Últimos Artículos del mundo de la Inteligencia Artificial
27 julio 2026
Jacobian lens: lo que Claude 'piensa' y no dice
Cuando un paper sobre inteligencia artificial habla de "mente", de "espacio de trabajo" y de "pensamientos no dichos", estamos ante metáforas útiles para hacer accesibles conceptos complejos, pero también potencialmente engañosas precisamente para el público al que deberían simplificar las cosas. El 6 de julio Anthropic publicó un nuevo estudio que usa exactamente este tipo de lenguaje, y en los días siguientes la red se dividió entre quienes leyeron la noticia como la antesala de una máquina consciente y quienes la descartaron como ingeniería disfrazada de filosofía. La verdad, como sucede a menudo, está en el medio, pero para encontrarla hay que separar con cuidado los datos de las palabras elegidas para contarlos.
24 julio 2026
Loop Engineering: ¿moda del momento o próximo salto?
A mediados de junio, un post de Peter Steinberger, desarrollador conocido por haber construido y luego vendido PSPDFKit, circula durante semanas entre los expertos: los agentes de IA ya no se promptean, se diseñan los loops que los hacen funcionar. Pocas líneas, tono de revelación, y en cuestión de pocos días el término "loop engineering" aparece en todas partes, desde Analytics Vidhya hasta los blogs corporativos especializados en infraestructuras para agentes como Requesty. Incluso Boris Cherny, entre los arquitectos de Claude Code, refuerza la idea hablando de un salto comparable al del código fuente compilado a los agentes autónomos, como relata BDTechTalks reconstruyendo la génesis del debate.
22 julio 2026
Por qué los benchmarks de los agentes de IA subestiman las capacidades reales
Durante años hemos tratado la capacidad de un agente de IA como un número fijo, casi como si fuera el tiempo de un velocista: se corre, se cronometra, se escribe el resultado en una pizarra. ¿Pero y si ese número dependiera del aliento que concedemos al corredor antes de detenerlo? Un informe publicado el 2 de julio de 2026 por el AI Security Institute, el instituto de seguridad de IA del gobierno británico, sugiere que es exactamente este el error oculto en muchas evaluaciones de los agentes: los estamos cronometrando con un silbato que suena demasiado pronto.
20 julio 2026
Colibrì: el minimotor que hace funcionar un modelo de 744B en hardware consumer
Cada semana, la comunidad de código abierto de la inteligencia artificial local parece buscar su tema de conversación favorito, y la que acaba de pasar parece haber elegido un repositorio en GitHub con un nombre curioso y una promesa casi absurda: hacer funcionar GLM-5.2, un modelo Mixture-of-Experts de 744 mil millones de parámetros, en un ordenador con apenas 25 GB de RAM. El proyecto se llama Colibrì y es obra de un solo desarrollador, JustVugg, quien en la sección de agradecimientos de su README admite con una honestidad desarmante haber escrito y probado todo en un portátil de doce núcleos. Sin laboratorio, sin clúster, sin patrocinio de hardware. Solo una obsesión técnica llevada hasta el final.
17 julio 2026
DSpark: la apuesta de DeepSeek por la velocidad que no traiciona la calidad
DeepSeek no ha presentado solo un nuevo enfoque para el speculative decoding; con DeepSpec está intentando transformarlo en una pipeline industrial reproducible. El paper se llama DSpark, las siglas son las enésimas de una larga serie que el laboratorio chino saca con frecuencia casi trimestral, y la tentación de leerlas distraídamente es fuerte. Sería un error, porque detrás del acrónimo se esconde una pregunta muy concreta: cuánto puede acelerar realmente la inferencia de un modelo de lenguaje si el modelo que genera los borradores de respuesta deja de ser ingenuo, y si el sistema que los controla aprende a no perder tiempo en los destinados a la papelera.
15 julio 2026
He enseñado a la IA a hacer de guardia: cómo he construido un sistema de seguridad a coste cero
En la serie de televisión 'Person of Interest', una superinteligencia apodada simplemente "la Máquina" vigila cada rincón del planeta a través de cámaras, micrófonos y sensores de todo tipo, identificando amenazas antes de que se materialicen. Es ciencia ficción, por supuesto. Pero la idea de fondo, es decir, usar la visión artificial para entender qué sucede en un entorno, es ahora accesible para cualquiera que tenga un PC y una webcam. Menos de 250 líneas de código. Sin suscripciones, sin nube, sin vídeos que viajen por el mundo. Solo una notificación en el teléfono, con foto, cuando alguien entra en casa.
13 julio 2026
La IA corre, el mundo camina: qué dice el primer informe científico de la ONU
Hay una escena en Serial Experiments Lain en la que la protagonista descubre que la red a la que ha estado conectada siempre ha dejado de ser una herramienta y se está convirtiendo en un entorno, algo que la incluye y la define sin que nadie haya decidido conscientemente jamás que sucediera. Pues bien, al leer el primer informe científico independiente de las Naciones Unidas sobre la inteligencia artificial, viene a la mente precisamente esa sensación: un sistema que se ha extendido más rápido que nuestra capacidad para describirlo, y ahora alguien intenta finalmente hacerlo con método.
10 julio 2026
Ornith-1.0 35B en local: el desconocido que bate a todos
Hay un momento, en cada sesión con un nuevo modelo descargado en local, en el que comprendéis si tenéis delante un juguete o una herramienta de trabajo. Con Ornith-1.0-35B ese momento llegó en el segundo prompt, cuando subí la foto borrosa de una hoja de Excel corporativa esperando la habitual respuesta vaga, y me encontré con un verdadero análisis de balance, completo con señales de alarma sobre la liquidez. A partir de ahí, la sesión de prueba tomó un rumbo diferente al habitual.
08 julio 2026
GLM-5.2: el open-weight chino che cierra la brecha, al menos en el coding
Cuando Z.ai, el laboratorio que en China todos conocen aún como Zhipu AI, lanzó GLM-5 el pasado febrero, el mensaje ya era claro: la serie GLM no buscaba ser simplemente competitiva, buscaba ser relevante para quienes hacen software. Aquel modelo de 744 mil millones de parámetros con arquitectura Mixture-of-Experts había puesto sobre la mesa un rendimiento que no desentonaba junto a los grandes propietarios, con la diferencia nada secundaria de los pesos abiertos bajo licencia MIT. Poco más de cuatro meses después, el 13 de junio de 2026, Z.ai ha vuelto a subir la apuesta: GLM-5.2 llegó primero a los niveles del GLM Coding Plan, los planes de suscripción dedicados a los desarrolladores, y luego, el 16 de junio, a la API pública y a Hugging Face con los pesos libremente descargables.
06 julio 2026
¿Necesitáis realmente el último modelo de AI? ¿O estáis actualizando vuestro ego tecnológico?
¿Necesitáis realmente el último modelo estado del arte para realizar vuestro trabajo diario? Si vuestra respuesta es "sí", ¿estáis seguros de que no os ha engañado el marketing de las grandes tecnológicas? Anthropic acaba de lanzar Claude Opus 4.8, OpenAI ya tiene en marcha la próxima versión de ChatGPT, y todos nos empujan a perseguir el modelo más reciente como si nuestra productividad dependiera de ese último decimal de un benchmark. Sin embargo, para el 90% de las actividades cotidianas, un modelo eficiente como, por ejemplo, DeepSeek V4 Flash cuesta una fracción del precio y hace exactamente lo mismo. ¿Os recuerda a algo? A mí sí, e intentaré contároslo.
03 julio 2026
Headroom: el compresor de tokens que no usa la IA para comprimir la IA
Hay una paradoja silenciosa en el corazón de muchos sistemas de inteligencia artificial modernos. Los ingenieros construyen agentes sofisticados, capaces de razonar, planificar y coordinar secuencias complejas de acciones. Luego miran la factura mensual de la API y se dan cuenta de que el gasto más grande no es el razonamiento, no es la creatividad, ni siquiera es la precisión. Es el tráfico. El puro y banal volumen de texto que los componentes intercambian entre sí.
01 julio 2026
Last30days: cuando un agente de código se convierte en un motor de búsqueda social
Antes de escribir algo sobre la IA, abrí once pestañas del navegador: Reddit, X, YouTube, Hacker News, GitHub, algunas newsletters del sector. Dos horas después, tres cafés mediante, había encontrado tres posts realmente útiles. El resto era ruido: artículos de blog optimizados para motores de búsqueda, opiniones de personas pagadas por tenerlas, clásicas galerías del tipo "las diez herramientas de IA que cambiarán su vida" escritas con la misma profundidad que una hoja de instrucciones de un mueble de IKEA.
29 junio 2026
La KV cache y el peso de la atención: tres caminos, un problema
Llama-3.1-70B, ejecutado en precisión BF16, acumula unos 0,31 megabytes de KV cache por cada token procesado. Con un contexto de 128.000 tokens, la cuenta sube a 40 gigabytes, una cifra ya incómoda. Con un millón de tokens, el estándar hacia el cual se están impulsando los modelos más recientes, se superan los 300 gigabytes: más de los 140 gigabytes ocupados por los pesos del propio modelo. Es un detalle que anula una intuición generalizada: que la memoria crítica en un gran modelo de lenguaje es la de sus parámetros. Ya no es así, o al menos no siempre. La memoria que realmente asusta a quienes diseñan sistemas de inferencia de contexto largo es la de la KV cache, el archivo donde el modelo guarda las representaciones de clave (key) y valor (value) de cada token ya visto, para no tener que volver a calcularlo todo desde cero con cada nueva palabra generada.
26 junio 2026
Cursos cancelados a favor de la IA: China reescribe la universidad
Hay una escena, relatada por el South China Morning Post, que vale más que mil estadísticas: un recién graduado en diseño industrial explica que su curso fue suspendido porque la inteligencia artificial ha golpeado duramente precisamente a ese sector, donde el modelado y el rendering pueden ahora ser realizados, en gran parte o en su totalidad, por un algoritmo. No es un caso aislado, sino el síntoma de una transformación que ha atravesado todo el sistema universitario chino en un puñado de años y con una determinación que en Occidente no tiene equivalente.
24 junio 2026
La guerra algorítmica. Fable 5 el dedo, Europa la Luna
El 12 de junio de 2026 el Departamento de Comercio de los Estados Unidos envió a Anthropic una carta que, en los círculos del sector, circuló con la velocidad de las noticias que dan miedo de verdad: suspensión obligatoria de los modelos Fable 5 y Mythos para cualquier ciudadano extranjero, dentro o fuera de las fronteras americanas. La motivación oficial es la seguridad nacional. Grupos vinculados a Pekín habrían obtenido acceso a Mythos, la versión sin guardarraíles (guardrails) pensada para aplicaciones de ciberseguridad, eludiendo los sistemas de control de acceso. Una violación grave, si se confirma, no cabe duda. Pero quedarse en esta noticia, como están haciendo muchos, obsesionados con los nombres Fable 5 y Mythos como si fueran personajes de una serie distópica, es como mirar el dedo y no la luna.
22 junio 2026
BenzUp: he creado una aplicación sin escribir una sola línea de código
Hay un momento preciso en el que una idea deja de ser una fantasía de bar y se convierte en algo concreto. En mi caso, ese momento tuvo como protagonistas, por orden: el coste de la gasolina, un ingeniero estadounidense molesto por una cerveza cara en Dublín, y un modelo de inteligencia artificial accesible para cualquiera con una conexión a Internet. El resultado se llama BenzUp, es gratuito, no hace nada revolucionario, y quizás sea precisamente por eso por lo que merece la pena contarlo.