IA
Inteligencia artificial: LLMs, agentes, difusión, visión, PLN y lo último de los principales laboratorios.
565 published articles
Herramientas de detección de IA
Un acuerdo de libro de 2 millones de dólares se derrumbó por una acusación de IA
Editores y escuelas actúan sobre las señales de los detectores de IA de formas que arruinan carreras: un acuerdo de libro de 2 millones de dólares cancelado, suspensiones, demandas. Los propios fabricantes de las herramientas admiten que no son lo bastante precisas para actuar en consecuencia. Bienvenidos a la era de la desconfianza.
2026-08-16
Agentes de IA · Código abierto
DeepSeek lanza un harness de agentes donde incluso el modelo es un plugin
DeepSeek publicó DeepSeek Harness, un runtime de agentes de código abierto donde los modelos, las herramientas, los sandboxes y la interfaz de usuario son todos plugins de Cordis. Los registros de sesión de solo añadidura y un modo mínimo de dos herramientas apuntan a una ambición más discreta: ejecuciones de agentes auditables y reproducibles.
2026-08-16
El caballo de batalla de Google, más grande en la actualización 3.7
Gemini 3.7 Flash reduce su precio a la mitad y luego lo justifica
El Gemini 3.7 Flash de Google llega a la mitad del precio introductorio del 3.6 Flash mientras afirma mejoras en los puntos de referencia de programación, desarrollo web y trabajo del conocimiento. El lanzamiento se produce tres semanas después del Flash anterior y trae consigo un nuevo argumento de relación precio-rendimiento para desarrolladores de agentes.
2026-08-16
IA de código abierto: Alibaba abre el nivel Max
Qwen 3.8-Max: el modelo más potente de Alibaba ya se puede descargar gratis
Alibaba está publicando como código abierto Qwen 3.8-Max, su modelo más capaz hasta la fecha: un MoE de 2,4 billones de parámetros que supera a GPT-5.6 Sol en SWE-bench Pro, PaperBench e IFBench. Analizamos las salvedades de los benchmarks y lo que significa un modelo insignia abierto con 95 mil millones de parámetros activos para los desarrolladores.
2026-08-16
Codificación agéntica e hinchazón de prompts
Recuerdo catastrófico: por qué los archivos CLAUDE.md crecen un 226% y nunca se reducen
Un estudio de arXiv sobre 1.867 repositorios revela que los archivos de instrucciones de codificación agéntica como CLAUDE.md triplican su tamaño a lo largo de su vida, porque eliminar una línea arriesga regresiones una vez que se pierde su razonamiento. Los autores lo llaman recuerdo catastrófico y demuestran que documentar el razonamiento reduce las instrucciones excesivas en un 99,3%.
2026-08-15
Investigación en IA
Basta de copiar y pegar habilidades: la solución sin evaluación de SkillZip para agentes inflados
Los agentes autoevolutivos añaden correcciones hasta que la misma regla aparece en varias ramas. SkillZip comprime sus habilidades sin rollouts de evaluación, al encontrar la explicación estructural fiel más corta. Modos One-shot y Zip-on-Write, y lo que el resumen deja sin demostrar.
2026-08-15
Multimodal / Código abierto
El paquete de plugins de Qwen le da a tu agente de código ojos, manos y memoria de video
El equipo de Qwen de Alibaba lanzó Qwen-MM-Plugins, un kit de herramientas Apache-2.0 que brinda a los agentes de código habilidades multimodales nativas: lectura de imágenes y video con resolución dinámica, OCR, grounding, ASR, memoria de video largo, generación de video y control de cliente ligero de Blender y FreeCAD. Un solo script lo instala en Claude Code, Codex, Qoder, OpenClaw, Qwen Code y Gemini CLI.
2026-08-15
Agentes de IA
Cuando las habilidades de los agentes fallan, SkillProx las poda como el descenso de gradiente
Se suponía que las habilidades harían más inteligentes a los agentes, pero cada corrección que acumulan puede hacerlos más torpes. SkillProx ejecuta un bucle hacia adelante y hacia atrás inspirado en el gradiente proximal que diagnostica, revierte y elimina. Resultado: una ganancia media de precisión de 3.0 puntos sobre la línea base basada en gradiente más sólida.
2026-08-14
Agentes de IA
Grok Bot va tras el último 10% del trabajo que la mayoría de la IA deja sin terminar
Grok Bot, el nuevo producto de agente de xAI, funciona en su propia computadora en la nube, se conecta a las herramientas que ya usas, aprende flujos de trabajo al verte hacerlos una vez y termina el trabajo de principio a fin. La idea detrás: la mayoría de la IA se detiene al 90%.
2026-08-14
Economía de la IA
El plan de $18 de Alibaba ejecuta Qwen y DeepSeek dentro de Claude Code
El Token Plan Individual de Alibaba Cloud agrupa Qwen y modelos de terceros como DeepSeek en un único fondo de créditos, desde $6 al mes, utilizable dentro de Claude Code y Cursor. La compañía afirma un ahorro de aproximadamente el 40% frente al pago por uso, pero el plan solo funciona desde Singapur y solo dentro de las herramientas aprobadas.
2026-08-14
Modelos de IA | NVIDIA Nemotron 3.5 Lightning
Por qué Nemotron 3.5 Lightning apuesta a que la mayoría de los pasos de un agente no necesitan un modelo grande
El nuevo modelo abierto de Nvidia se ejecuta localmente con 3B de parámetros activos y un contexto de 1M de tokens, diseñado para agentes que permanecen en ejecución. Nvidia afirma hasta 4 veces más rendimiento y un 30 % más rápido en la finalización de tareas que los modelos abiertos comparables.
2026-08-14
Investigación en IA de video
Cómo Context-Matched Distillation impide que los maestros de video vean el futuro
Durante mucho tiempo, la destilación de video ha entrenado a estudiantes causales con profesores que puntúan clips completos usando conocimiento futuro. CMD reemplaza esa puntuación con un profesor causal, añade objetivos puntuados por prefijo y reporta resultados de vanguardia entre los métodos autorregresivos.
2026-08-14