Agentes de IA
Agentes autónomos, flujos de trabajo multiagente y orquestación.
45 published articles
Herramientas de diseño
Open Design 0.18.0 pone fin a la reunión de «¿esta es la última versión?»
Open Design 0.18.0 incluye un espacio de trabajo de equipo compartido con espejos vivos de solo lectura y permite que Codex invoque el motor de diseño sin interfaz. 115 solicitudes de extracción de 22 colaboradores aterrizaron en dos días. Esto es lo que cambió y la tendencia de herramientas de agentes en la que encaja.
2026-08-21
Memoria de agentes
TEPA: para los agentes de IA, una memoria obsoleta es peor que ninguna
La memoria de los agentes tiene un problema de falseabilidad, sostiene una nueva preimpresión de arXiv: los hechos obsoletos siguen siendo recuperables y contaminan el prompt. Su mecanismo TEPA revoca las memorias superadas, y en las pruebas de deriva la memoria ingenua puntuó por debajo de la ausencia de memoria (0.210 frente a 0.309), mientras que TEPA alcanzó 0.950.
2026-08-19
Agentes de IA
PsychoAgent dotó a los agentes de IA de memoria emocional. Los evaluadores no encontraron ventaja
PsychoAgent ofrece a los agentes LLM una memoria afectiva separada para que los rastros emocionalmente salientes y cargados de conflicto puedan pesar más que los meramente temáticos. En tres escenarios de conflicto recuperó más memorias críticas para el conflicto que ambas líneas base (0.933 frente a 0.500 y 0.667), aunque cinco evaluadores ciegos no encontraron una ventaja significativa de calidad.
2026-08-19
Codificación agéntica e hinchazón de prompts
Recuerdo catastrófico: por qué los archivos CLAUDE.md crecen un 226% y nunca se reducen
Un estudio de arXiv sobre 1.867 repositorios revela que los archivos de instrucciones de codificación agéntica como CLAUDE.md triplican su tamaño a lo largo de su vida, porque eliminar una línea arriesga regresiones una vez que se pierde su razonamiento. Los autores lo llaman recuerdo catastrófico y demuestran que documentar el razonamiento reduce las instrucciones excesivas en un 99,3%.
2026-08-15
Investigación en IA
Basta de copiar y pegar habilidades: la solución sin evaluación de SkillZip para agentes inflados
Los agentes autoevolutivos añaden correcciones hasta que la misma regla aparece en varias ramas. SkillZip comprime sus habilidades sin rollouts de evaluación, al encontrar la explicación estructural fiel más corta. Modos One-shot y Zip-on-Write, y lo que el resumen deja sin demostrar.
2026-08-15
Agentes de IA
Cuando las habilidades de los agentes fallan, SkillProx las poda como el descenso de gradiente
Se suponía que las habilidades harían más inteligentes a los agentes, pero cada corrección que acumulan puede hacerlos más torpes. SkillProx ejecuta un bucle hacia adelante y hacia atrás inspirado en el gradiente proximal que diagnostica, revierte y elimina. Resultado: una ganancia media de precisión de 3.0 puntos sobre la línea base basada en gradiente más sólida.
2026-08-14
Seguridad de terminal
La trampa de '$HOME': los agentes de codificación de IA necesitan sandboxes, no avisos de '¿permitir?'
El sandbox de terminal de Qoder bloquea cerca de un centenar de comandos destructivos de agentes cada día. Los casos detrás de esos bloqueos explican por qué fallan los avisos de '¿permitir?': una carpeta de proyecto llamada $HOME, una limpieza que apuntaba a /root, y un clic que casi cuesta un disco entero.
2026-08-13
IA clínica
nMAS automatiza las características de EHR para insuficiencia cardíaca, probado solo con 500 pacientes simulados
nMAS, un pipeline multiagente, generó 132 características estructuradas y 70 puntuadas mediante rúbrica a partir de 500 registros de pacientes simulados, elevando el AUROC de fenotipado de HFrEF en el conjunto reservado de 0,895 a 0,963. El preprint no ha sido validado con datos reales de pacientes.
2026-08-13
Qoder Computer Use
Un ingeniero lanzó un agente macOS sin saber Swift
Un ingeniero que no sabía leer Swift lanzó software macOS de calidad de producción con Computer Use de Qoder. Su enfoque: juzgar el código por el comportamiento, hacer que el Agente genere sus propias pruebas y guardar cada lección en el sistema de archivos para que ninguna ronda comience desde cero.
2026-08-12
Agentes de IA y DevOps
Una pregunta de una sola frase en Qoder pone fin a la búsqueda de causa raíz de 40 minutos
El plugin STAROps de Alibaba Cloud incorpora el diagnóstico de causa raíz en lenguaje natural al IDE Qoder. Su demo presenta un pico de P95 que pasa de menos de 60 ms a 1,9 segundos, devuelve una cadena de evidencia con un 80% de confianza y termina con un merge request creado automáticamente. La resolución tradicional de problemas tomaba más de 40 minutos en cinco plataformas.
2026-08-09
UI agéntica
Qoder Canvas: un sistema de diseño creado para agentes, no para humanos
El equipo de Qoder de Alibaba sostiene que la ventana de chat es el contenedor equivocado para la salida compleja de los agentes. Qoder Canvas aplica el pensamiento de los sistemas de diseño a las interfaces de los agentes, y enseña a los agentes a construir artefactos interactivos y conscientes del código base en lugar de muros de Markdown.
2026-08-07
Codificación con IA
OpenCode apuesta por la eficiencia de tokens y añade Ling 3.0 Flash gratis
OpenCode ahora ofrece el Ling 3.0 Flash de inclusionAI de forma gratuita, días después de su lanzamiento. La medida amplía una estrategia consciente de los costos que apuesta a que la eficiencia de tokens gana la carrera de la codificación con IA.
2026-08-07