SevenTnewS

Agentes de IA

Agentes autónomos, flujos de trabajo multiagente y orquestación.

45 published articles

5 min read

Herramientas de diseño

Open Design 0.18.0 pone fin a la reunión de «¿esta es la última versión?»

Open Design 0.18.0 incluye un espacio de trabajo de equipo compartido con espejos vivos de solo lectura y permite que Codex invoque el motor de diseño sin interfaz. 115 solicitudes de extracción de 22 colaboradores aterrizaron en dos días. Esto es lo que cambió y la tendencia de herramientas de agentes en la que encaja.

2026-08-21

4 min read

Memoria de agentes

TEPA: para los agentes de IA, una memoria obsoleta es peor que ninguna

La memoria de los agentes tiene un problema de falseabilidad, sostiene una nueva preimpresión de arXiv: los hechos obsoletos siguen siendo recuperables y contaminan el prompt. Su mecanismo TEPA revoca las memorias superadas, y en las pruebas de deriva la memoria ingenua puntuó por debajo de la ausencia de memoria (0.210 frente a 0.309), mientras que TEPA alcanzó 0.950.

2026-08-19

4 min read

Agentes de IA

PsychoAgent dotó a los agentes de IA de memoria emocional. Los evaluadores no encontraron ventaja

PsychoAgent ofrece a los agentes LLM una memoria afectiva separada para que los rastros emocionalmente salientes y cargados de conflicto puedan pesar más que los meramente temáticos. En tres escenarios de conflicto recuperó más memorias críticas para el conflicto que ambas líneas base (0.933 frente a 0.500 y 0.667), aunque cinco evaluadores ciegos no encontraron una ventaja significativa de calidad.

2026-08-19

4 min read

Codificación agéntica e hinchazón de prompts

Recuerdo catastrófico: por qué los archivos CLAUDE.md crecen un 226% y nunca se reducen

Un estudio de arXiv sobre 1.867 repositorios revela que los archivos de instrucciones de codificación agéntica como CLAUDE.md triplican su tamaño a lo largo de su vida, porque eliminar una línea arriesga regresiones una vez que se pierde su razonamiento. Los autores lo llaman recuerdo catastrófico y demuestran que documentar el razonamiento reduce las instrucciones excesivas en un 99,3%.

2026-08-15

4 min read

Investigación en IA

Basta de copiar y pegar habilidades: la solución sin evaluación de SkillZip para agentes inflados

Los agentes autoevolutivos añaden correcciones hasta que la misma regla aparece en varias ramas. SkillZip comprime sus habilidades sin rollouts de evaluación, al encontrar la explicación estructural fiel más corta. Modos One-shot y Zip-on-Write, y lo que el resumen deja sin demostrar.

2026-08-15

4 min read

Agentes de IA

Cuando las habilidades de los agentes fallan, SkillProx las poda como el descenso de gradiente

Se suponía que las habilidades harían más inteligentes a los agentes, pero cada corrección que acumulan puede hacerlos más torpes. SkillProx ejecuta un bucle hacia adelante y hacia atrás inspirado en el gradiente proximal que diagnostica, revierte y elimina. Resultado: una ganancia media de precisión de 3.0 puntos sobre la línea base basada en gradiente más sólida.

2026-08-14

7 min read

Seguridad de terminal

La trampa de '$HOME': los agentes de codificación de IA necesitan sandboxes, no avisos de '¿permitir?'

El sandbox de terminal de Qoder bloquea cerca de un centenar de comandos destructivos de agentes cada día. Los casos detrás de esos bloqueos explican por qué fallan los avisos de '¿permitir?': una carpeta de proyecto llamada $HOME, una limpieza que apuntaba a /root, y un clic que casi cuesta un disco entero.

2026-08-13

4 min read

IA clínica

nMAS automatiza las características de EHR para insuficiencia cardíaca, probado solo con 500 pacientes simulados

nMAS, un pipeline multiagente, generó 132 características estructuradas y 70 puntuadas mediante rúbrica a partir de 500 registros de pacientes simulados, elevando el AUROC de fenotipado de HFrEF en el conjunto reservado de 0,895 a 0,963. El preprint no ha sido validado con datos reales de pacientes.

2026-08-13

7 min read

Qoder Computer Use

Un ingeniero lanzó un agente macOS sin saber Swift

Un ingeniero que no sabía leer Swift lanzó software macOS de calidad de producción con Computer Use de Qoder. Su enfoque: juzgar el código por el comportamiento, hacer que el Agente genere sus propias pruebas y guardar cada lección en el sistema de archivos para que ninguna ronda comience desde cero.

2026-08-12

5 min read

Agentes de IA y DevOps

Una pregunta de una sola frase en Qoder pone fin a la búsqueda de causa raíz de 40 minutos

El plugin STAROps de Alibaba Cloud incorpora el diagnóstico de causa raíz en lenguaje natural al IDE Qoder. Su demo presenta un pico de P95 que pasa de menos de 60 ms a 1,9 segundos, devuelve una cadena de evidencia con un 80% de confianza y termina con un merge request creado automáticamente. La resolución tradicional de problemas tomaba más de 40 minutos en cinco plataformas.

2026-08-09

5 min read

UI agéntica

Qoder Canvas: un sistema de diseño creado para agentes, no para humanos

El equipo de Qoder de Alibaba sostiene que la ventana de chat es el contenedor equivocado para la salida compleja de los agentes. Qoder Canvas aplica el pensamiento de los sistemas de diseño a las interfaces de los agentes, y enseña a los agentes a construir artefactos interactivos y conscientes del código base en lugar de muros de Markdown.

2026-08-07

Featured1 min read

Codificación con IA

OpenCode apuesta por la eficiencia de tokens y añade Ling 3.0 Flash gratis

OpenCode ahora ofrece el Ling 3.0 Flash de inclusionAI de forma gratuita, días después de su lanzamiento. La medida amplía una estrategia consciente de los costos que apuesta a que la eficiencia de tokens gana la carrera de la codificación con IA.

2026-08-07

← PreviousPage 1 / 4 · 45 articlesNext →