SevenTnewS

Agentes de IA

Agentes autónomos, flujos de trabajo multiagente y orquestación.

45 published articles

6 min read

Agentes de IA

El enjambre de Cursor reconstruyó SQLite desde cero. Mismos resultados, facturas radicalmente distintas

El rediseñado enjambre de agentes de Cursor reconstruyó SQLite en Rust solo a partir de su manual y superó la suite de verificación completa, reduciendo los conflictos de fusión de más de 70.000 a menos de 1.000. Cada combinación de modelos ofreció una calidad similar a precios muy distintos, y esa brecha es la historia.

2026-08-05

2 min read

Autonomía de red

Un punto ciego de confianza en redes de agentes de múltiples proveedores recibe una solución

Cuando la herramienta del Proveedor B se ve comprometida, los agentes del Proveedor A siguen usándola sin saberlo. Un nuevo artículo propone una máquina de estados de confianza con propagación de cascada amortiguada para reducir la contención de horas a tiempo casi real.

2026-08-04

5 min read

Agentes de IA

El bot de Slack de Hugging Face consulta datos de producción. El LLM nunca ve las claves

Hugging Face ejecuta un agente de codificación interno de Slack, Moon Bot, que puede consultar bases de datos de producción y abrir PRs. Su diseño de seguridad mantiene las credenciales fuera del alcance del modelo mediante niveles de Okta, bash en sandbox y proxies inversos locales que inyectan las claves en el lado del servidor.

2026-08-04

4 min read

Infraestructura de IA

Hacer que los agentes paguen es fácil. Hacerlos confiables no lo es.

El Agent Stack de Circle proporciona los rieles financieros para la economía de agentes: pagos en USDC, políticas de gasto y un registro de servicios. Pero la verdadera barrera no es la tecnología, es la gobernanza. Sin registros de auditoría transparentes y barreras programables, la promesa del comercio autónomo sigue siendo teórica.

2026-08-04

4 min read

Agentes de IA

La promesa de agentes 24/7 de Zuckerberg choca con el problema de confianza de Meta

Zuckerberg promete agentes de consumo 24/7 para salud, relaciones y finanzas, y los llama la próxima ola de ingresos de Meta. La distribución es real a escala de WhatsApp, pero un déficit de confianza y la falta de ecosistemas de datos se interponen entre la visión y los miles de millones de usuarios que necesita.

2026-08-03

3 min read

Desarrollo de IA

Los agentes de codificación están dejando tu máquina local: Alibaba y Mistral se vuelven remotos

Qoder de Alibaba Cloud introduce la delegación remota para agentes de codificación, permitiendo a los desarrolladores descargar tareas de larga duración en sandboxes en la nube. La función, combinada con un nuevo motor de conocimiento, enfrenta a Qoder directamente contra los agentes remotos de Mistral en una carrera por desacoplar el desarrollo asistido por IA del terminal local.

2026-08-03

4 min read

Agentes LLM

El impuesto de regresión: por qué cargar a los agentes LLM con habilidades puede resultar contraproducente

Un nuevo estudio muestra que agregar habilidades procedimentales a los agentes LLM no siempre ayuda, puede introducir regresiones, donde tareas previamente resueltas sin habilidades fallan después de agregarlas. La investigación identifica tres causas y argumenta que la fiabilidad depende más del anclaje y la verificación que de la habilidad en sí misma.

2026-08-03

2 min read

Enrutamiento de IA

Para la IA agéntica, el enrutamiento por llamada es el punto ciego. TRACE-Router tiene una solución.

Un nuevo marco de enrutamiento, TRACE-Router, aborda el desajuste entre los enrutadores de LLM por llamada y las métricas de éxito a nivel de tarea en la IA agéntica, obteniendo hasta 8 puntos de precisión y un 36% menos de latencia.

2026-08-01

3 min read

IA industrial

AgentRCA: análisis de causa raíz zero-shot que explica su propio razonamiento

Un framework agéntico zero-shot llamado AgentRCA utiliza un gemelo digital y un LLM para diagnosticar fallos en plantas sin datos etiquetados, logrando una precisión a nivel supervisado con total transparencia.

2026-08-01

3 min read

IA de investigación profunda

El nuevo agente de investigación de BAAI no solo busca más tiempo, sino que revisa su propia tarea

Los agentes AREX de BAAI utilizan un bucle de auto-mejora recursiva que comprime historiales de investigación largos, permitiendo un refinamiento eficiente impulsado por la verificación. Entrenados con una novedosa receta de RL de horizonte largo, superan a las líneas base comparables en BrowseComp, DeepSearchQA y HLE.

2026-07-31

3 min read

Agentes GUI

El Qwen-UI-Agent de Alibaba obtiene mejores resultados en teléfonos reales que en sandboxes

El Qwen-UI-Agent de Alibaba Tongyi Lab afirma obtener puntuaciones móviles de última generación (97.5% en AndroidDaily) y resultados competitivos en uso de computadora frente a Opus 4.8, Gemini 3.1 Pro y GPT-5.6 Sol. Su puntuación en el benchmark de dispositivos reales supera la de sandbox, mientras que el progreso parcial del 40% en OSWorld-v2 es el límite honesto.

2026-07-31

Featured2 min read

Ingeniería Multiagente

El experimento multiagente de Qoder: 60% menos errores, ¿pero a qué costo?

Un análisis del Qoder Experts Mode de Alibaba Cloud, que despliega agentes de IA especializados como un equipo coordinado. Las afirmaciones de reducción significativa de errores se examinan en función de casos de uso reales y las compensaciones de la complejidad multi-agente.

2026-07-31

← PreviousPage 2 / 4 · 45 articlesNext →