sistemas agentivos
3 published articles
Inteligencia Artificial
Lo que el despliegue revela sobre los sistemas agentivos que los benchmarks pasan por alto
Un nuevo tutorial sobre sistemas agentivos destaca la brecha entre el éxito en benchmarks y la fiabilidad en producción. Los investigadores comparten patrones concretos para manejar fallos, desde pipelines de verificación hasta diseño con participación humana, basándose en casos de estudio en descubrimiento de fármacos y finanzas.
2026-07-24
Diseño de Sistemas / Infraestructura de LLM
Por qué el enrutamiento de modelos es un problema de sistemas, no de clasificación
En 417 tareas de agentes, GPT-4.1 resultó ser casi el doble de caro que Sonnet a pesar de tener un precio de lista más bajo, porque el almacenamiento en caché, no las tarifas base, dominó el costo. Un análisis profundo sobre por qué el enrutamiento de modelos falla cuando se trata como clasificación y cómo construir enrutadores que optimicen simultáneamente costo, latencia y precisión.
2026-07-15
Análisis de investigación
Corrupción de documentos por IA en flujos de trabajo delegados: lo que revela una nueva prueba de estrés
El punto de referencia DELEGATE-52 evalúa sistemas de IA en tareas de edición de documentos delegadas de largo alcance, encontrando que los modelos frontera acumulan una pérdida de fidelidad semántica del 19, 34% en 20 iteraciones. Los flujos de trabajo en Python mostraron menos del 1% de degradación en promedio, pero el estudio subraya que la delegación confiable a largo plazo sigue siendo un desafío abierto.
2026-07-04