SevenTnewS

sistemas agentivos

3 published articles

IA5 min read

Inteligencia Artificial

Lo que el despliegue revela sobre los sistemas agentivos que los benchmarks pasan por alto

Un nuevo tutorial sobre sistemas agentivos destaca la brecha entre el éxito en benchmarks y la fiabilidad en producción. Los investigadores comparten patrones concretos para manejar fallos, desde pipelines de verificación hasta diseño con participación humana, basándose en casos de estudio en descubrimiento de fármacos y finanzas.

2026-07-24

LLMs y Modelos4 min read

Diseño de Sistemas / Infraestructura de LLM

Por qué el enrutamiento de modelos es un problema de sistemas, no de clasificación

En 417 tareas de agentes, GPT-4.1 resultó ser casi el doble de caro que Sonnet a pesar de tener un precio de lista más bajo, porque el almacenamiento en caché, no las tarifas base, dominó el costo. Un análisis profundo sobre por qué el enrutamiento de modelos falla cuando se trata como clasificación y cómo construir enrutadores que optimicen simultáneamente costo, latencia y precisión.

2026-07-15

IA3 min read

Análisis de investigación

Corrupción de documentos por IA en flujos de trabajo delegados: lo que revela una nueva prueba de estrés

El punto de referencia DELEGATE-52 evalúa sistemas de IA en tareas de edición de documentos delegadas de largo alcance, encontrando que los modelos frontera acumulan una pérdida de fidelidad semántica del 19, 34% en 20 iteraciones. Los flujos de trabajo en Python mostraron menos del 1% de degradación en promedio, pero el estudio subraya que la delegación confiable a largo plazo sigue siendo un desafío abierto.

2026-07-04