LLMs y Modelos4 min read
Cuello de botella
El nuevo benchmark de Alibaba demuestra lo que los agentes de IA aún no pueden hacer: seguir las reglas
El benchmark HSCodeComp de Alibaba revela la brecha: los mejores agentes alcanzan un 49,4% de precisión frente al 95% de los expertos humanos en clasificación arancelaria. El cuello de botella es estructural, más capacidad de cómputo no ayuda.
2026-07-19