fundamentación
2 published articles
Agentes LLM
El impuesto de regresión: por qué cargar a los agentes LLM con habilidades puede resultar contraproducente
Un nuevo estudio muestra que agregar habilidades procedimentales a los agentes LLM no siempre ayuda, puede introducir regresiones, donde tareas previamente resueltas sin habilidades fallan después de agregarlas. La investigación identifica tres causas y argumenta que la fiabilidad depende más del anclaje y la verificación que de la habilidad en sí misma.
2026-08-03
Evaluación fundamentada vs. no fundamentada
Por qué la autoevaluación de tu modelo de IA falla en la calidad visual
Una nueva investigación introduce la 'fundamentación' como la variable clave que gobierna un tercer eje del cómputo en tiempo de prueba: el escalado de interacción. Los hallazgos muestran que un instrumento determinista que mide el diseño real supera a la evaluación VLM sobre captura de pantalla, arreglando el 40, 74% de los defectos en modalidades visuales mientras la métrica estándar no ve nada.
2026-07-31