Modelos de Lenguaje Grandes
7 published articles
Benchmark de razonamiento financiero
Los LLM conocen las fórmulas contables. FinIndices demuestra que no saben aplicarlas
Los LLM pueden recitar fórmulas contables, pero FinIndices, un benchmark construido sobre estados financieros reales de empresas chinas, demuestra que les cuesta aplicarlas. La precisión de Gemini-3.1-Pro cayó del 70.70% al 38.22% al eliminar las pistas de fórmulas, y la generación de tablas degradó activamente el razonamiento de los modelos.
2026-08-20
Memoria de agentes
TEPA: para los agentes de IA, una memoria obsoleta es peor que ninguna
La memoria de los agentes tiene un problema de falseabilidad, sostiene una nueva preimpresión de arXiv: los hechos obsoletos siguen siendo recuperables y contaminan el prompt. Su mecanismo TEPA revoca las memorias superadas, y en las pruebas de deriva la memoria ingenua puntuó por debajo de la ausencia de memoria (0.210 frente a 0.309), mientras que TEPA alcanzó 0.950.
2026-08-19
Los pesos abiertos de Qwen3.8-Max llegan la próxima semana
El modelo más potente de Alibaba hasta la fecha se vuelve de código abierto
Qwen3.8-Max, el primer modelo de clase Max con pesos abiertos de Alibaba, con 2,4 billones de parámetros, llega a Hugging Face y ModelScope la próxima semana. El lanzamiento replantea la cuestión del código abierto: ¿qué ocurre cuando los pesos más grandes de la frontera son libres de descargar y probar?
2026-08-06
IA de Código Abierto
Kimi K3 es el modelo abierto más grande jamás creado. Pero aún no es el mejor.
Kimi K3 es el modelo abierto más grande con 2,8 billones de parámetros, pero no logra superar a los mejores modelos propietarios en los benchmarks generales. Si bien sobresale en tareas específicas de codificación y agentivas, la brecha con los líderes de frontera como Claude Fable 5 y GPT 5.6 Sol expone los límites del escalado sin avances arquitectónicos y de datos.
2026-07-27
Filosofía de la IA
No, la IA no es una mente rival. Es una extensión de la nuestra
Basándose en la fenomenología de Husserl, los investigadores sostienen que los sistemas de IA se entienden mejor como extensiones de la inteligencia natural, no como mentes autónomas. Esta perspectiva explica las alucinaciones y los fallos composicionales, al tiempo que desplaza los debates sobre seguridad de los temores a una IA rebelde hacia una ingeniería y gobernanza responsables.
2026-07-09
Privacidad Digital
Tu IA acaba de escribir tu obituario en 17 diapositivas. Ese es el problema.
Un resumen generado por IA de tu vida en 17 diapositivas suena como un truco de productividad, pero plantea preguntas incómodas sobre cuánto concedemos voluntariamente a máquinas que aprenden cada uno de nuestros hábitos.
2026-07-07
Datos sintéticos
Sin jefe, sin cuello de botella: por qué un marco peer-to-peer está repensando la generación de datos sintéticos
Matrix es un marco descentralizado que utiliza mensajes serializados enviados a través de colas distribuidas para la generación de datos sintéticos multiagente. Al eliminar el orquestador central, logra un rendimiento entre 2 y 15 veces mayor en hardware idéntico.
2026-06-06