SevenTnewS

Modelos de Lenguaje Grandes

7 published articles

Pruebas y Benchmarks4 min read

Benchmark de razonamiento financiero

Los LLM conocen las fórmulas contables. FinIndices demuestra que no saben aplicarlas

Los LLM pueden recitar fórmulas contables, pero FinIndices, un benchmark construido sobre estados financieros reales de empresas chinas, demuestra que les cuesta aplicarlas. La precisión de Gemini-3.1-Pro cayó del 70.70% al 38.22% al eliminar las pistas de fórmulas, y la generación de tablas degradó activamente el razonamiento de los modelos.

2026-08-20

Agentes de IA4 min read

Memoria de agentes

TEPA: para los agentes de IA, una memoria obsoleta es peor que ninguna

La memoria de los agentes tiene un problema de falseabilidad, sostiene una nueva preimpresión de arXiv: los hechos obsoletos siguen siendo recuperables y contaminan el prompt. Su mecanismo TEPA revoca las memorias superadas, y en las pruebas de deriva la memoria ingenua puntuó por debajo de la ausencia de memoria (0.210 frente a 0.309), mientras que TEPA alcanzó 0.950.

2026-08-19

Qwen / Alibaba4 min read

Los pesos abiertos de Qwen3.8-Max llegan la próxima semana

El modelo más potente de Alibaba hasta la fecha se vuelve de código abierto

Qwen3.8-Max, el primer modelo de clase Max con pesos abiertos de Alibaba, con 2,4 billones de parámetros, llega a Hugging Face y ModelScope la próxima semana. El lanzamiento replantea la cuestión del código abierto: ¿qué ocurre cuando los pesos más grandes de la frontera son libres de descargar y probar?

2026-08-06

LLMs y ModelosFeatured3 min read

IA de Código Abierto

Kimi K3 es el modelo abierto más grande jamás creado. Pero aún no es el mejor.

Kimi K3 es el modelo abierto más grande con 2,8 billones de parámetros, pero no logra superar a los mejores modelos propietarios en los benchmarks generales. Si bien sobresale en tareas específicas de codificación y agentivas, la brecha con los líderes de frontera como Claude Fable 5 y GPT 5.6 Sol expone los límites del escalado sin avances arquitectónicos y de datos.

2026-07-27

IAFeatured4 min read

Filosofía de la IA

No, la IA no es una mente rival. Es una extensión de la nuestra

Basándose en la fenomenología de Husserl, los investigadores sostienen que los sistemas de IA se entienden mejor como extensiones de la inteligencia natural, no como mentes autónomas. Esta perspectiva explica las alucinaciones y los fallos composicionales, al tiempo que desplaza los debates sobre seguridad de los temores a una IA rebelde hacia una ingeniería y gobernanza responsables.

2026-07-09

Salud3 min read

Privacidad Digital

Tu IA acaba de escribir tu obituario en 17 diapositivas. Ese es el problema.

Un resumen generado por IA de tu vida en 17 diapositivas suena como un truco de productividad, pero plantea preguntas incómodas sobre cuánto concedemos voluntariamente a máquinas que aprenden cada uno de nuestros hábitos.

2026-07-07

PLN y ML4 min read

Datos sintéticos

Sin jefe, sin cuello de botella: por qué un marco peer-to-peer está repensando la generación de datos sintéticos

Matrix es un marco descentralizado que utiliza mensajes serializados enviados a través de colas distribuidas para la generación de datos sintéticos multiagente. Al eliminar el orquestador central, logra un rendimiento entre 2 y 15 veces mayor en hardware idéntico.

2026-06-06