razonamiento
3 published articles
Qwen / Alibaba
Qwen3-2507 llega con un modelo pensante y un modelo de instrucción dividido de nuevo en boga
El equipo Qwen de Alibaba lanzó Qwen3-2507, dividiendo su línea de modelos en variantes dedicadas de instrucción y pensamiento. La actualización trae mejoras sustanciales en razonamiento, seguimiento de instrucciones y soporte de contexto de 256K, extensible a 1M de tokens.
2026-07-29
Investigación en IA
El cuello de botella que frena a los agentes de IA no es la exploración, sino la evaluación
Dos nuevos artículos de Hugging Face abordan el mismo problema central desde direcciones opuestas: cómo lograr que los agentes de IA evalúen de forma fiable sus propias acciones. AJ-Bench construye un punto de referencia para agentes jueces conscientes del entorno, mientras que HeavySkill sostiene que el mejor juez reside dentro de los parámetros del modelo.
2026-07-17
Inteligencia Artificial
El modelo Phi-4 de Microsoft redefine la eficiencia en una investigación innovadora
El modelo Phi-4 de Microsoft logra una eficiencia de última generación, igualando a modelos más grandes en tareas de razonamiento con significativamente menos parámetros. Publicado el 15 de mayo de 2025, el artículo de investigación reexamina las suposiciones sobre las leyes de escalado en IA.
2026-07-03