preimpresión de arXiv
4 published articles
Investigación en IA
Muon capta la suma modular más rápido y luego sus soluciones colapsan
Los transformadores entrenados con Muon captan la suma modular más rápido que con AdamW y luego pierden la solución en todas las configuraciones probadas. El artículo sitúa el colapso en la interfaz representación-lectura, donde congelar cualquiera de los dos grupos de parámetros lo previene. El análisis de Fourier muestra que el circuito de la tarea sobrevive y simplemente queda en minoría.
2026-08-19
Fisher-R1 | Prueba de hipótesis
Los agentes de IA ejecutan estadísticas impecables y aun así llegan a conclusiones equivocadas
Los agentes que automatizan la prueba de hipótesis pueden ejecutar análisis a la perfección y aun así llegar a conclusiones erróneas, porque la mayoría de los benchmarks nunca comprueban si el valor p es válido. Un benchmark de 425 tareas cuantifica la brecha, y un modelo de peso abierto entrenado con RL cierra una parte de ella.
2026-08-19
IA clínica
nMAS automatiza las características de EHR para insuficiencia cardíaca, probado solo con 500 pacientes simulados
nMAS, un pipeline multiagente, generó 132 características estructuradas y 70 puntuadas mediante rúbrica a partir de 500 registros de pacientes simulados, elevando el AUROC de fenotipado de HFrEF en el conjunto reservado de 0,895 a 0,963. El preprint no ha sido validado con datos reales de pacientes.
2026-08-13
Investigación en IA
Un pequeño controlador de monitoreo mejora los puntajes de LLM cuantizados en 4.5 puntos en MATH-500
Una nueva investigación propone un controlador de monitoreo externo para modelos de lenguaje pequeños cuantizados que detecta trayectorias de razonamiento repetitivas o degenerantes y activa una reversión y una redecodificación restringida. La precisión mejoró en 4.5 puntos porcentuales en un amplio conjunto de evaluación, pero los autores enfatizan que los hallazgos no son confirmatorios.
2026-07-30