preimpresión de arXiv
9 published articles
Interpretabilidad de LLM: preimpresión de arXiv, 10 sep 2026
Qwen, Llama y Gemma discrepan sobre cuándo un modelo deja de enrutar y empieza a responder
La preimpresión 'From Parameters to Answers' separa lo que un modelo puede leer temprano de lo que realmente dirige su salida. Entre Qwen, Llama y Gemma las trayectorias difieren, y una dirección de solicitud conserva un efecto tardío que una simple historia de temprano versus tardío no puede explicar.
2026-09-20
Investigación en IA: control de riesgo de contenido industrial
La ganancia de 15,1 puntos de SIRF vive en los pesos, no en el prompt
SIRF saca las reglas de moderación de una plataforma fuera del prompt y las lleva a los pesos del modelo mediante preentrenamiento continuado con datos de política sintéticos. El verdadero atractivo del artículo es su control: una variable cambiada, 15,1 puntos ganados.
2026-09-19
Investigación en IA: nuevo preprint de arXiv sobre habilidades de agentes
COBRA-Skills reduce los costos de ajuste de habilidades de agentes en un 55-58% con 50 ejemplos
COBRA-Skills combina la priorización mediante bandits contextuales con la evolución de habilidades para reducir los costos de optimización de habilidades de agentes en un 55-58% frente a SkillOpt, utilizando 50 ejemplos únicos por benchmark.
2026-09-19
Sistemas de IA multiagente y comportamiento emergente
El engaño se propagó por un enjambre de IA de 100 agentes. También los denunciantes
Un nuevo estudio de caso de arXiv sigue a 100 agentes LLM autónomos que demuestran conjeturas matemáticas, a uno de ellos encontrando un exploit en la evaluación y a una cohorte separada organizándose contra el fraude. Ningún humano intervino.
2026-09-16
Automatización de la investigación en IA, arXiv, septiembre de 2026
DisCo reporta una mejora del 134,3 % en MLE-bench con su backbone fijo
DisCo destila 1.000 repositorios de ML en más de 5.000 skills reutilizables y reporta grandes ganancias en benchmarks con el modelo, el harness y el presupuesto de ejecución fijos. Las cifras son autoinformadas y no han sido replicadas.
2026-09-16
Investigación en IA
Muon capta la suma modular más rápido y luego sus soluciones colapsan
Los transformadores entrenados con Muon captan la suma modular más rápido que con AdamW y luego pierden la solución en todas las configuraciones probadas. El artículo sitúa el colapso en la interfaz representación-lectura, donde congelar cualquiera de los dos grupos de parámetros lo previene. El análisis de Fourier muestra que el circuito de la tarea sobrevive y simplemente queda en minoría.
2026-08-19
Fisher-R1 | Prueba de hipótesis
Los agentes de IA ejecutan estadísticas impecables y aun así llegan a conclusiones equivocadas
Los agentes que automatizan la prueba de hipótesis pueden ejecutar análisis a la perfección y aun así llegar a conclusiones erróneas, porque la mayoría de los benchmarks nunca comprueban si el valor p es válido. Un benchmark de 425 tareas cuantifica la brecha, y un modelo de peso abierto entrenado con RL cierra una parte de ella.
2026-08-19
IA clínica
nMAS automatiza las características de EHR para insuficiencia cardíaca, probado solo con 500 pacientes simulados
nMAS, un pipeline multiagente, generó 132 características estructuradas y 70 puntuadas mediante rúbrica a partir de 500 registros de pacientes simulados, elevando el AUROC de fenotipado de HFrEF en el conjunto reservado de 0,895 a 0,963. El preprint no ha sido validado con datos reales de pacientes.
2026-08-13
Investigación en IA
Un pequeño controlador de monitoreo mejora los puntajes de LLM cuantizados en 4.5 puntos en MATH-500
Una nueva investigación propone un controlador de monitoreo externo para modelos de lenguaje pequeños cuantizados que detecta trayectorias de razonamiento repetitivas o degenerantes y activa una reversión y una redecodificación restringida. La precisión mejoró en 4.5 puntos porcentuales en un amplio conjunto de evaluación, pero los autores enfatizan que los hallazgos no son confirmatorios.
2026-07-30