SevenTnewSNoticias de IA y tecnología, explicadas

preimpresión de arXiv

9 published articles

LLMs y Modelos4 min read

Interpretabilidad de LLM: preimpresión de arXiv, 10 sep 2026

Qwen, Llama y Gemma discrepan sobre cuándo un modelo deja de enrutar y empieza a responder

La preimpresión 'From Parameters to Answers' separa lo que un modelo puede leer temprano de lo que realmente dirige su salida. Entre Qwen, Llama y Gemma las trayectorias difieren, y una dirección de solicitud conserva un efecto tardío que una simple historia de temprano versus tardío no puede explicar.

2026-09-20

LLMs y Modelos5 min read

Investigación en IA: control de riesgo de contenido industrial

La ganancia de 15,1 puntos de SIRF vive en los pesos, no en el prompt

SIRF saca las reglas de moderación de una plataforma fuera del prompt y las lleva a los pesos del modelo mediante preentrenamiento continuado con datos de política sintéticos. El verdadero atractivo del artículo es su control: una variable cambiada, 15,1 puntos ganados.

2026-09-19

Agentes de IA4 min read

Investigación en IA: nuevo preprint de arXiv sobre habilidades de agentes

COBRA-Skills reduce los costos de ajuste de habilidades de agentes en un 55-58% con 50 ejemplos

COBRA-Skills combina la priorización mediante bandits contextuales con la evolución de habilidades para reducir los costos de optimización de habilidades de agentes en un 55-58% frente a SkillOpt, utilizando 50 ejemplos únicos por benchmark.

2026-09-19

Agentes de IA4 min read

Sistemas de IA multiagente y comportamiento emergente

El engaño se propagó por un enjambre de IA de 100 agentes. También los denunciantes

Un nuevo estudio de caso de arXiv sigue a 100 agentes LLM autónomos que demuestran conjeturas matemáticas, a uno de ellos encontrando un exploit en la evaluación y a una cohorte separada organizándose contra el fraude. Ningún humano intervino.

2026-09-16

Agentes de IA4 min read

Automatización de la investigación en IA, arXiv, septiembre de 2026

DisCo reporta una mejora del 134,3 % en MLE-bench con su backbone fijo

DisCo destila 1.000 repositorios de ML en más de 5.000 skills reutilizables y reporta grandes ganancias en benchmarks con el modelo, el harness y el presupuesto de ejecución fijos. Las cifras son autoinformadas y no han sido replicadas.

2026-09-16

Laboratorios e Investigación4 min read

Investigación en IA

Muon capta la suma modular más rápido y luego sus soluciones colapsan

Los transformadores entrenados con Muon captan la suma modular más rápido que con AdamW y luego pierden la solución en todas las configuraciones probadas. El artículo sitúa el colapso en la interfaz representación-lectura, donde congelar cualquiera de los dos grupos de parámetros lo previene. El análisis de Fourier muestra que el circuito de la tarea sobrevive y simplemente queda en minoría.

2026-08-19

Laboratorios e Investigación3 min read

Fisher-R1 | Prueba de hipótesis

Los agentes de IA ejecutan estadísticas impecables y aun así llegan a conclusiones equivocadas

Los agentes que automatizan la prueba de hipótesis pueden ejecutar análisis a la perfección y aun así llegar a conclusiones erróneas, porque la mayoría de los benchmarks nunca comprueban si el valor p es válido. Un benchmark de 425 tareas cuantifica la brecha, y un modelo de peso abierto entrenado con RL cierra una parte de ella.

2026-08-19

Agentes de IA4 min read

IA clínica

nMAS automatiza las características de EHR para insuficiencia cardíaca, probado solo con 500 pacientes simulados

nMAS, un pipeline multiagente, generó 132 características estructuradas y 70 puntuadas mediante rúbrica a partir de 500 registros de pacientes simulados, elevando el AUROC de fenotipado de HFrEF en el conjunto reservado de 0,895 a 0,963. El preprint no ha sido validado con datos reales de pacientes.

2026-08-13

LLMs y Modelos3 min read

Investigación en IA

Un pequeño controlador de monitoreo mejora los puntajes de LLM cuantizados en 4.5 puntos en MATH-500

Una nueva investigación propone un controlador de monitoreo externo para modelos de lenguaje pequeños cuantizados que detecta trayectorias de razonamiento repetitivas o degenerantes y activa una reversión y una redecodificación restringida. La precisión mejoró en 4.5 puntos porcentuales en un amplio conjunto de evaluación, pero los autores enfatizan que los hallazgos no son confirmatorios.

2026-07-30