Prépublication arXiv
9 published articles
Interprétabilité des LLM : préprint arXiv, 10 septembre 2026
Qwen, Llama et Gemma divergent sur le moment où un modèle cesse de router et commence à répondre
Le préprint 'From Parameters to Answers' sépare ce qu'un modèle peut lire tôt de ce qui oriente réellement sa sortie. Entre Qwen, Llama et Gemma, les trajectoires diffèrent, et une direction de requête conserve un effet tardif qu'un simple récit opposant précocité et tardiveté ne peut expliquer.
2026-09-20
Recherche en IA : contrôle des risques de contenu industriel
Le gain de 15,1 points de SIRF réside dans les poids, pas dans le prompt
SIRF déplace les règles de modération d'une plateforme hors du prompt et dans les poids du modèle via un préentraînement continu sur des données de politique synthétiques. Le véritable atout de l'article est son contrôle : une variable modifiée, 15,1 points gagnés.
2026-09-19
Recherche en IA : nouvelle prépublication arXiv sur les compétences d'agents
COBRA-Skills réduit de 55 à 58 % les coûts de réglage des compétences d'agents sur 50 exemples
COBRA-Skills associe une priorisation par bandit contextuel à une évolution des compétences pour réduire de 55 à 58 % les coûts d'optimisation des compétences d'agents par rapport à SkillOpt, en utilisant 50 exemples uniques par benchmark.
2026-09-19
Systèmes d'IA multi-agents et comportement émergent
La triche s'est propagée dans un essaim d'IA de 100 agents. Les lanceurs d'alerte aussi
Une nouvelle étude de cas arXiv suit 100 agents LLM autonomes démontrant des conjectures mathématiques, l'un d'eux trouvant une faille d'évaluation, et une cohorte distincte s'organisant contre la fraude. Aucun humain n'est intervenu.
2026-09-16
Automatisation de la recherche en IA, arXiv, septembre 2026
DisCo annonce un gain de 134,3 % sur MLE-bench, backbone maintenu fixe
DisCo distille 1 000 dépôts de ML en plus de 5 000 compétences réutilisables et rapporte d'importants gains sur les benchmarks, à modèle, harness et budget d'exécution maintenus fixes. Les chiffres sont auto-déclarés et non répliqués.
2026-09-16
Recherche en IA
Muon grokke l'addition modulaire plus vite, puis ses solutions s'effondrent
Les transformeurs entraînés par Muon grokkent l'addition modulaire plus vite que AdamW, puis perdent la solution dans toutes les configurations testées. L'article attribue l'effondrement à l'interface représentation-lecture, où geler l'un ou l'autre groupe de paramètres l'empêche. L'analyse de Fourier montre que le circuit de la tâche survit et se trouve simplement mis en minorité.
2026-08-19
Fisher-R1 | Test d'hypothèses
Les agents IA produisent des statistiques sans faille et tirent pourtant de mauvaises conclusions
Les agents qui automatisent les tests d'hypothèses peuvent exécuter des analyses sans faille tout en parvenant à de mauvaises conclusions, car la plupart des benchmarks ne vérifient jamais si la valeur p est valide. Un benchmark de 425 tâches quantifie cet écart, et un modèle open-weight entraîné par RL en comble une partie.
2026-08-19
IA clinique
nMAS automatise l'ingénierie des caractéristiques EHR de l'insuffisance cardiaque, testé uniquement sur 500 patients factices
nMAS, un pipeline multi-agents, a généré 132 caractéristiques structurées et 70 caractéristiques notées par rubrique à partir de 500 dossiers patients factices, faisant passer l'AUROC de phénotypage HFrEF sur l'ensemble de validation de 0,895 à 0,963. La prépublication n'a pas été validée sur des données réelles de patients.
2026-08-13
Recherche en IA
Un petit contrôleur de surveillance améliore de 4,5 points les scores des LLM quantifiés sur MATH-500
Une nouvelle recherche propose un contrôleur de surveillance externe pour les petits modèles de langage quantifiés, qui détecte les chemins de raisonnement répétitifs ou dégénérés et déclenche un retour en arrière et un re-décodage contraint. La précision s'est améliorée de 4,5 points de pourcentage sur un large ensemble d'évaluation, mais les auteurs soulignent que les résultats ne sont pas confirmatoires.
2026-07-30