NLP & ML
Traitement automatique du langage, apprentissage automatique et apprentissage profond.
15 published articles
Apprentissage fédéré
Quand les utilisateurs ne peuvent pas être partagés, FedCGR partage plutôt un langage
FedCGR traite la recommandation inter-domaine fédérée comme une génération sur un langage d'items sémantique stable. Les items deviennent des identifiants sémantiques discrets tirés de métadonnées publiques, de sorte que les clients s'alignent sans échanger d'interactions privées. Le compromis : un goulot d'étranglement purement sémantique que les signaux locaux de filtrage collaboratif doivent combler.
2026-08-18
Graphes de connaissances & IA urbaine
Les stations ne sont pas des îles : comment RTSKG reconfigure les données de transport urbain
Les modèles de transport à l'échelle urbaine ignorent souvent la manière dont les stations sont liées aux routes et aux commerces. RTSKG, un jeu de données à base de graphe de connaissances publié sur arXiv, modélise explicitement ces interactions et fait état de gains en matière de recommandation de commerces et de prévision de fréquentation.
2026-08-18
Recherche RAG
BM25 bat le RAG agentique lorsque les corpus dépassent 10 millions de tokens
La recherche agentique gagne sur les petits corpus, mais une étude de muset-ai sur 28 niveaux imbriqués montre BM25 la dépassant vers 10 millions de tokens. L’agent consomme 39 fois plus de tokens de requête, et le RAG par graphe plafonne à la construction.
2026-08-07
Recherche en IA
Voice Memory : un fichier de 776 octets qui dit à la reconnaissance vocale quand ne rien faire
Un nouveau schéma d'inférence seule pour la reconnaissance vocale apprend la retenue : un correcteur figé lit un fichier mémoire par domaine et décide quand s'abstenir. La correction non contrainte casse les jetons corrects dans jusqu'à 64 % des modifications ; Voice Memory réduit ce taux à 35 % et abaisse le WER pondéré de 8,36 % à 7,52 %.
2026-08-06
Recherche
La mémoire partagée a ses limites : les algorithmes acteur-critique peinent à passer l'échelle au-delà de cinq agents
Des chercheurs ont partagé des buffers de répétition entre des agents acteur-critique sur des tâches d'actions paramétrées. GAC a bondi en performance, tandis que SAC et TQC n'ont que faiblement progressé. Au-delà de cinq agents, le coût de calcul grimpe sans retour significatif. L'article propose une limite pratique pour savoir jusqu'où les méthodes d'expérience partagée peuvent s'étendre avant de plafonner.
2026-07-27
IA & Neurosciences
Les neurones brouillés d’un modèle de langage recréent les effets d’un AVC sur la parole
Des chercheurs ont perturbé LLaVA 1.6 pour simuler les erreurs de dénomination d’images chez des patients aphasiques et ont mis en correspondance les profils individuels dans jusqu’à sept catégories d’erreurs pour 79,5 % des cas. Six des sept types d’erreurs sont apparus naturellement avec différentes configurations de perturbation, suggérant que des modèles multimodaux généralistes peuvent fonctionner comme des jumeaux numériques pour les déficits langagiers post-AVC.
2026-07-24
IA incarnée
Le cerveau robotique de Xiaomi est open-source et compte 38 milliards de paramètres. Cela change le goulot d'étranglement des données
Avec un modèle de 38 milliards de paramètres qui unifie quatre tâches robotiques et ouvre l'intégralité du pipeline, Xiaomi vise à briser le goulot d'étranglement des données dans l'IA incarnée. Les premiers benchmarks montrent une amélioration de 26 % des taux d'achèvement des tâches lors de l'entraînement sur des données augmentées par le modèle.
2026-07-15
IA physique
Le Qwen d'Alibaba est désormais le cerveau de 150 000 robots, voitures, lunettes et drones
La famille d'IA Qwen d'Alibaba alimente désormais plus de 150 000 appareils matériels, des robots humanoïdes aux caméras pour enfants, alors que l'entreprise pivote des chatbots vers l'IA physique, intégrant des modèles multimodaux dans des robots, voitures, lunettes et drones.
2026-07-14
Recherche en IA
Pourquoi GPT-5.5 domine un benchmark qui teste comment les agents s'améliorent eux-mêmes
EvoPolicyGym isole une capacité critique mais peu étudiée : la capacité d'un agent à affiner une politique exécutable par des modifications répétées sous contrainte de rétroaction. Le benchmark révèle GPT-5.5 comme le plus performant dans 16 environnements, et fournit des diagnostics au niveau des trajectoires qui exposent comment différents agents allouent leur budget et convertissent la rétroaction en paramètres ajustés.
2026-07-11
Gestion mémoire
Le secret des 12 000 lignes derrière la vitesse de Bing : comment mimalloc a surmonté le compromis des allocateurs
L'allocateur mimalloc de Microsoft Research utilise des milliers de listes libres par page et une astucieuse technique de vol de pages pour atteindre à la fois une haute concurrence et une faible surcharge mémoire, comme détaillé par le groupe RiSE dans un nouveau blog technique.
2026-07-10
Histoire du NLP
Le benchmark qui a fait parler les modèles de langue : comment le GLUE de 2018 a changé l'IA pour toujours
Le benchmark GLUE, lancé en 2018, a transformé le traitement automatique du langage naturel en fournissant un étalon standardisé pour la compréhension du langage. Son héritage perdure dans tous les benchmarks modernes des LLM, de SuperGLUE aux dernières évaluations de type arène qui définissent la course actuelle à l'IA.
2026-07-08
Recherche en apprentissage automatique
Fast-LeWM : La prédiction parallèle de préfixes d'actions réduit les coûts de planification des modèles de monde latent
Des chercheurs présentent Fast-LeWM, un modèle de monde latent qui accélère la planification visuelle en prédisant en parallèle les états futurs à partir de préfixes d'actions. L'approche réduit les coûts de calcul et l'accumulation d'erreurs, surpassant les modèles de transition en une étape précédents.
2026-07-07