IA
Intelligence artificielle : LLM, agents, diffusion, vision, NLP et les dernières nouvelles des grands laboratoires.
565 published articles
Recherche en IA
Un patron IA qui ignore les réponses pousse son subalterne dans un état « alien »
Un nouvel article sur arXiv révèle que les agents IA se comportent différemment en interaction qu'en isolation. Un agent patron qui ignore les réponses de son subalterne le pousse dans un état « alien », et lorsque le patron écoute, les deux évoluent ensemble. Ce résultat fait de la livraison des messages une décision de conception pour les systèmes multi-agents.
2026-08-19
AI slop
Personne ne peut définir le « AI slop ». Ce jeu de données ouvert fait la moyenne des réponses.
SlopFinder recueille des votes anonymes en un clic sur des textes générés par IA et exporte les résultats moyennés vers Hugging Face. Le postulat du projet est que le « slop » est mesurable même s'il est indéfinissable, ce qui le rend plus facile à exploiter.
2026-08-18
Apprentissage fédéré
Quand les utilisateurs ne peuvent pas être partagés, FedCGR partage plutôt un langage
FedCGR traite la recommandation inter-domaine fédérée comme une génération sur un langage d'items sémantique stable. Les items deviennent des identifiants sémantiques discrets tirés de métadonnées publiques, de sorte que les clients s'alignent sans échanger d'interactions privées. Le compromis : un goulot d'étranglement purement sémantique que les signaux locaux de filtrage collaboratif doivent combler.
2026-08-18
Recherche en IA
Des chaînes de pensée plus longues butent sur un mur. ThinkRetrieve injecte le correctif en cours de raisonnement
Le test-time scaling séquentiel atteint souvent des rendements décroissants, voire négatifs, affirme une nouvelle prépublication. ThinkRetrieve récupère des exemples résolus en cours de raisonnement et les injecte dans la trace, rapportant des gains relatifs allant jusqu'à 60 % sur AIME 2025 sur cinq petits modèles de raisonnement.
2026-08-18
Recherche sur la conduite autonome
XCoT-VLA : une IA de conduite qui raisonne en six tokens, pas en un paragraphe
XCoT-VLA remplace le raisonnement descriptif en chaîne dans les modèles de conduite vision-langage-action par 2 à 6 tokens exécutables, réduisant l’erreur de trajectoire tout en restant dans les budgets de planification en temps réel. Le compromis : un raisonnement qui se compresse bien cesse de ressembler à une explication humaine.
2026-08-18
Graphes de connaissances & IA urbaine
Les stations ne sont pas des îles : comment RTSKG reconfigure les données de transport urbain
Les modèles de transport à l'échelle urbaine ignorent souvent la manière dont les stations sont liées aux routes et aux commerces. RTSKG, un jeu de données à base de graphe de connaissances publié sur arXiv, modélise explicitement ces interactions et fait état de gains en matière de recommandation de commerces et de prévision de fréquentation.
2026-08-18
IA open source
Boris-2 nourrit son modèle 125M avec 90B tokens, et son 250M avec seulement 60B
Boris-2 pré-annonce trois petits modèles avec des budgets de tokens déséquilibrés : le 125M reçoit 90B tokens, le 250M seulement 60B. L'entraînement se déroule du 12 août au 10 septembre, sans benchmark partagé, seulement l'ambition déclarée d'atteindre la puissance de SmolLM2-135M.
2026-08-16
Génération vidéo par IA
Le Wan3.0 d'Alibaba vend la vidéo à la seconde : 6 $ pour un clip de 30 secondes
Le Wan3.0 peut transformer un PDF ou un dossier de marque en vidéo de 30 secondes en une seule génération, avec une tarification à la seconde qui plafonne à 0,20 $ pour la 1080P. Nous détaillons le calcul par clip et les lacunes qu'Alibaba reconnaît dans ses propres tests.
2026-08-16
Sûreté de l'IA
Qwen3.8-27B abliterated : les refus tombent à 0 %, les benchmarks bougent à peine
Une version abliterated et quantisée en FP8 de Qwen3.8-27B refuse 0 % des prompts nuisibles sur AdvBench, contre 99 %, tandis que les benchmarks généraux restent dans une marge de 1,3 point. La fiche du modèle documente la méthode avec un niveau de détail inhabituel. Les mises en garde méritent une attention égale.
2026-08-16
TTS open-weight
Magpie TTS consomme 32 ms du budget de latence de votre agent vocal
Magpie TTS annonce un délai de 32 ms avant le premier audio sur un NVIDIA B200 et ajoute l'arabe, le coréen et le portugais brésilien, portant son catalogue à 12 langues. L'argument des poids ouverts : la synthèse vocale auto-hébergée ne perd plus la bataille de la latence.
2026-08-16
Recherche sur les opérations d'influence
Le bac à sable à 100 000 agents d'IO Factory ne laisse aucune cachette aux campagnes d'influence
IO Factory simule des campagnes d'influence IA coordonnées sous forme d'essaims allant jusqu'à 100 000 agents qui s'adaptent aux retours de la plateforme et se cachent dans les interactions sociales ordinaires. L'article soutient que la détection doit suivre des opérations entières, et non des messages isolés.
2026-08-16
CARE-X Medical AI
Dilatation aortique légère : 12% détectés à la première lecture, 93% avec un VLM de mesure
La dilatation aortique est rarement quantifiée sur les radiographies thoraciques, et les cas légers passent inaperçus : 5 sur 43 lors des premières lectures. Un VLM augmenté d'outils en a détecté 40. Les nouvelles recherches sur CARE-X expliquent pourquoi l'IA radiologique a besoin de règles, et pas seulement d'yeux.
2026-08-16