IA
Intelligence artificielle : LLM, agents, diffusion, vision, NLP et les dernières nouvelles des grands laboratoires.
565 published articles
Recherche en IA
SoftReason comble le fossé du gradient qui empêchait les réseaux de neurones de raisonner véritablement
SoftReason est une architecture neuro-souple-symbolique entièrement différentiable pour le raisonnement déductif. Elle supprime la barrière du gradient entre la perception et la déduction, permettant un apprentissage de bout en bout sur des données perceptuelles de grande dimension et des triplets de graphes de connaissances. Testé sur KVQA, il montre comment le raisonnement souple peut unifier l'ancrage, l'injection de preuves et la fermeture.
2026-07-26
Infrastructure de données
Un nouvel agent de données d'Alibaba veut être le chef dont votre IA ne peut se passer
Alibaba Cloud lance DataBridge Agent pour automatiser la collecte, l'analyse et la structuration de données multi-sources pour les workflows d'IA. L'outil s'attaque au fossé croissant entre des modèles puissants et des données d'entreprise désorganisées.
2026-07-26
Recherche en IA
Quand un graphe sait ce que vous n'avez pas appris : un nouveau modèle d'apprenant
MR-ConceptGCN combine des graphes de connaissances personnels avec des GCN multi-relationnels et des embeddings SBERT pour produire des modèles d'apprenant séquentiels. Dans une étude de 31 personnes, il a amélioré la précision, l'utilité, la diversité et la satisfaction des recommandations par rapport aux approches de référence.
2026-07-26
Autonomie européenne
L'investissement d'État polonais dans ElevenLabs transforme une start-up en signal politique
ElevenLabs a reçu des capitaux d'État de la Pologne. L'investissement, effectué via Vinci, est associé à un nouveau laboratoire de recherche à Varsovie. Il s'agit d'un pari pour empêcher les fondateurs européens de talents en IA de dériver vers les États-Unis.
2026-07-26
Chaîne d'approvisionnement en IA
Empoisonner un LLM via des commentaires publics est réalisable, prévient une nouvelle étude
Des chercheurs de l'Université de Washington démontrent que l'empoisonnement des données de pré-entraînement via du spam de commentaires automatisés est une menace réaliste. Leur analyse HalfLife montre que 0,13 % des injections de poison survivent à l'ensemble du pipeline de données, suffisamment pour dépasser les seuils d'attaque connus et affecter les modèles entraînés sur Common Crawl.
2026-07-26
Intelligence artificielle
Latence de 480 ms, précision au niveau de Whisper, une recette ouverte : Canary de Nvidia redéfinit la reconnaissance vocale en temps réel
Les modèles Nemo Canary de Nvidia atteignent une précision équivalente à Whisper sur LibriSpeech et Common Voice avec une latence de 480 ms en streaming. La version open source inclut des scripts d'entraînement et des poids, ce qui en fait un concurrent rarement reproductible dans le domaine de la reconnaissance vocale en temps réel.
2026-07-26
Analyse
Le modèle 0.8B qui a tout remis en question dans l'analyse de documents
OvisOCR2, un analyseur de documents à 0,8 milliard de paramètres de Tencent, a atteint 96,58 sur OmniDocBench, devenant le premier modèle de bout en bout à dominer le classement. Le modèle utilise l'apprentissage par renforcement et la distillation pour surpasser des systèmes en pipeline plus volumineux, remettant en question les hypothèses sur la nécessité des architectures multi-étapes.
2026-07-26
Intelligence artificielle
Le modèle d'image à 4 milliards de paramètres de Microsoft fonctionne sur un seul A100 et défie les systèmes à 30B
Mage-Flow de Microsoft est un modèle compact de 4 milliards de paramètres pour la génération et l'édition d'images qui égale des systèmes ouverts plus grands comme Qwen-Image et FLUX.2 tout en fonctionnant sur un seul GPU A100 à des vitesses interactives. Son innovation clé est un tokenizer léger qui réduit les coûts de codage par 12.
2026-07-26
IA & Science
Anthropic lance Claude Science, un poste de travail IA pour la recherche scientifique
Anthropic lance Claude Science, un environnement de recherche qui intègre des outils scientifiques fragmentés, gère le calcul et produit des résultats entièrement audités. Disponible en version bêta pour les utilisateurs Pro, Max, Team et Enterprise.
2026-07-26
Intelligence Artificielle
De meilleurs détecteurs d’IA pourraient inciter les gens à utiliser davantage l’IA, pas moins
Des détecteurs d’IA imparfaits peuvent fausser les incitations des utilisateurs, conduisant à une utilisation accrue de l’IA et à des résultats de moindre qualité. Les conclusions de l’article remettent en question l’hypothèse naïve selon laquelle les outils de détection réduisent proprement le contenu généré par machine.
2026-07-26
Speech synthesis
Alibaba's new TTS model speaks 16 languages, laughs on command, and might actually ship
Alibaba's Qwen-Audio-3.0-TTS is a production-oriented speech synthesis system that combines a low-frame-rate tokenizer with progressive training. It supports 16 languages, 20 Chinese dialect regions, and natural-language instructions for emotion, pace, and speaking style.
2026-07-26
Deep Tech
Le routage partagé entre couches accélère l'attention sparse de 7x sans perte de qualité
CLSA utilise un seul passage de routage par séquence au lieu d'un par couche, réduisant les frais généraux du KV-cache tout en conservant la sélectivité au niveau des tokens. Les benchmarks montrent une amélioration du débit de 17,1x à 128K de contexte.
2026-07-26