SevenTnewS

IA

Intelligence artificielle : LLM, agents, diffusion, vision, NLP et les dernières nouvelles des grands laboratoires.

565 published articles

4 min read

Recherche en IA

SoftReason comble le fossé du gradient qui empêchait les réseaux de neurones de raisonner véritablement

SoftReason est une architecture neuro-souple-symbolique entièrement différentiable pour le raisonnement déductif. Elle supprime la barrière du gradient entre la perception et la déduction, permettant un apprentissage de bout en bout sur des données perceptuelles de grande dimension et des triplets de graphes de connaissances. Testé sur KVQA, il montre comment le raisonnement souple peut unifier l'ancrage, l'injection de preuves et la fermeture.

2026-07-26

4 min read

Infrastructure de données

Un nouvel agent de données d'Alibaba veut être le chef dont votre IA ne peut se passer

Alibaba Cloud lance DataBridge Agent pour automatiser la collecte, l'analyse et la structuration de données multi-sources pour les workflows d'IA. L'outil s'attaque au fossé croissant entre des modèles puissants et des données d'entreprise désorganisées.

2026-07-26

3 min read

Recherche en IA

Quand un graphe sait ce que vous n'avez pas appris : un nouveau modèle d'apprenant

MR-ConceptGCN combine des graphes de connaissances personnels avec des GCN multi-relationnels et des embeddings SBERT pour produire des modèles d'apprenant séquentiels. Dans une étude de 31 personnes, il a amélioré la précision, l'utilité, la diversité et la satisfaction des recommandations par rapport aux approches de référence.

2026-07-26

3 min read

Autonomie européenne

L'investissement d'État polonais dans ElevenLabs transforme une start-up en signal politique

ElevenLabs a reçu des capitaux d'État de la Pologne. L'investissement, effectué via Vinci, est associé à un nouveau laboratoire de recherche à Varsovie. Il s'agit d'un pari pour empêcher les fondateurs européens de talents en IA de dériver vers les États-Unis.

2026-07-26

5 min read

Chaîne d'approvisionnement en IA

Empoisonner un LLM via des commentaires publics est réalisable, prévient une nouvelle étude

Des chercheurs de l'Université de Washington démontrent que l'empoisonnement des données de pré-entraînement via du spam de commentaires automatisés est une menace réaliste. Leur analyse HalfLife montre que 0,13 % des injections de poison survivent à l'ensemble du pipeline de données, suffisamment pour dépasser les seuils d'attaque connus et affecter les modèles entraînés sur Common Crawl.

2026-07-26

Featured2 min read

Intelligence artificielle

Latence de 480 ms, précision au niveau de Whisper, une recette ouverte : Canary de Nvidia redéfinit la reconnaissance vocale en temps réel

Les modèles Nemo Canary de Nvidia atteignent une précision équivalente à Whisper sur LibriSpeech et Common Voice avec une latence de 480 ms en streaming. La version open source inclut des scripts d'entraînement et des poids, ce qui en fait un concurrent rarement reproductible dans le domaine de la reconnaissance vocale en temps réel.

2026-07-26

Featured3 min read

Analyse

Le modèle 0.8B qui a tout remis en question dans l'analyse de documents

OvisOCR2, un analyseur de documents à 0,8 milliard de paramètres de Tencent, a atteint 96,58 sur OmniDocBench, devenant le premier modèle de bout en bout à dominer le classement. Le modèle utilise l'apprentissage par renforcement et la distillation pour surpasser des systèmes en pipeline plus volumineux, remettant en question les hypothèses sur la nécessité des architectures multi-étapes.

2026-07-26

4 min read

Intelligence artificielle

Le modèle d'image à 4 milliards de paramètres de Microsoft fonctionne sur un seul A100 et défie les systèmes à 30B

Mage-Flow de Microsoft est un modèle compact de 4 milliards de paramètres pour la génération et l'édition d'images qui égale des systèmes ouverts plus grands comme Qwen-Image et FLUX.2 tout en fonctionnant sur un seul GPU A100 à des vitesses interactives. Son innovation clé est un tokenizer léger qui réduit les coûts de codage par 12.

2026-07-26

3 min read

IA & Science

Anthropic lance Claude Science, un poste de travail IA pour la recherche scientifique

Anthropic lance Claude Science, un environnement de recherche qui intègre des outils scientifiques fragmentés, gère le calcul et produit des résultats entièrement audités. Disponible en version bêta pour les utilisateurs Pro, Max, Team et Enterprise.

2026-07-26

3 min read

Intelligence Artificielle

De meilleurs détecteurs d’IA pourraient inciter les gens à utiliser davantage l’IA, pas moins

Des détecteurs d’IA imparfaits peuvent fausser les incitations des utilisateurs, conduisant à une utilisation accrue de l’IA et à des résultats de moindre qualité. Les conclusions de l’article remettent en question l’hypothèse naïve selon laquelle les outils de détection réduisent proprement le contenu généré par machine.

2026-07-26

4 min read

Speech synthesis

Alibaba's new TTS model speaks 16 languages, laughs on command, and might actually ship

Alibaba's Qwen-Audio-3.0-TTS is a production-oriented speech synthesis system that combines a low-frame-rate tokenizer with progressive training. It supports 16 languages, 20 Chinese dialect regions, and natural-language instructions for emotion, pace, and speaking style.

2026-07-26

5 min read

Deep Tech

Le routage partagé entre couches accélère l'attention sparse de 7x sans perte de qualité

CLSA utilise un seul passage de routage par séquence au lieu d'un par couche, réduisant les frais généraux du KV-cache tout en conservant la sélectivité au niveau des tokens. Les benchmarks montrent une amélioration du débit de 17,1x à 128K de contexte.

2026-07-26

← PreviousPage 19 / 48 · 565 articlesNext →