IA
Intelligence artificielle : LLM, agents, diffusion, vision, NLP et les dernières nouvelles des grands laboratoires.
565 published articles
Stratégie d'écosystème
La plus grande nouvelle concernant Grok 4.5 pourrait être la façon dont il a été construit
Le Grok 4.5 de xAI est désormais disponible sur grok.com, X, iOS, Android, et dans Microsoft 365, Google Workspace, GitHub Copilot et Cursor. Le modèle, construit avec des données d'entraînement générées par des agents, est en tête du benchmark SWE Marathon et introduit une mise à niveau vocale.
2026-08-01
IA industrielle
AgentRCA : analyse de cause racine zero-shot qui explique son propre raisonnement
Un framework agentique zero-shot appelé AgentRCA utilise un jumeau numérique et un LLM pour diagnostiquer les défauts d'usine sans données étiquetées, atteignant une précision de niveau supervisé avec une transparence totale.
2026-08-01
IA & Robotique
La formation des robots chirurgicaux s'accélère : le Cosmos-H-Dreams de Nvidia tourne à 160 ips
Le Cosmos-H-Dreams de Nvidia transforme la simulation chirurgicale en une expérience interactive en temps réel. Tournant à 160 ips sur un seul GPU, il permet aux chirurgiens, stagiaires et politiques IA de s'entraîner dans une boucle fermée de vidéo générée sans avoir besoin d'un robot physique.
2026-08-01
Graph Foundation Models
Le transfert zero-shot sur les graphes a un angle mort multimodal. CHARM propose une solution
CHARM remplace les caractéristiques isolées des nœuds par des contextes de graphe structurés qui capturent la sémantique multimodale et les relations inter-modales. En mappant des motifs propres à chaque domaine à des concepts partagés de haut niveau, le modèle réalise un transfert zero-shot entre des graphes contenant du texte, des images et d'autres modalités.
2026-08-01
IA d'entreprise
Le Claude d'Anthropic trouve son pont vers l'entreprise : 30 000 ingénieurs de Cognizant
Alors que la capacité de l'IA dépasse l'adoption par les entreprises, Cognizant étend son partenariat avec Anthropic, formant 30 000 employés à Claude et offrant des gains de productivité mesurables comme des examens de contrats 40 % plus rapides et des économies de huit heures par semaine pour les souscripteurs. L'accord signale une stratégie visant à intégrer l'IA de pointe via les systèmes d'entreprise existants.
2026-08-01
Intégrité IA
Le pipeline IA a trois fuites silencieuses, et chaque correctif en aggrave une
Une étude sur l'empoisonnement par spam de commentaires, un article montrant que les détecteurs d'IA peuvent se retourner contre eux, et un modèle de détection de fraude pris à exploiter une fuite d'étiquettes décrivent tous la même défaillance sous-jacente : les mesures indirectes dans les pipelines d'IA sont contournées dès qu'elles deviennent critiques, et corriger l'une ne corrige pas le schéma.
2026-07-31
Outils de développement
Personne n'a livré de percée cette semaine. C'est là la vraie nouvelle.
La version de correction de bugs de xAI, l'ouverture de Xcode aux modèles IA concurrents par Apple, et la refonte « apportez votre propre clé » de Bruno renoncent toutes aux fonctionnalités clinquantes au profit de la fiabilité et de la confiance dans les données. Ensemble, elles signalent que le marché des outils de développement IA passe d'une course aux fonctionnalités à une course à la confiance.
2026-07-31
IA de recherche approfondie
Le nouvel agent de recherche de BAAI ne se contente pas de chercher plus longtemps, il vérifie ses propres devoirs
Les agents AREX de BAAI utilisent une boucle d'auto-amélioration récursive qui compresse les longs historiques de recherche, permettant un raffinement efficace axé sur la vérification. Entraînés avec une nouvelle recette de RL à long horizon, ils surpassent les bases de référence comparables sur BrowseComp, DeepSearchQA et HLE.
2026-07-31
Raisonnement 3D
SceneActBench : Pourquoi même les meilleurs VLM échouent dans l'action 3D
SceneActBench teste onze configurations de VLM sur cinq tâches 3D dans une boucle d'agent unifiée. Les scores globaux vont de 38,6 à 50,2, aucun modèle n'étant performant de manière constante. Le benchmark expose un angle mort des agents vision-langage : agir sur des scènes complètes, pas seulement les décrire.
2026-07-31
Tests de jeu automatisés
Le graphe qui a battu la grille : pourquoi les modèles GAT surpassent les CNNs dans les tests de jeu de Candy Crush
Des chercheurs ont comparé les modèles GAT, BERT et CNN pour les tests de jeu automatisés dans Candy Crush Saga. Les modèles GAT ont égalé ou surpassé les CNN en prédiction de mouvements et en estimation de difficulté, en particulier sur les niveaux difficiles, tout en gérant de nouvelles mécaniques de jeu sans ingénierie de caractéristiques.
2026-07-31
MUSIQUE IA
L'astuce de la mélodie en premier qui permet à Qwen-Music de battre Suno sur 13 indicateurs
Qwen-Music sépare la planification de la mélodie de la génération complète de chansons via Melody-CoT. Le modèle de 3 milliards de paramètres, entraîné sur plus de 5 millions d'heures de données multilingues, obtient des résultats de pointe contre Suno V5 et MiniMax Music 2.6, tant sur les indicateurs objectifs que sur la préférence humaine.
2026-07-31
Recherche en IA médicale
Un modèle de 4 milliards de paramètres traite des données cliniques irrégulières avec des réponses en 0,15 seconde
ClinPRISM est un framework de raisonnement LLM multimodal économique conçu pour répondre à des questions sur des séries temporelles cliniques irrégulières. En utilisant seulement 16 tokens et un modèle de base de 4 milliards de paramètres, il atteint des performances de pointe avec une latence moyenne de 0,15 seconde par question.
2026-07-31