IA
Intelligence artificielle : LLM, agents, diffusion, vision, NLP et les dernières nouvelles des grands laboratoires.
565 published articles
IA Open Source
L'AV-Flamingo de Nvidia s'attaque à la compréhension des longues vidéos là où la plupart des modèles échouent
Nvidia publie AV-Flamingo, un grand modèle de langage audiovisuel open source conçu pour la compréhension de vidéos longues et complexes. Il utilise un programme d'apprentissage en trois étapes et un cadre de chaîne de pensée horodatée pour gérer le raisonnement temporel et cross-modal qui fait trébucher la plupart des modèles.
2026-07-28
IA physique
Le modèle à 4 milliards de paramètres pour périphériques Edge de Nvidia fait ce que la plupart des petits VLM ne font pas
Le Cosmos 3 Edge de Nvidia intègre la modélisation du monde en 4 milliards de paramètres, se classant premier au VANTAGE-Bench parmi sa catégorie de taille. Sa conception à double transformateur mêle raisonnement et prédiction d'action en temps réel pour les robots, le tout déployable sur le matériel Jetson et RTX.
2026-07-28
Sciences comportementales
Les décisions humaines que les LLM peuvent reproduire mieux que les enquêtes
Une étude utilisant 3 000 agents basés sur GPT-5 dans des expériences de choix d'itinéraire montre que les LLM reproduisent les biais de la théorie des perspectives cumulées (CPT), l'aversion aux pertes, la dépendance aux points de référence et la pondération des probabilités, avec une grande fidélité. L'approche contourne le goulot d'étranglement de l'estimation des paramètres qui limite la modélisation comportementale traditionnelle.
2026-07-28
Rapport d'intégrité
Stability AI a signalé 13 cas de CSAM au NCMEC dans son premier rapport de transparence
Le rapport couvre la sécurité des modèles, le red-teaming, la modération de contenu et la collaboration avec les forces de l'ordre. Stability AI indique n'avoir détecté aucun CSAM dans ses données d'entraînement et avoir effectué des tests de stress sur tous ses modèles génératifs sans trouver de capacités de génération de CSAM.
2026-07-28
Stratégie IA
Plan IA français à 2,5 milliards d'euros : plus qu'un budget, un modèle pour la souveraineté
La stratégie IA de la France est entrée dans une nouvelle phase avec 2,5 milliards d'euros de financement, un tour de table record pour Mistral AI, et une volonté de faire adopter l'IA par la moitié des PME d'ici 2027. Voici comment les pièces s'assemblent.
2026-07-27
Claude Code
Ignorez les nouveaux modèles. La vraie mise à jour de Claude Code se trouve dans les marges
La dernière mise à jour de Claude Code par Anthropic est une masterclass en polissage incrémental : support du simulateur iOS, corrections de reconnexion SSH, améliorations d'accessibilité et un compositeur plus étroit. La vraie histoire est comment ces petits changements s'accumulent pour créer un outil dont on se sépare difficilement.
2026-07-27
Modèles d'IA
La conception à quatre spécialistes de 748B du Macaron-V1-Venti bat GPT-5.5 et Opus 4.8
Macaron-V1-Venti de MindLab Research mène les benchmarks en intelligence personnelle, codage, utilisation du terminal et UI générative, utilisant une nouvelle architecture Mixture of LoRA qui maintient le modèle compact tout en étant spécialisé.
2026-07-27
Recherche
Le RL explicable s'attaque au contrôle du trafic aérien, une carte de saillance à la fois
Une équipe de chercheurs applique le RL explicable au contrôle du trafic aérien, en formant un agent à éviter les zones interdites et en utilisant des cartes de saillance pour révéler son raisonnement. Ce travail est une étape préliminaire vers la confiance dans l'IA à enjeux élevés.
2026-07-27
Analyse
Benchmarks, pas des bonnes affaires : les laboratoires d'IA chinois atteignent la parité
Les laboratoires chinois d'IA Qwen, DeepSeek, MiniMax et Kimi ont égalé ou battu les modèles de pointe américains dans les benchmarks de raisonnement, codage et analyse de documents. Avec une tarification agressive et des stratégies open-weight, ils ne sont plus de simples alternatives bon marché, ce sont de véritables concurrents.
2026-07-27
Économie de l'IA
Le calcul Claude vs Fugu : quand un essaim bat un modèle unique
Le Claude Opus 5 d'Anthropic offre des performances quasi-phares pour la moitié du coût des tokens, mais limite volontairement les capacités en cybersécurité. La plateforme Fugu de Sakana AI orchestre plusieurs modèles ouverts pour égaler les benchmarks de pointe. La décision repose sur le type de tâche, le budget et la tolérance à la complexité.
2026-07-27
IA Open Source
Kimi K3 est le plus grand modèle open source jamais créé. Il n'est toujours pas le meilleur.
Kimi K3 est le plus grand modèle open source avec 2,8 billions de paramètres, mais il ne parvient pas à battre les meilleurs modèles propriétaires sur les benchmarks globaux. Bien qu'il excelle sur des tâches spécifiques de codage et d'agents, l'écart avec les leaders de pointe comme Claude Fable 5 et GPT 5.6 Sol expose les limites du passage à l'échelle sans percées architecturales et de données.
2026-07-27
Gouvernement numérique
La Grèce signe un accord avec ElevenLabs pour intégrer l'IA vocale dans les services publics et sauver un dialecte en voie de disparition
La Grèce s'associe à ElevenLabs pour intégrer l'IA vocale dans gov.gr, les portails touristiques et la préservation des dialectes régionaux comme le crétois. L'accord a été signé par le ministre de la Gouvernance numérique et de l'IA, Dimitris Papastergiou, et marque le premier pacte d'IA vocale au niveau étatique en Europe du Sud.
2026-07-27