IA
Intelligence artificielle : LLM, agents, diffusion, vision, NLP et les dernières nouvelles des grands laboratoires.
565 published articles
IA souveraine en Europe
Mistral promet la souveraineté en IA, et son pari sur 1 GW de calcul en montre les limites
La démarche de souveraineté de Mistral repose désormais sur des produits concrets : des endpoints régionaux, un niveau adossé à un SLA, et l'hébergement de modèles tiers, à commencer par GLM-5.2. Le point difficile est le calcul, qui repose sur une coalition d'engagements et un objectif de 1 GW pour 2030.
2026-08-13
Intelligence artificielle
Grok 4.6 fait match nul avec GPT-5.6 Sol à 61, puis les scores par composante divergent
Le Grok 4.6 de xAI fait match nul avec GPT-5.6 Sol à 61 sur l'indice Artificial Analysis Intelligence, un composite de neuf benchmarks. La répartition est déséquilibrée : victoires sur le travail de connaissance et la plupart des tests de code, défaites sur DeepSWE et Terminal-Bench. Disponible dès maintenant dans Cursor et Grok Build, à partir de 2 $ par million de jetons d'entrée.
2026-08-13
IA open source
Le Muse Glimmer 30B de Meta arrive en premier sur Apple Silicon, le support NVIDIA suivra
Meta a publié Muse Glimmer, un modèle multimodal à poids ouverts de 30B conçu pour les charges de travail d'agents, et Ollama l'a diffusé pour Apple Silicon le même jour. DFlash le rend 1,5 à 1,8 fois plus rapide sur les Mac. Les supports NVIDIA et AMD suivront dans les prochains jours.
2026-08-13
Sécurité du terminal
Le piège « $HOME » : les agents de codage IA ont besoin de sandboxes, pas de prompts « allow ? »
Le sandbox terminal de Qoder bloque près d'une centaine de commandes d'agents destructrices chaque jour. Les cas derrière ces blocages expliquent pourquoi les prompts « allow ? » échouent : un dossier de projet nommé $HOME, un nettoyage qui ciblait /root, et un clic qui a failli coûter un disque entier.
2026-08-13
Sécurité de l'IA
OpenAI a suspendu Astra par crainte qu'elle puisse pirater des systèmes durcis sans aide
OpenAI a suspendu le travail interne sur Astra, son modèle en développement, après que des évaluations ont conclu que la société ne peut pas exclure des « capacités cybernétiques critiques » dans le cadre de son Preparedness Framework. Le seuil complet décrit un modèle qui trouve des exploits zero-day dans des systèmes durcis sans intervention humaine.
2026-08-13
IA clinique
nMAS automatise l'ingénierie des caractéristiques EHR de l'insuffisance cardiaque, testé uniquement sur 500 patients factices
nMAS, un pipeline multi-agents, a généré 132 caractéristiques structurées et 70 caractéristiques notées par rubrique à partir de 500 dossiers patients factices, faisant passer l'AUROC de phénotypage HFrEF sur l'ensemble de validation de 0,895 à 0,963. La prépublication n'a pas été validée sur des données réelles de patients.
2026-08-13
Qoder Computer Use
Un ingénieur a livré un agent macOS sans connaître Swift
Un ingénieur qui ne savait pas lire Swift a livré un logiciel macOS de qualité production avec Computer Use de Qoder. Son approche : juger le code au comportement, faire générer ses propres tests à l'Agent, et conserver chaque leçon dans le système de fichiers afin qu'aucun cycle ne parte de zéro.
2026-08-12
Compréhension vidéo
Gemini 3.6 Flash compte les changements d'état mais ne détecte pas les clignements
Les modèles de langage vidéo échouent à la simple tenue de registre d'événements, selon une nouvelle étude arXiv. Gemini 3.6 Flash compte les changements d'état persistants jusqu'à 12 événements mais ne dispose d'aucune région de comptage positif fiable pour les clignements transitoires ; des images supplémentaires gonflent la précision sans récupération fidèle, avec seulement 0,2 % de comptes finaux corrects dans le régime à comptage élevé.
2026-08-12
Agents IA embarqués
LFM2.5-2.6B : le petit agent qui distance des modèles 4 fois plus gros
Le LFM2.5-2.6B de Liquid AI fait tenir un modèle agentique dans 2,6 milliards de paramètres et moins de 2,5 Go de mémoire, et domine tous les benchmarks de suivi d'instructions sur lesquels il a été testé. Il tourne à 220 tokens/s sur un ordinateur portable ; le code est la seule lacune claire.
2026-08-12
Anthropic / Claude
La founder house d'Anthropic à Londres est désormais en streaming uniquement
Les candidatures pour la Claude Founder House London d'Anthropic sont closes, et le livestream du 23 septembre est la seule porte restante. L'ordre du jour montre un laboratoire courtisant les meilleurs fondateurs d'IA du Royaume-Uni avec son playbook interne, des office hours et un argumentaire selon lequel startups et Anthropic gagnent ensemble.
2026-08-11
Guerre des prix de l'IA
Le prix viral de 0,07 $ du GLM-5.2 de Zhipu aurait déjà été multiplié par 10, selon une réponse
Le GLM-5.2 de Zhipu est devenu viral à 0,07 $ par million de jetons, une baisse de 95 % qualifiée de « presque gratuit » par les internautes. Une réponse affirme que le prix a rebondi de 10 fois, un coup de pub pour attirer les regards. Les praticiens ajoutent que le GLM-5.2 n'a jamais été jugé de niveau de pointe lors des tests.
2026-08-10
IA open source
Muse Glimmer : l'agent 30B de Meta tient sous 20 Go, cloud en option
Meta a open-sourcé Muse Glimmer, un modèle agentique de 30B qui fonctionne hors ligne sur un seul GPU grand public. La quantification le maintient sous 20 Go, un drafter DFlash offre un décodage jusqu'à 3,1x plus rapide sur un RTX 5090, et les poids sont sur Hugging Face sous licence Apache 2.0.
2026-08-10