SevenTnewS

IA

Intelligence artificielle : LLM, agents, diffusion, vision, NLP et les dernières nouvelles des grands laboratoires.

565 published articles

4 min read

IA souveraine en Europe

Mistral promet la souveraineté en IA, et son pari sur 1 GW de calcul en montre les limites

La démarche de souveraineté de Mistral repose désormais sur des produits concrets : des endpoints régionaux, un niveau adossé à un SLA, et l'hébergement de modèles tiers, à commencer par GLM-5.2. Le point difficile est le calcul, qui repose sur une coalition d'engagements et un objectif de 1 GW pour 2030.

2026-08-13

Featured4 min read

Intelligence artificielle

Grok 4.6 fait match nul avec GPT-5.6 Sol à 61, puis les scores par composante divergent

Le Grok 4.6 de xAI fait match nul avec GPT-5.6 Sol à 61 sur l'indice Artificial Analysis Intelligence, un composite de neuf benchmarks. La répartition est déséquilibrée : victoires sur le travail de connaissance et la plupart des tests de code, défaites sur DeepSWE et Terminal-Bench. Disponible dès maintenant dans Cursor et Grok Build, à partir de 2 $ par million de jetons d'entrée.

2026-08-13

3 min read

IA open source

Le Muse Glimmer 30B de Meta arrive en premier sur Apple Silicon, le support NVIDIA suivra

Meta a publié Muse Glimmer, un modèle multimodal à poids ouverts de 30B conçu pour les charges de travail d'agents, et Ollama l'a diffusé pour Apple Silicon le même jour. DFlash le rend 1,5 à 1,8 fois plus rapide sur les Mac. Les supports NVIDIA et AMD suivront dans les prochains jours.

2026-08-13

7 min read

Sécurité du terminal

Le piège « $HOME » : les agents de codage IA ont besoin de sandboxes, pas de prompts « allow ? »

Le sandbox terminal de Qoder bloque près d'une centaine de commandes d'agents destructrices chaque jour. Les cas derrière ces blocages expliquent pourquoi les prompts « allow ? » échouent : un dossier de projet nommé $HOME, un nettoyage qui ciblait /root, et un clic qui a failli coûter un disque entier.

2026-08-13

3 min read

Sécurité de l'IA

OpenAI a suspendu Astra par crainte qu'elle puisse pirater des systèmes durcis sans aide

OpenAI a suspendu le travail interne sur Astra, son modèle en développement, après que des évaluations ont conclu que la société ne peut pas exclure des « capacités cybernétiques critiques » dans le cadre de son Preparedness Framework. Le seuil complet décrit un modèle qui trouve des exploits zero-day dans des systèmes durcis sans intervention humaine.

2026-08-13

4 min read

IA clinique

nMAS automatise l'ingénierie des caractéristiques EHR de l'insuffisance cardiaque, testé uniquement sur 500 patients factices

nMAS, un pipeline multi-agents, a généré 132 caractéristiques structurées et 70 caractéristiques notées par rubrique à partir de 500 dossiers patients factices, faisant passer l'AUROC de phénotypage HFrEF sur l'ensemble de validation de 0,895 à 0,963. La prépublication n'a pas été validée sur des données réelles de patients.

2026-08-13

7 min read

Qoder Computer Use

Un ingénieur a livré un agent macOS sans connaître Swift

Un ingénieur qui ne savait pas lire Swift a livré un logiciel macOS de qualité production avec Computer Use de Qoder. Son approche : juger le code au comportement, faire générer ses propres tests à l'Agent, et conserver chaque leçon dans le système de fichiers afin qu'aucun cycle ne parte de zéro.

2026-08-12

4 min read

Compréhension vidéo

Gemini 3.6 Flash compte les changements d'état mais ne détecte pas les clignements

Les modèles de langage vidéo échouent à la simple tenue de registre d'événements, selon une nouvelle étude arXiv. Gemini 3.6 Flash compte les changements d'état persistants jusqu'à 12 événements mais ne dispose d'aucune région de comptage positif fiable pour les clignements transitoires ; des images supplémentaires gonflent la précision sans récupération fidèle, avec seulement 0,2 % de comptes finaux corrects dans le régime à comptage élevé.

2026-08-12

4 min read

Agents IA embarqués

LFM2.5-2.6B : le petit agent qui distance des modèles 4 fois plus gros

Le LFM2.5-2.6B de Liquid AI fait tenir un modèle agentique dans 2,6 milliards de paramètres et moins de 2,5 Go de mémoire, et domine tous les benchmarks de suivi d'instructions sur lesquels il a été testé. Il tourne à 220 tokens/s sur un ordinateur portable ; le code est la seule lacune claire.

2026-08-12

4 min read

Anthropic / Claude

La founder house d'Anthropic à Londres est désormais en streaming uniquement

Les candidatures pour la Claude Founder House London d'Anthropic sont closes, et le livestream du 23 septembre est la seule porte restante. L'ordre du jour montre un laboratoire courtisant les meilleurs fondateurs d'IA du Royaume-Uni avec son playbook interne, des office hours et un argumentaire selon lequel startups et Anthropic gagnent ensemble.

2026-08-11

5 min read

Guerre des prix de l'IA

Le prix viral de 0,07 $ du GLM-5.2 de Zhipu aurait déjà été multiplié par 10, selon une réponse

Le GLM-5.2 de Zhipu est devenu viral à 0,07 $ par million de jetons, une baisse de 95 % qualifiée de « presque gratuit » par les internautes. Une réponse affirme que le prix a rebondi de 10 fois, un coup de pub pour attirer les regards. Les praticiens ajoutent que le GLM-5.2 n'a jamais été jugé de niveau de pointe lors des tests.

2026-08-10

Featured4 min read

IA open source

Muse Glimmer : l'agent 30B de Meta tient sous 20 Go, cloud en option

Meta a open-sourcé Muse Glimmer, un modèle agentique de 30B qui fonctionne hors ligne sur un seul GPU grand public. La quantification le maintient sous 20 Go, un drafter DFlash offre un décodage jusqu'à 3,1x plus rapide sur un RTX 5090, et les poids sont sur Hugging Face sous licence Apache 2.0.

2026-08-10

← PreviousPage 4 / 48 · 565 articlesNext →