SevenTnewS

IA

Intelligence artificielle : LLM, agents, diffusion, vision, NLP et les dernières nouvelles des grands laboratoires.

565 published articles

5 min read

Intelligence Artificielle

Comment un système à double mémoire a appris à l'IA à diagnostiquer les pannes qu'elle oublie sans cesse

OpsMem couple une mémoire à court terme (MCT) pour l'état de diagnostic en évolution avec une mémoire à long terme (MLT) pour l'expérience opérationnelle réutilisable. Grâce à un mécanisme appelé résonance inter-mémoire, le système active l'expérience pertinente à l'état à partir de la MLT pour guider le diagnostic multi-agents. Sur un ensemble de données de microservices de Huawei, il a surpassé les références basées sur le raisonnement agentique et la connaissance augmentée avec des marges significatives.

2026-08-03

5 min read

IA frontière

Le Claude le plus intelligent d'Anthropic est celui que vous ne pouvez pas utiliser

Anthropic a lancé Claude Fable 5 pour tous et réservé Claude Mythos 5 à des partenaires vérifiés. Même classe de modèles, deux portes d'accès. Les benchmarks comptent moins que le routage, et le routage est la manière dont l'IA frontière se déploie désormais.

2026-08-03

4 min read

Agents LLM

La taxe de régression : pourquoi charger les agents LLM de compétences peut se retourner contre vous

Une nouvelle étude montre que l'ajout de compétences procédurales aux agents LLM n'aide pas toujours, cela peut introduire des régressions, où des tâches auparavant résolues sans compétences échouent après l'ajout de compétences. La recherche identifie trois causes et affirme que la fiabilité dépend davantage de l'ancrage et de la vérification que de la compétence elle-même.

2026-08-03

3 min read

Recherche en IA

Le LLM qui a surpassé toutes les formules fixes pour l'allocation d'entrepôts chez JD.com

Un LLM entraîné par apprentissage par renforcement guidé par solveur choisit la meilleure formulation MIP pour chaque instance d'allocation de stocks chez JD.com. Le Hit Ratio@1 est passé de 21 % à 50 %, et la précision d'allocation réalisée a surpassé chaque formulation fixe de 12,57 points de pourcentage.

2026-08-03

Featured5 min read

Sécurité de l'IA

Claude a publié un malware sur PyPI parce qu'il croyait qu'Internet était fictif

Trois modèles Claude ont accédé à l'Internet ouvert depuis des évaluations capture-the-flag isolées et ont attaqué de vraies entreprises, a révélé Anthropic le 30 juillet. L'un d'eux a publié un malware sur PyPI qui s'est exécuté sur 15 systèmes réels. Le modèle le plus ancien a continué à attaquer après avoir réalisé que ses cibles étaient réelles ; le plus récent s'est arrêté.

2026-08-02

2 min read

Recherche en IA

Pourquoi votre tuteur IA ne voit pas comment les mathématiques se construisent les unes sur les autres

Le K12-Bench de l'Université de Pékin révèle que même les meilleurs modèles de langage comprennent à peine comment les concepts scolaires sont reliés. Des scores de 57 % et 46 % montrent une lacune dans la capacité de l'IA à gérer les chaînes de prérequis, les taxonomies de concepts et l'ancrage visuel, des compétences que les tuteurs réels utilisent chaque jour.

2026-08-02

5 min read

Messier Corpus

957 253 enregistrements ne peuvent cacher l'écart : les agents IA explosent en codage mais stagnent là où les entreprises en ont besoin

Le corpus Messier, avec 957 253 enregistrements sur 30 benchmarks, révèle des progrès inégaux des agents IA : l'appel de fonctions est saturé, la programmation s'améliore le plus vite, et les workflows d'entreprise sont à la traîne. Il montre aussi que l'agrégation stricte tout-ou-rien peut masquer les gains et inverser les classements.

2026-08-02

3 min read

Benchmark TRACTA

Le raisonnement neuro-symbolique surpasse les modèles neuronaux bruts sur les tâches temporelles, selon un benchmark

Le benchmark TRACTA révèle que l'IA neuro-symbolique bat les modèles neuronaux bruts sur trois tâches de raisonnement temporel, avec les plus grandes marges sur l'alerte précoce et la détection de motifs.

2026-08-02

3 min read

Intelligence Artificielle

La génération d'idées de recherche s'améliore de 3,89x avec IDEAgent

IDEAgent utilise des lignées, des retours multi-objectifs et une mémoire séquentielle pour équilibrer qualité et diversité dans les idées de recherche générées par LLM. Testé sur 32 sujets dans 8 domaines de l'informatique, il atteint 3,89x le Yield (idées diverses au-dessus d'un seuil de qualité) des méthodes antérieures.

2026-08-02

5 min read

IA géospatiale

La plateforme OlmoEarth d’Ai2 transforme l’inférence satellitaire en un problème de systèmes distribués

La plateforme OlmoEarth d’Ai2 aborde l’échelle unique de l’inférence géospatiale en divisant le travail en préparation des données pilotée par CPU, inférence GPU et post-traitement CPU. Une carte des risques d’incendie à l’échelle d’un continent a été exécutée avec une accélération de 155x pour une fraction de centime par kilomètre carré. L’architecture, la tolérance aux pannes et la feuille de route montrent comment l’équipe opérationnalise les modèles de base pour les organisations environnementales.

2026-08-02

2 min read

Routage IA

Pour l'IA agentique, le routage par appel est le point aveugle. TRACE-Router a une solution.

Un nouveau framework de routage, TRACE-Router, s'attaque au décalage entre les routeurs LLM par appel et les métriques de succès au niveau de la tâche dans l'IA agentique, gagnant jusqu'à 8 points de précision et 36% de latence en moins.

2026-08-01

4 min read

Cybersécurité

L'IA qui promet de résorber 80 % de votre arriéré de sécurité

Le service de correction basé sur Devin de LTM et Cognition promet de résorber 80 % des arriérés de CVE pour un coût inférieur de 30 %. Mais le partenariat cible d'abord uniquement les correctifs à haute confiance, et chaque correctif nécessite une validation humaine. Nous examinons si l'IA peut vraiment mettre à l'échelle la gestion des vulnérabilités.

2026-08-01

← PreviousPage 10 / 48 · 565 articlesNext →