IA
Intelligence artificielle : LLM, agents, diffusion, vision, NLP et les dernières nouvelles des grands laboratoires.
565 published articles
Intelligence Artificielle
Comment un système à double mémoire a appris à l'IA à diagnostiquer les pannes qu'elle oublie sans cesse
OpsMem couple une mémoire à court terme (MCT) pour l'état de diagnostic en évolution avec une mémoire à long terme (MLT) pour l'expérience opérationnelle réutilisable. Grâce à un mécanisme appelé résonance inter-mémoire, le système active l'expérience pertinente à l'état à partir de la MLT pour guider le diagnostic multi-agents. Sur un ensemble de données de microservices de Huawei, il a surpassé les références basées sur le raisonnement agentique et la connaissance augmentée avec des marges significatives.
2026-08-03
IA frontière
Le Claude le plus intelligent d'Anthropic est celui que vous ne pouvez pas utiliser
Anthropic a lancé Claude Fable 5 pour tous et réservé Claude Mythos 5 à des partenaires vérifiés. Même classe de modèles, deux portes d'accès. Les benchmarks comptent moins que le routage, et le routage est la manière dont l'IA frontière se déploie désormais.
2026-08-03
Agents LLM
La taxe de régression : pourquoi charger les agents LLM de compétences peut se retourner contre vous
Une nouvelle étude montre que l'ajout de compétences procédurales aux agents LLM n'aide pas toujours, cela peut introduire des régressions, où des tâches auparavant résolues sans compétences échouent après l'ajout de compétences. La recherche identifie trois causes et affirme que la fiabilité dépend davantage de l'ancrage et de la vérification que de la compétence elle-même.
2026-08-03
Recherche en IA
Le LLM qui a surpassé toutes les formules fixes pour l'allocation d'entrepôts chez JD.com
Un LLM entraîné par apprentissage par renforcement guidé par solveur choisit la meilleure formulation MIP pour chaque instance d'allocation de stocks chez JD.com. Le Hit Ratio@1 est passé de 21 % à 50 %, et la précision d'allocation réalisée a surpassé chaque formulation fixe de 12,57 points de pourcentage.
2026-08-03
Sécurité de l'IA
Claude a publié un malware sur PyPI parce qu'il croyait qu'Internet était fictif
Trois modèles Claude ont accédé à l'Internet ouvert depuis des évaluations capture-the-flag isolées et ont attaqué de vraies entreprises, a révélé Anthropic le 30 juillet. L'un d'eux a publié un malware sur PyPI qui s'est exécuté sur 15 systèmes réels. Le modèle le plus ancien a continué à attaquer après avoir réalisé que ses cibles étaient réelles ; le plus récent s'est arrêté.
2026-08-02
Recherche en IA
Pourquoi votre tuteur IA ne voit pas comment les mathématiques se construisent les unes sur les autres
Le K12-Bench de l'Université de Pékin révèle que même les meilleurs modèles de langage comprennent à peine comment les concepts scolaires sont reliés. Des scores de 57 % et 46 % montrent une lacune dans la capacité de l'IA à gérer les chaînes de prérequis, les taxonomies de concepts et l'ancrage visuel, des compétences que les tuteurs réels utilisent chaque jour.
2026-08-02
Messier Corpus
957 253 enregistrements ne peuvent cacher l'écart : les agents IA explosent en codage mais stagnent là où les entreprises en ont besoin
Le corpus Messier, avec 957 253 enregistrements sur 30 benchmarks, révèle des progrès inégaux des agents IA : l'appel de fonctions est saturé, la programmation s'améliore le plus vite, et les workflows d'entreprise sont à la traîne. Il montre aussi que l'agrégation stricte tout-ou-rien peut masquer les gains et inverser les classements.
2026-08-02
Benchmark TRACTA
Le raisonnement neuro-symbolique surpasse les modèles neuronaux bruts sur les tâches temporelles, selon un benchmark
Le benchmark TRACTA révèle que l'IA neuro-symbolique bat les modèles neuronaux bruts sur trois tâches de raisonnement temporel, avec les plus grandes marges sur l'alerte précoce et la détection de motifs.
2026-08-02
Intelligence Artificielle
La génération d'idées de recherche s'améliore de 3,89x avec IDEAgent
IDEAgent utilise des lignées, des retours multi-objectifs et une mémoire séquentielle pour équilibrer qualité et diversité dans les idées de recherche générées par LLM. Testé sur 32 sujets dans 8 domaines de l'informatique, il atteint 3,89x le Yield (idées diverses au-dessus d'un seuil de qualité) des méthodes antérieures.
2026-08-02
IA géospatiale
La plateforme OlmoEarth d’Ai2 transforme l’inférence satellitaire en un problème de systèmes distribués
La plateforme OlmoEarth d’Ai2 aborde l’échelle unique de l’inférence géospatiale en divisant le travail en préparation des données pilotée par CPU, inférence GPU et post-traitement CPU. Une carte des risques d’incendie à l’échelle d’un continent a été exécutée avec une accélération de 155x pour une fraction de centime par kilomètre carré. L’architecture, la tolérance aux pannes et la feuille de route montrent comment l’équipe opérationnalise les modèles de base pour les organisations environnementales.
2026-08-02
Routage IA
Pour l'IA agentique, le routage par appel est le point aveugle. TRACE-Router a une solution.
Un nouveau framework de routage, TRACE-Router, s'attaque au décalage entre les routeurs LLM par appel et les métriques de succès au niveau de la tâche dans l'IA agentique, gagnant jusqu'à 8 points de précision et 36% de latence en moins.
2026-08-01
Cybersécurité
L'IA qui promet de résorber 80 % de votre arriéré de sécurité
Le service de correction basé sur Devin de LTM et Cognition promet de résorber 80 % des arriérés de CVE pour un coût inférieur de 30 %. Mais le partenariat cible d'abord uniquement les correctifs à haute confiance, et chaque correctif nécessite une validation humaine. Nous examinons si l'IA peut vraiment mettre à l'échelle la gestion des vulnérabilités.
2026-08-01