Agents IA
Agents autonomes, workflows multi-agents et orchestration.
45 published articles
Agents IA
Le swarm de Cursor a reconstruit SQLite de zéro. Mêmes scores, factures radicalement différentes
Le swarm d'agents repensé de Cursor a reconstruit SQLite en Rust à partir du seul manuel et a réussi l'intégralité de la suite de vérification, réduisant les conflits de fusion de plus de 70 000 à moins de 1 000. Chaque combinaison de modèles a offert une qualité similaire à des prix très différents, et cet écart est le cœur du sujet.
2026-08-05
Autonomie réseau
Un angle mort de confiance dans les réseaux d'agents multi-fournisseurs trouve une solution
Lorsque l'outil du fournisseur B est compromis, les agents du fournisseur A continuent de l'utiliser sans le savoir. Un nouvel article propose une machine d'état de confiance avec propagation de cascade amortie pour réduire le confinement de plusieurs heures à un temps quasi réel.
2026-08-04
Agents IA
Le bot Slack de Hugging Face interroge les données de production. Le LLM ne voit jamais les clés
Hugging Face opère un agent de codage Slack interne, Moon Bot, capable d'interroger des bases de données de production et d'ouvrir des PR. Sa conception de la sécurité maintient les identifiants hors de portée du modèle grâce à des niveaux Okta, un bash sandboxé et des proxys inverses locaux qui injectent les clés côté serveur.
2026-08-04
Infrastructure IA
Faire payer les agents est facile. Les rendre dignes de confiance ne l'est pas.
L'Agent Stack de Circle fournit les rails financiers de l'économie agentique : paiements en USDC, politiques de dépenses et registre de services. Mais le véritable obstacle n'est pas la technologie, c'est la gouvernance. Sans pistes d'audit transparentes et de garde-fous programmables, la promesse du commerce autonome reste théorique.
2026-08-04
Agents IA
La promesse d'agents 24/7 de Zuckerberg se heurte au problème de confiance de Meta
Zuckerberg promet des agents grand public 24/7 pour la santé, les relations et les finances, les qualifiant de prochaine vague de revenus de Meta. La distribution est réelle à l'échelle de WhatsApp, mais un déficit de confiance et l'absence d'écosystèmes de données se dressent entre la vision et les milliards d'utilisateurs nécessaires.
2026-08-03
Développement IA
Les agents de codage quittent votre machine locale : Alibaba et Mistral passent à distance
Qoder d'Alibaba Cloud introduit la délégation à distance pour les agents de codage, permettant aux développeurs de décharger les tâches longues vers des sandbox cloud. Cette fonctionnalité, associée à un nouveau moteur de connaissances, oppose directement Qoder aux agents distants de Mistral dans une course pour découpler le développement assisté par IA du terminal local.
2026-08-03
Agents LLM
La taxe de régression : pourquoi charger les agents LLM de compétences peut se retourner contre vous
Une nouvelle étude montre que l'ajout de compétences procédurales aux agents LLM n'aide pas toujours, cela peut introduire des régressions, où des tâches auparavant résolues sans compétences échouent après l'ajout de compétences. La recherche identifie trois causes et affirme que la fiabilité dépend davantage de l'ancrage et de la vérification que de la compétence elle-même.
2026-08-03
Routage IA
Pour l'IA agentique, le routage par appel est le point aveugle. TRACE-Router a une solution.
Un nouveau framework de routage, TRACE-Router, s'attaque au décalage entre les routeurs LLM par appel et les métriques de succès au niveau de la tâche dans l'IA agentique, gagnant jusqu'à 8 points de précision et 36% de latence en moins.
2026-08-01
IA industrielle
AgentRCA : analyse de cause racine zero-shot qui explique son propre raisonnement
Un framework agentique zero-shot appelé AgentRCA utilise un jumeau numérique et un LLM pour diagnostiquer les défauts d'usine sans données étiquetées, atteignant une précision de niveau supervisé avec une transparence totale.
2026-08-01
IA de recherche approfondie
Le nouvel agent de recherche de BAAI ne se contente pas de chercher plus longtemps, il vérifie ses propres devoirs
Les agents AREX de BAAI utilisent une boucle d'auto-amélioration récursive qui compresse les longs historiques de recherche, permettant un raffinement efficace axé sur la vérification. Entraînés avec une nouvelle recette de RL à long horizon, ils surpassent les bases de référence comparables sur BrowseComp, DeepSearchQA et HLE.
2026-07-31
Agents GUI
L'agent Qwen-UI-Agent d'Alibaba obtient de meilleurs scores sur de vrais téléphones que dans les sandboxes
Le Qwen-UI-Agent du laboratoire Tongyi d'Alibaba revendique des scores mobiles de pointe (97,5 % sur AndroidDaily) et des résultats compétitifs en usage informatique face à Opus 4.8, Gemini 3.1 Pro et GPT-5.6 Sol. Son score sur benchmark sur appareil réel dépasse son score en sandbox, tandis que 40 % de progression partielle sur OSWorld-v2 constitue la limite honnête.
2026-07-31
Ingénierie multi-agents
L'expérience multi-agents de Qoder : 60 % d'erreurs en moins, mais à quel prix ?
Une analyse d'Experts Mode de Qoder d'Alibaba Cloud, qui déploie des agents IA spécialisés comme une équipe coordonnée. Les affirmations de réduction significative des erreurs sont examinées à la lumière de cas d'usage réels et des compromis de la complexité multi-agent.
2026-07-31