SevenTnewS

Agents IA

Agents autonomes, workflows multi-agents et orchestration.

45 published articles

6 min read

Agents IA

Le swarm de Cursor a reconstruit SQLite de zéro. Mêmes scores, factures radicalement différentes

Le swarm d'agents repensé de Cursor a reconstruit SQLite en Rust à partir du seul manuel et a réussi l'intégralité de la suite de vérification, réduisant les conflits de fusion de plus de 70 000 à moins de 1 000. Chaque combinaison de modèles a offert une qualité similaire à des prix très différents, et cet écart est le cœur du sujet.

2026-08-05

2 min read

Autonomie réseau

Un angle mort de confiance dans les réseaux d'agents multi-fournisseurs trouve une solution

Lorsque l'outil du fournisseur B est compromis, les agents du fournisseur A continuent de l'utiliser sans le savoir. Un nouvel article propose une machine d'état de confiance avec propagation de cascade amortie pour réduire le confinement de plusieurs heures à un temps quasi réel.

2026-08-04

5 min read

Agents IA

Le bot Slack de Hugging Face interroge les données de production. Le LLM ne voit jamais les clés

Hugging Face opère un agent de codage Slack interne, Moon Bot, capable d'interroger des bases de données de production et d'ouvrir des PR. Sa conception de la sécurité maintient les identifiants hors de portée du modèle grâce à des niveaux Okta, un bash sandboxé et des proxys inverses locaux qui injectent les clés côté serveur.

2026-08-04

4 min read

Infrastructure IA

Faire payer les agents est facile. Les rendre dignes de confiance ne l'est pas.

L'Agent Stack de Circle fournit les rails financiers de l'économie agentique : paiements en USDC, politiques de dépenses et registre de services. Mais le véritable obstacle n'est pas la technologie, c'est la gouvernance. Sans pistes d'audit transparentes et de garde-fous programmables, la promesse du commerce autonome reste théorique.

2026-08-04

4 min read

Agents IA

La promesse d'agents 24/7 de Zuckerberg se heurte au problème de confiance de Meta

Zuckerberg promet des agents grand public 24/7 pour la santé, les relations et les finances, les qualifiant de prochaine vague de revenus de Meta. La distribution est réelle à l'échelle de WhatsApp, mais un déficit de confiance et l'absence d'écosystèmes de données se dressent entre la vision et les milliards d'utilisateurs nécessaires.

2026-08-03

3 min read

Développement IA

Les agents de codage quittent votre machine locale : Alibaba et Mistral passent à distance

Qoder d'Alibaba Cloud introduit la délégation à distance pour les agents de codage, permettant aux développeurs de décharger les tâches longues vers des sandbox cloud. Cette fonctionnalité, associée à un nouveau moteur de connaissances, oppose directement Qoder aux agents distants de Mistral dans une course pour découpler le développement assisté par IA du terminal local.

2026-08-03

4 min read

Agents LLM

La taxe de régression : pourquoi charger les agents LLM de compétences peut se retourner contre vous

Une nouvelle étude montre que l'ajout de compétences procédurales aux agents LLM n'aide pas toujours, cela peut introduire des régressions, où des tâches auparavant résolues sans compétences échouent après l'ajout de compétences. La recherche identifie trois causes et affirme que la fiabilité dépend davantage de l'ancrage et de la vérification que de la compétence elle-même.

2026-08-03

2 min read

Routage IA

Pour l'IA agentique, le routage par appel est le point aveugle. TRACE-Router a une solution.

Un nouveau framework de routage, TRACE-Router, s'attaque au décalage entre les routeurs LLM par appel et les métriques de succès au niveau de la tâche dans l'IA agentique, gagnant jusqu'à 8 points de précision et 36% de latence en moins.

2026-08-01

3 min read

IA industrielle

AgentRCA : analyse de cause racine zero-shot qui explique son propre raisonnement

Un framework agentique zero-shot appelé AgentRCA utilise un jumeau numérique et un LLM pour diagnostiquer les défauts d'usine sans données étiquetées, atteignant une précision de niveau supervisé avec une transparence totale.

2026-08-01

3 min read

IA de recherche approfondie

Le nouvel agent de recherche de BAAI ne se contente pas de chercher plus longtemps, il vérifie ses propres devoirs

Les agents AREX de BAAI utilisent une boucle d'auto-amélioration récursive qui compresse les longs historiques de recherche, permettant un raffinement efficace axé sur la vérification. Entraînés avec une nouvelle recette de RL à long horizon, ils surpassent les bases de référence comparables sur BrowseComp, DeepSearchQA et HLE.

2026-07-31

3 min read

Agents GUI

L'agent Qwen-UI-Agent d'Alibaba obtient de meilleurs scores sur de vrais téléphones que dans les sandboxes

Le Qwen-UI-Agent du laboratoire Tongyi d'Alibaba revendique des scores mobiles de pointe (97,5 % sur AndroidDaily) et des résultats compétitifs en usage informatique face à Opus 4.8, Gemini 3.1 Pro et GPT-5.6 Sol. Son score sur benchmark sur appareil réel dépasse son score en sandbox, tandis que 40 % de progression partielle sur OSWorld-v2 constitue la limite honnête.

2026-07-31

Featured2 min read

Ingénierie multi-agents

L'expérience multi-agents de Qoder : 60 % d'erreurs en moins, mais à quel prix ?

Une analyse d'Experts Mode de Qoder d'Alibaba Cloud, qui déploie des agents IA spécialisés comme une équipe coordonnée. Les affirmations de réduction significative des erreurs sont examinées à la lumière de cas d'usage réels et des compromis de la complexité multi-agent.

2026-07-31

← PreviousPage 2 / 4 · 45 articlesNext →