SevenTnewS

Architectures multi-agents

Pourquoi Qoder donne un chef à chaque agent IA

Le mode Experts de Qoder remplace la messagerie multi-agents pair-à-pair par un Leader unique qui coordonne des experts spécialisés de manière asynchrone. L'architecture réduit l'explosion d'état, améliore la qualité sur quatre dimensions et extrait des compétences réutilisables après chaque tâche.

Emmanuel Fabrice Omgbwa Yasse Assisté par IA

2026-03-11 · Dernière mise à jour : 2026-07-30 · 3 min de lecture

Pourquoi Qoder donne un chef à chaque agent IA

Lorsque plusieurs agents IA tentent de travailler ensemble sur une tâche d'ingénierie complexe, l'instinct naturel est de les laisser parler directement. Partager des découvertes, demander de l'aide, diffuser des mises à jour. Mais à mesure que le nombre d'agents augmente, ce réseau de conversations devient rapidement un désastre : informations contradictoires, travail redondant, un espace d'état qui explose hors de contrôle.

Le Qoder d'Alibaba Cloud adopte l'approche inverse. Son nouveau mode Experts remplace la messagerie pair-à-pair par un agent unique qui agit comme chef d'équipe. Le Leader décide qui fait quoi, quand, et assemble les résultats. Les agents ne se parlent jamais. Ils ne parlent qu'au patron.

Un cerveau, plusieurs mains

Le mode Experts divise le travail en un DAG de tâches dépendantes. Le Leader maintient une vue globale, décompose les exigences en sous-tâches et les répartit entre des experts spécialisés. Ces experts s'exécutent de manière asynchrone et en parallèle : dès que le Leader envoie une tâche, il passe immédiatement à la suivante, permettant à plusieurs experts de travailler simultanément.

Les cinq types d'experts intégrés sont chacun dotés de leur propre ensemble d'outils :

  • Expert en recherche, sélection de technologies, analyse des causes racines, recherche concurrentielle, évaluation de l'impact sur la base de code. Il intègre la recherche sémantique, la recherche de code, les graphes de connaissances et la recherche web. Qoder revendique une amélioration de 21% du F-Score par rapport aux références du secteur pour la recherche de code.
  • Expert en codage, nouvelles fonctionnalités, corrections de bugs d'urgence, refactoring, développement d'API, modélisation de base de données. S'exécute dans un sandbox multi-plateforme (Mac, Linux, Windows) pour la sécurité.
  • Expert QA (Vérification), vérification de régression sensible aux changements, portes qualité, validation fonctionnelle, vérifications pré-déploiement.
  • Expert en revue de code, revue de PR/MR, évaluation des risques, vérifications de sécurité et de performance, revue d'architecture. Selon les benchmarks internes de Qoder, il se classe Top 2 dans l'industrie, surpassant Cursor et Codex.
  • Expert navigateur, tests d'interaction frontend, flux de formulaires de bout en bout, régression visuelle, vérifications inter-navigateurs. Qoder affirme économiser 60% des coûts de tokens par rapport à l'approche basée sur MCP de Playwright.

Comment fonctionne la coordination

Chaque expert rend compte via une boîte aux lettres. Après avoir terminé une tâche, un expert envoie un callback qui atterrit dans la boîte de réception du Leader. Le Leader, lorsqu'il est inactif, lit le message, effectue un raisonnement du modèle et décide de l'action suivante : envoyer un autre expert, mettre à jour l'état de la tâche ou répondre à l'utilisateur. Cette boucle (rapport → évaluation → action) se poursuit jusqu'à ce que toutes les tâches soient terminées.

L'utilisateur reste également dans la boucle. Vous pouvez interrompre à tout moment, et le Leader intégrera votre contribution dans son prochain cycle, ajustant la direction ou annulant le travail. Le rôle passe de la conduite de chaque étape à l'alignement des intentions et à la révision des résultats, plus comme diriger une véritable équipe d'ingénierie.

Apprendre de chaque tâche

Après achèvement, le système détecte des signaux (corrections, échecs, instructions utilisateur) et extrait des compétences réutilisables. L'agent principal et les sous-agents capturent des compétences spécifiques au domaine à partir de leur propre travail. Ces compétences sont stockées comme mémoire persistante et rappelées automatiquement lorsque des tâches similaires apparaissent, formant une boucle d'apprentissage fermée.

Benchmarks : qualité et coût

Qoder a testé le mode Experts sur un benchmark interne de tâches d'ingénierie complexes couvrant le développement full-stack, le refactoring cross-langage et l'implémentation de fonctionnalités. Ils ont évalué sur quatre dimensions de qualité : utilisabilité, complétude, expérience UI et qualité technique. Le mode Experts a surpassé sur les quatre. Les gains proviennent des choix architecturaux, de la coordination centralisée, de la planification asynchrone parallèle et des experts spécialisés, plutôt que d'ajouter simplement plus d'agents.

Les données, bien sûr, sont propres à Qoder, et le modèle de comparaison n'est pas spécifié. Mais le principe est défendable : dans les systèmes où les agents ont des capacités qui se chevauchent, un leader partagé peut maintenir une cohérence que la messagerie libre a du mal à préserver. L'architecture reflète un organigramme d'ingénierie réel pour une raison.

L'essentiel de la tech en 3 minutes chaque matin

Un email, chaque jour ouvré, avec ce qui compte vraiment en IA et en tech.