SevenTnewS

Agents IA

Agents autonomes, workflows multi-agents et orchestration.

45 published articles

5 min read

Outils de design

Open Design 0.18.0 met fin à la réunion « Est-ce la dernière version ? »

Open Design 0.18.0 propose un espace de travail d'équipe partagé avec des miroirs en lecture seule en direct et permet à Codex d'appeler le moteur de design sans interface. 115 pull requests de 22 contributeurs ont été fusionnées en deux jours. Voici ce qui a changé et la tendance des outils d'agents à laquelle cela correspond.

2026-08-21

4 min read

Mémoire des agents

TEPA : pour les agents IA, une mémoire obsolète est pire que l'absence de mémoire

La mémoire des agents a un problème de falsifiabilité, soutient un nouveau préprint arXiv : les faits obsolètes restent récupérables et polluent le prompt. Son mécanisme TEPA révoque les mémoires dépassées, et lors des tests de dérive, la mémoire naïve a obtenu un score inférieur à celui de l'absence de mémoire (0.210 contre 0.309), tandis que TEPA a atteint 0.950.

2026-08-19

4 min read

Agents IA

PsychoAgent a doté les agents d'IA d'une mémoire émotionnelle. Les évaluateurs n'ont trouvé aucun avantage

PsychoAgent donne aux agents LLM une mémoire affective distincte, de sorte que les traces conflictuelles et chargées d'émotion peuvent l'emporter sur celles simplement thématiques. Dans trois scénarios de conflit, il a récupéré plus de mémoires critiques pour le conflit que les deux références (0.933 contre 0.500 et 0.667), mais cinq évaluateurs en aveugle n'ont trouvé aucun avantage qualitatif significatif.

2026-08-19

4 min read

Codage agentique & gonflement des prompts

Mémoire catastrophique : pourquoi les fichiers CLAUDE.md grossissent de 226 % et ne rétrécissent jamais

Une étude arXiv portant sur 1 867 dépôts constate que les fichiers d'instructions de codage agentique comme CLAUDE.md triplent de taille au cours de leur vie, car supprimer une ligne risque d'entraîner des régressions une fois sa justification perdue. Les auteurs nomment ce phénomène « mémoire catastrophique » et montrent que documenter le raisonnement réduit les instructions superflues de 99,3 %.

2026-08-15

4 min read

Recherche IA

Fini le copier-coller des compétences : la correction sans évaluation de SkillZip pour les agents gonflés

Les agents auto-évolutifs ajoutent des correctifs jusqu'à ce que la même règle apparaisse dans plusieurs branches. SkillZip compresse leurs compétences sans rollouts d'évaluation, en trouvant la plus courte explication structurelle fidèle. Les modes one-shot et Zip-on-Write, et ce que le résumé laisse sans preuve.

2026-08-15

4 min read

Agents IA

Quand les compétences des agents se retournent contre eux, SkillProx les élaguent comme une descente de gradient

Les compétences étaient censées rendre les agents plus intelligents, mais chaque correctif qu'ils accumulent peut les rendre moins intelligents. SkillProx exécute une boucle avant-arrière inspirée du gradient proximal qui diagnostique, annule et supprime. Résultat : un gain moyen en précision de 3,0 points par rapport à la baseline à base de gradient la plus solide.

2026-08-14

7 min read

Sécurité du terminal

Le piège « $HOME » : les agents de codage IA ont besoin de sandboxes, pas de prompts « allow ? »

Le sandbox terminal de Qoder bloque près d'une centaine de commandes d'agents destructrices chaque jour. Les cas derrière ces blocages expliquent pourquoi les prompts « allow ? » échouent : un dossier de projet nommé $HOME, un nettoyage qui ciblait /root, et un clic qui a failli coûter un disque entier.

2026-08-13

4 min read

IA clinique

nMAS automatise l'ingénierie des caractéristiques EHR de l'insuffisance cardiaque, testé uniquement sur 500 patients factices

nMAS, un pipeline multi-agents, a généré 132 caractéristiques structurées et 70 caractéristiques notées par rubrique à partir de 500 dossiers patients factices, faisant passer l'AUROC de phénotypage HFrEF sur l'ensemble de validation de 0,895 à 0,963. La prépublication n'a pas été validée sur des données réelles de patients.

2026-08-13

7 min read

Qoder Computer Use

Un ingénieur a livré un agent macOS sans connaître Swift

Un ingénieur qui ne savait pas lire Swift a livré un logiciel macOS de qualité production avec Computer Use de Qoder. Son approche : juger le code au comportement, faire générer ses propres tests à l'Agent, et conserver chaque leçon dans le système de fichiers afin qu'aucun cycle ne parte de zéro.

2026-08-12

5 min read

Agents IA et DevOps

Une question en une phrase dans Qoder met fin à la recherche de cause racine de 40 minutes

Le plugin STAROps d'Alibaba Cloud intègre le diagnostic de cause racine en langage naturel dans l'IDE Qoder. Sa démo fait passer un pic de P95 de moins de 60 ms à 1,9 seconde, renvoie une chaîne de preuves avec un niveau de confiance de 80 % et se termine par une merge request créée automatiquement. Le dépannage traditionnel prenait plus de 40 minutes sur cinq plateformes.

2026-08-09

5 min read

UI agentique

Qoder Canvas : un système de conception conçu pour les agents, pas pour les humains

L'équipe Qoder d'Alibaba affirme que la fenêtre de chat n'est pas le bon contenant pour les sorties complexes des agents. Qoder Canvas applique la pensée des systèmes de conception aux interfaces des agents, apprenant aux agents à créer des artefacts interactifs et conscients du codebase plutôt que des murs de Markdown.

2026-08-07

Featured1 min read

Codage IA

OpenCode parie que l'efficacité des tokens gagnera, en ajoutant Ling 3.0 Flash gratuitement

OpenCode propose désormais gratuitement Ling 3.0 Flash d'inclusionAI, quelques jours après sa sortie. Cette décision prolonge une stratégie attentive aux coûts, qui parie que l'efficacité des tokens gagnera la course du codage IA.

2026-08-07

← PreviousPage 1 / 4 · 45 articlesNext →