SevenTnewS

Agents IA

PsychoAgent a doté les agents d'IA d'une mémoire émotionnelle. Les évaluateurs n'ont trouvé aucun avantage

PsychoAgent donne aux agents LLM une mémoire affective distincte, de sorte que les traces conflictuelles et chargées d'émotion peuvent l'emporter sur celles simplement thématiques. Dans trois scénarios de conflit, il a récupéré plus de mémoires critiques pour le conflit que les deux références (0.933 contre 0.500 et 0.667), mais cinq évaluateurs en aveugle n'ont trouvé aucun avantage qualitatif significatif.

Emmanuel Fabrice Omgbwa Yasse Assisté par IA

2026-08-19 · 4 min de lecture

PsychoAgent a doté les agents d'IA d'une mémoire émotionnelle. Les évaluateurs n'ont trouvé aucun avantage

La mémoire à long terme empêche un agent LLM de poser deux fois la même question, et c'est aussi ainsi que l'agent se trouve bloqué. Lorsque de nouvelles preuves contredisent un ancien souvenir, la trace obsolète peut rester récupérable et évincer celle qui l'a remplacée. Une prépublication postée sur arXiv le 7 août 2026 aborde ce problème d'un côté inattendu : plutôt que de décider quels souvenirs sont vrais, elle demande lesquels pèsent sur l'agent.

L'architecture s'appelle PsychoAgent. Ce n'est pas un nouveau modèle de fondation ; c'est une architecture cognitive pour agents LLM qui sépare la mémoire factuelle et la mémoire affective et les intègre toutes deux via un contrôleur exécutif conscient des conflits. Les souvenirs affectifs sont d'abord filtrés par pertinence sémantique, puis reclassés par saillance, de sorte que les traces émotionnellement importantes peuvent entrer dans le prompt sans perdre leur adéquation thématique. Le postulat, emprunté à la façon dont les humains se souviennent, est que la similarité thématique n'est pas le seul sélecteur : la signification affective et les conflits non résolus façonnent ce qui devient accessible.

Cela importe au-delà des scores de rappel. Pour un agent, la couche de récupération décide de ce que le modèle sous-jacent peut jamais voir, donc un biais dans la récupération devient un biais dans le comportement. Un système qui privilégie systématiquement les souvenirs chargés d'affect ou porteurs de conflit ne se souvient pas seulement différemment ; il agit sur une version différente du passé.

Comment PsychoAgent pèse la saillance émotionnelle

Graphique : Conflict-critical memory retrieval by system
Conflict-critical memory retrieval across the three conflict scenarios, as reported in the article.

Le mécanisme de la prépublication repose sur deux espaces de stockage et un point de décision. Les mémoires factuelles et affectives vivent séparément, et le contrôleur exécutif intègre les deux. Les traces chargées d'affect n'atteignent le prompt qu'après un reclassement par saillance qui respecte toujours la pertinence sémantique, préservant l'adéquation thématique tout en laissant passer les souvenirs émotionnellement importants. Ce que la conception ne fait pas, c'est vérifier qu'un souvenir est toujours vrai ; la validité est traitée comme une préoccupation distincte, et une ligne de travail parallèle s'en charge.

Les chiffres de récupération et le verdict des évaluateurs

Les chiffres principaux proviennent de trois scénarios de conflit contrôlés. L'architecture complète a récupéré plus de mémoires critiques pour le conflit qu'une référence sémantique-affective et que la RAG à mémoire unique : 0.933 contre 0.500 et 0.667, au prix d'une légère baisse de similarité sémantique.

Trois scénarios de conflitPsychoAgent completRéférence sémantique-affectiveRAG à mémoire unique
Récupération des mémoires critiques pour le conflit0.9330.5000.667

À lire ces chiffres au pied de la lettre : la RAG simple fait déjà remonter deux mémoires critiques sur trois, de sorte que l'avantage de l'architecture se limite au tiers restant, où la saillance tranche.

L'évaluation humaine est plus sobre. Cinq évaluateurs en aveugle ont noté 27 sorties, et après standardisation intra-évaluateur, l'architecture complète a affiché la moyenne globale la plus élevée, +0.22 écarts-types. Les différences appariées corrigées n'ont pas atteint la significativité. En termes simples : le système a fait remonter davantage de mémoires que les scénarios étaient conçus pour tester, mais les correcteurs n'ont pas pu noter ses sorties de manière fiable au-dessus des alternatives.

Ce que l'affect apporte à la course à la mémoire des agents

PsychoAgent arrive dans une saison chargée pour la recherche sur la mémoire des agents. Rien que cet été, des prépublications ont proposé des couches de compétences, des rubriques auto-évolutives et une révocation de mémoire. L'une d'elles est TEPA, soumise le même jour, qui attaque de front le côté validité du problème : elle traite la validité de la mémoire comme un état explicite, indexe les observations comme des précédents et révoque les précédents actifs lorsque de nouvelles preuves les contredisent sous la même clé. Ses auteurs appellent ce mode de défaillance pollution de la mémoire, une dégradation causée par des mémoires actives que des preuves plus récentes ont supplantées, et positionnent la révocation de cycle de vie comme une opération centrale pour les agents qui doivent falsifier, auditer, puis re-promouvoir des connaissances en évolution. Là où TEPA supprime, PsychoAgent repondère.

Le document soutient que la récupération sensible aux affects est un mécanisme inspectable pour modéliser les effets de conflit de type humain chez les agents, et il inclut une trace illustrative de trois jours montrant un affect persistant, une recombinaison de mémoire hors ligne et une repondération sélective de la mémoire. La base de preuves, cependant, est de trois scénarios, 27 sorties et cinq évaluateurs. La chose la plus crédible dans la prépublication est la façon dont elle se présente : le résultat nul des évaluateurs figure dans le même résumé que le titre de la récupération.

Cette franchise compte, car le mécanisme n'est utile que si le fait de changer les souvenirs qui remontent améliore aussi ce que fait l'agent, et les preuves actuelles ne l'établissent pas. L'étape suivante évidente est une réplication avec davantage de scénarios, davantage d'évaluateurs et une analyse préenregistrée. PsychoAgent change ce dont un agent se souvient lorsque des souvenirs entrent en conflit. Savoir si l'agent agit mieux sur ces souvenirs reste une question ouverte, et la prépublication le dit elle-même.

L'essentiel de la tech en 3 minutes chaque matin

Un email, chaque jour ouvré, avec ce qui compte vraiment en IA et en tech.