Recherche en IA
18 published articles
Agents IA
PsychoAgent a doté les agents d'IA d'une mémoire émotionnelle. Les évaluateurs n'ont trouvé aucun avantage
PsychoAgent donne aux agents LLM une mémoire affective distincte, de sorte que les traces conflictuelles et chargées d'émotion peuvent l'emporter sur celles simplement thématiques. Dans trois scénarios de conflit, il a récupéré plus de mémoires critiques pour le conflit que les deux références (0.933 contre 0.500 et 0.667), mais cinq évaluateurs en aveugle n'ont trouvé aucun avantage qualitatif significatif.
2026-08-19
Recherche en IA
Un patron IA qui ignore les réponses pousse son subalterne dans un état « alien »
Un nouvel article sur arXiv révèle que les agents IA se comportent différemment en interaction qu'en isolation. Un agent patron qui ignore les réponses de son subalterne le pousse dans un état « alien », et lorsque le patron écoute, les deux évoluent ensemble. Ce résultat fait de la livraison des messages une décision de conception pour les systèmes multi-agents.
2026-08-19
Recherche IA
Fini le copier-coller des compétences : la correction sans évaluation de SkillZip pour les agents gonflés
Les agents auto-évolutifs ajoutent des correctifs jusqu'à ce que la même règle apparaisse dans plusieurs branches. SkillZip compresse leurs compétences sans rollouts d'évaluation, en trouvant la plus courte explication structurelle fidèle. Les modes one-shot et Zip-on-Write, et ce que le résumé laisse sans preuve.
2026-08-15
Recherche en IA vidéo
Comment la distillation contextuellement alignée empêche les enseignants vidéo de voir l'avenir
La distillation vidéo a longtemps formé des étudiants causaux contre des enseignants qui notent des clips entiers avec une connaissance du futur. CMD remplace cette notation par un enseignant causal, ajoute des cibles notées par préfixe et rapporte des résultats de pointe parmi les méthodes autorégressives.
2026-08-14
Recherche en IA
Voice Memory : un fichier de 776 octets qui dit à la reconnaissance vocale quand ne rien faire
Un nouveau schéma d'inférence seule pour la reconnaissance vocale apprend la retenue : un correcteur figé lit un fichier mémoire par domaine et décide quand s'abstenir. La correction non contrainte casse les jetons corrects dans jusqu'à 64 % des modifications ; Voice Memory réduit ce taux à 35 % et abaisse le WER pondéré de 8,36 % à 7,52 %.
2026-08-06
Agents IA
Traiter les SOP comme du code : un nouveau runtime à pagination par pile sépare les agents forts des faibles
De nouvelles recherches de Hong Kong et de Chine continentale démontrent que la compilation des SOP en pseudo-code exécutable et leur exécution sur une machine virtuelle à pagination par pile séparent clairement les agents capables des agents fragiles. Le travail donne une règle de déploiement précise : compiler d'abord, paginer seulement après une vérification de discipline au niveau du modèle.
2026-08-04
Benchmark
Les modèles de vision IA de pointe échouent dans la perception de base, selon un nouveau benchmark
PerceptionBench teste dix capacités visuelles atomiques sur 3 000 questions. Aucun modèle de pointe n'a dépassé 60 %, et des scores globaux similaires masquent des profils de faiblesse radicalement différents.
2026-08-03
Benchmark TRACTA
Le raisonnement neuro-symbolique surpasse les modèles neuronaux bruts sur les tâches temporelles, selon un benchmark
Le benchmark TRACTA révèle que l'IA neuro-symbolique bat les modèles neuronaux bruts sur trois tâches de raisonnement temporel, avec les plus grandes marges sur l'alerte précoce et la détection de motifs.
2026-08-02
Intelligence Artificielle
Pourquoi la chaîne de pensée de votre IA gaspille des jetons, et comment l'arrêt optimal y remédie
Des chercheurs du MIT proposent OS-Pruner, un plug-in qui arrête dynamiquement le raisonnement par chaîne de pensée lorsque des calculs supplémentaires ne valent pas le coût en jetons. Les tests montrent une réduction de longueur de 20 à 60 % avec un sacrifice de précision minime.
2026-07-29
Recherche en IA
SoftReason comble le fossé du gradient qui empêchait les réseaux de neurones de raisonner véritablement
SoftReason est une architecture neuro-souple-symbolique entièrement différentiable pour le raisonnement déductif. Elle supprime la barrière du gradient entre la perception et la déduction, permettant un apprentissage de bout en bout sur des données perceptuelles de grande dimension et des triplets de graphes de connaissances. Testé sur KVQA, il montre comment le raisonnement souple peut unifier l'ancrage, l'injection de preuves et la fermeture.
2026-07-26
IA multimodale
Pourquoi les modèles vision-langage ont besoin d'une fenêtre de relais visuel pour arrêter de halluciner
De nouvelles recherches révèlent une redistribution stable en trois étapes de l'attention multimodale dans les VLM, opérationnalisée sous le nom de Fenêtre de Relais Visuel (VRW). Le cadre TRACE utilise des modules légers entraînés pour planifier cette fenêtre par tâche, améliorant les bancs d'essai sensibles à l'ancrage de 4,33 points en moyenne et jusqu'à 6,6 points.
2026-07-23
Recherche en IA
Qwen-Music place la mélodie au premier plan, et les résultats parlent d'eux-mêmes
Qwen-Music innove en planifiant explicitement les mélodies avant de générer des chansons complètes, une technique que l'équipe appelle Melody-CoT. Le modèle obtient des résultats de pointe sur 13 des 16 métriques objectives et, lors de tests en aveugle, bat Suno V5 et MiniMax Music 2.6.
2026-07-20