SevenTnewS

Recherche en IA

18 published articles

Agents IA4 min read

Agents IA

PsychoAgent a doté les agents d'IA d'une mémoire émotionnelle. Les évaluateurs n'ont trouvé aucun avantage

PsychoAgent donne aux agents LLM une mémoire affective distincte, de sorte que les traces conflictuelles et chargées d'émotion peuvent l'emporter sur celles simplement thématiques. Dans trois scénarios de conflit, il a récupéré plus de mémoires critiques pour le conflit que les deux références (0.933 contre 0.500 et 0.667), mais cinq évaluateurs en aveugle n'ont trouvé aucun avantage qualitatif significatif.

2026-08-19

Laboratoires & Recherche4 min read

Recherche en IA

Un patron IA qui ignore les réponses pousse son subalterne dans un état « alien »

Un nouvel article sur arXiv révèle que les agents IA se comportent différemment en interaction qu'en isolation. Un agent patron qui ignore les réponses de son subalterne le pousse dans un état « alien », et lorsque le patron écoute, les deux évoluent ensemble. Ce résultat fait de la livraison des messages une décision de conception pour les systèmes multi-agents.

2026-08-19

Agents IA4 min read

Recherche IA

Fini le copier-coller des compétences : la correction sans évaluation de SkillZip pour les agents gonflés

Les agents auto-évolutifs ajoutent des correctifs jusqu'à ce que la même règle apparaisse dans plusieurs branches. SkillZip compresse leurs compétences sans rollouts d'évaluation, en trouvant la plus courte explication structurelle fidèle. Les modes one-shot et Zip-on-Write, et ce que le résumé laisse sans preuve.

2026-08-15

Vision & DiffusionFeatured5 min read

Recherche en IA vidéo

Comment la distillation contextuellement alignée empêche les enseignants vidéo de voir l'avenir

La distillation vidéo a longtemps formé des étudiants causaux contre des enseignants qui notent des clips entiers avec une connaissance du futur. CMD remplace cette notation par un enseignant causal, ajoute des cibles notées par préfixe et rapporte des résultats de pointe parmi les méthodes autorégressives.

2026-08-14

NLP & ML4 min read

Recherche en IA

Voice Memory : un fichier de 776 octets qui dit à la reconnaissance vocale quand ne rien faire

Un nouveau schéma d'inférence seule pour la reconnaissance vocale apprend la retenue : un correcteur figé lit un fichier mémoire par domaine et décide quand s'abstenir. La correction non contrainte casse les jetons corrects dans jusqu'à 64 % des modifications ; Voice Memory réduit ce taux à 35 % et abaisse le WER pondéré de 8,36 % à 7,52 %.

2026-08-06

IA5 min read

Agents IA

Traiter les SOP comme du code : un nouveau runtime à pagination par pile sépare les agents forts des faibles

De nouvelles recherches de Hong Kong et de Chine continentale démontrent que la compilation des SOP en pseudo-code exécutable et leur exécution sur une machine virtuelle à pagination par pile séparent clairement les agents capables des agents fragiles. Le travail donne une règle de déploiement précise : compiler d'abord, paginer seulement après une vérification de discipline au niveau du modèle.

2026-08-04

Tests & BenchmarksFeatured3 min read

Benchmark

Les modèles de vision IA de pointe échouent dans la perception de base, selon un nouveau benchmark

PerceptionBench teste dix capacités visuelles atomiques sur 3 000 questions. Aucun modèle de pointe n'a dépassé 60 %, et des scores globaux similaires masquent des profils de faiblesse radicalement différents.

2026-08-03

IA3 min read

Benchmark TRACTA

Le raisonnement neuro-symbolique surpasse les modèles neuronaux bruts sur les tâches temporelles, selon un benchmark

Le benchmark TRACTA révèle que l'IA neuro-symbolique bat les modèles neuronaux bruts sur trois tâches de raisonnement temporel, avec les plus grandes marges sur l'alerte précoce et la détection de motifs.

2026-08-02

IA4 min read

Intelligence Artificielle

Pourquoi la chaîne de pensée de votre IA gaspille des jetons, et comment l'arrêt optimal y remédie

Des chercheurs du MIT proposent OS-Pruner, un plug-in qui arrête dynamiquement le raisonnement par chaîne de pensée lorsque des calculs supplémentaires ne valent pas le coût en jetons. Les tests montrent une réduction de longueur de 20 à 60 % avec un sacrifice de précision minime.

2026-07-29

Laboratoires & Recherche4 min read

Recherche en IA

SoftReason comble le fossé du gradient qui empêchait les réseaux de neurones de raisonner véritablement

SoftReason est une architecture neuro-souple-symbolique entièrement différentiable pour le raisonnement déductif. Elle supprime la barrière du gradient entre la perception et la déduction, permettant un apprentissage de bout en bout sur des données perceptuelles de grande dimension et des triplets de graphes de connaissances. Testé sur KVQA, il montre comment le raisonnement souple peut unifier l'ancrage, l'injection de preuves et la fermeture.

2026-07-26

LLM & Modèles4 min read

IA multimodale

Pourquoi les modèles vision-langage ont besoin d'une fenêtre de relais visuel pour arrêter de halluciner

De nouvelles recherches révèlent une redistribution stable en trois étapes de l'attention multimodale dans les VLM, opérationnalisée sous le nom de Fenêtre de Relais Visuel (VRW). Le cadre TRACE utilise des modules légers entraînés pour planifier cette fenêtre par tâche, améliorant les bancs d'essai sensibles à l'ancrage de 4,33 points en moyenne et jusqu'à 6,6 points.

2026-07-23

LLM & ModèlesFeatured4 min read

Recherche en IA

Qwen-Music place la mélodie au premier plan, et les résultats parlent d'eux-mêmes

Qwen-Music innove en planifiant explicitement les mélodies avant de générer des chansons complètes, une technique que l'équipe appelle Melody-CoT. Le modèle obtient des résultats de pointe sur 13 des 16 métriques objectives et, lors de tests en aveugle, bat Suno V5 et MiniMax Music 2.6.

2026-07-20

← PreviousPage 1 / 2 · 18 articlesNext →