Génération augmentée de récupération
2 published articles
IA d'usine en local, prépublication arXiv
La compression a coûté à un assistant d'usine 13,7 % de sa qualité de réponse
Une nouvelle prépublication soutient qu'une fois un modèle compressé et adapté à l'aide de la recherche documentaire, le nombre de paramètres cesse de prédire la qualité des réponses que donne un assistant d'atelier. Sa seule étude de cas perd 13,7 % de qualité évaluée à cause de l'extraction et en récupère les deux tiers.
2026-09-25
Recherche en IA
Des chaînes de pensée plus longues butent sur un mur. ThinkRetrieve injecte le correctif en cours de raisonnement
Le test-time scaling séquentiel atteint souvent des rendements décroissants, voire négatifs, affirme une nouvelle prépublication. ThinkRetrieve récupère des exemples résolus en cours de raisonnement et les injecte dans la trace, rapportant des gains relatifs allant jusqu'à 60 % sur AIME 2025 sur cinq petits modèles de raisonnement.
2026-08-18