LLM & Modèles3 min read
Recherche en IA
Un petit contrôleur de surveillance améliore de 4,5 points les scores des LLM quantifiés sur MATH-500
Une nouvelle recherche propose un contrôleur de surveillance externe pour les petits modèles de langage quantifiés, qui détecte les chemins de raisonnement répétitifs ou dégénérés et déclenche un retour en arrière et un re-décodage contraint. La précision s'est améliorée de 4,5 points de pourcentage sur un large ensemble d'évaluation, mais les auteurs soulignent que les résultats ne sont pas confirmatoires.
2026-07-30