efficacité
3 published articles
IA multimodale
Un modèle de 12B bat un modèle de 90B. L'orthodoxie du scaling est en difficulté
Pixtral-12B égale ou bat des modèles sept fois plus grands sur des benchmarks multimodaux, sans sacrifier les performances linguistiques. Mistral publie également un nouveau benchmark ouvert pour l'évaluation pratique vision-langage, remettant en cause l'idée que plus grand est toujours meilleur.
2026-07-17
Analyse comparative approfondie
GPT-5.6 : chaque dollar investi dans l'IA compte plus que jamais
La famille GPT-5.6 d'OpenAI, Sol, Terra, Luna, offre des résultats de pointe en codage, cybersécurité et benchmarks professionnels pour une fraction du coût en tokens de ses concurrents. Le mode multi-agent « ultra » et une tarification par paliers visent à rendre l'intelligence de pointe accessible à davantage d'utilisateurs, tandis que des garde-fous en couches abordent les risques à double usage.
2026-07-09
Recherche en IA open source
Contexte d'un million de tokens avec un dixième du cache KV : le pari d'efficacité de DeepSeek-V4
L'aperçu V4 de DeepSeek associe un modèle Pro de 1,6T de paramètres à une variante Flash de 284B, tous deux avec un contexte d'un million de tokens. Le document revendique 27 % des FLOPs d'inférence et 10 % du cache KV de V3.2, soit les chiffres qui rendent ce contexte rentable à servir.
2026-06-22