LLM
7 published articles
Le cheval de trait de Google, plus étoffé dans la mise à jour 3.7
Gemini 3.7 Flash divise son prix par deux, puis le justifie
Le Gemini 3.7 Flash de Google sort à la moitié du prix de lancement du 3.6 Flash, tout en revendiquant des gains sur les benchmarks de codage, de développement web et de travail cognitif. La sortie intervient trois semaines après le Flash précédent et s'accompagne d'un nouvel argument prix-performance pour les développeurs d'agents.
2026-08-16
Économie de l'IA
Le plan à 18 $ d'Alibaba fait tourner Qwen et DeepSeek dans Claude Code
Le Token Plan Individual d'Alibaba Cloud regroupe Qwen et des modèles tiers tels que DeepSeek dans un pool de crédits unique, à partir de 6 $ par mois, utilisable dans Claude Code et Cursor. L'entreprise revendique environ 40 % d'économies par rapport au paiement à l'utilisation, mais le plan ne fonctionne qu'à partir de Singapour et uniquement dans les outils approuvés.
2026-08-14
Qwen / Alibaba
Qwen3-2507 arrive avec un modèle de réflexion et un modèle d'instructions, la séparation revient à la mode
L'équipe Qwen d'Alibaba a publié Qwen3-2507, divisant sa gamme de modèles en variantes dédiées aux instructions et à la réflexion. La mise à jour apporte des améliorations substantielles en raisonnement, suivi d'instructions, et support de contexte 256K, extensible à 1 million de tokens.
2026-07-29
Modèles IA
OpenAI publie une mise à jour mineure de GPT pour la gestion des longs contextes
OpenAI a déployé aujourd'hui une mise à jour mineure de GPT, portant sur la gestion des longs contextes. Ce changement vise à aider le modèle à traiter les entrées étendues plus efficacement.
2026-07-28
Modèles d'IA
Claude Opus 5 égale presque Fable 5 sur tous les benchmarks, avec la cybersécurité comme angle mort délibéré
Claude Opus 5 est lancé avec des scores proches de Fable sur les benchmarks de codage et de connaissances à moitié prix. Mais ses capacités délibérément affaiblies en cybersécurité créent un compromis clair pour les développeurs.
2026-07-24
Article dans Nature Neuroscience
La nouvelle méthode de Microsoft transforme les IA cérébrales en boîte noire en théories lisibles
Le GCT traduit les modèles cérébraux basés sur les LLM, impossibles à interpréter, en phrases courtes comme 'préparation de nourriture' ou 'noms de lieux', puis utilise un LLM pour écrire des histoires qui testent causalement ces explications chez des sujets réels. La méthode promet de faire le pont entre l'IA prédictive et la théorie scientifique lisible par l'homme.
2026-07-05
contexte effectif, plafonds de sortie et l'impôt caché des longues fenêtres
Votre modèle d'IA prétend lire 1 million de tokens. Il ment. Voici les vrais calculs.
Les quatre LLM de pointe annoncent des contextes de 1M+ tokens, mais le rappel effectif, les limites de sortie et les coûts réels diffèrent considérablement. DeepSeek V4 Pro domine en matière de plafond de sortie et de coût, Gemini excelle sous 200K tokens, et Claude Opus remporte la palme du cache pour la revue de code interactive. Cette analyse détaille les chiffres d'avril 2026.
2026-06-30