SevenTnewS

LLM

7 published articles

Google DeepMindFeatured3 min read

Le cheval de trait de Google, plus étoffé dans la mise à jour 3.7

Gemini 3.7 Flash divise son prix par deux, puis le justifie

Le Gemini 3.7 Flash de Google sort à la moitié du prix de lancement du 3.6 Flash, tout en revendiquant des gains sur les benchmarks de codage, de développement web et de travail cognitif. La sortie intervient trois semaines après le Flash précédent et s'accompagne d'un nouvel argument prix-performance pour les développeurs d'agents.

2026-08-16

Qwen / Alibaba4 min read

Économie de l'IA

Le plan à 18 $ d'Alibaba fait tourner Qwen et DeepSeek dans Claude Code

Le Token Plan Individual d'Alibaba Cloud regroupe Qwen et des modèles tiers tels que DeepSeek dans un pool de crédits unique, à partir de 6 $ par mois, utilisable dans Claude Code et Cursor. L'entreprise revendique environ 40 % d'économies par rapport au paiement à l'utilisation, mais le plan ne fonctionne qu'à partir de Singapour et uniquement dans les outils approuvés.

2026-08-14

Qwen / Alibaba2 min read

Qwen / Alibaba

Qwen3-2507 arrive avec un modèle de réflexion et un modèle d'instructions, la séparation revient à la mode

L'équipe Qwen d'Alibaba a publié Qwen3-2507, divisant sa gamme de modèles en variantes dédiées aux instructions et à la réflexion. La mise à jour apporte des améliorations substantielles en raisonnement, suivi d'instructions, et support de contexte 256K, extensible à 1 million de tokens.

2026-07-29

IA1 min read

Modèles IA

OpenAI publie une mise à jour mineure de GPT pour la gestion des longs contextes

OpenAI a déployé aujourd'hui une mise à jour mineure de GPT, portant sur la gestion des longs contextes. Ce changement vise à aider le modèle à traiter les entrées étendues plus efficacement.

2026-07-28

LLM & ModèlesFeatured3 min read

Modèles d'IA

Claude Opus 5 égale presque Fable 5 sur tous les benchmarks, avec la cybersécurité comme angle mort délibéré

Claude Opus 5 est lancé avec des scores proches de Fable sur les benchmarks de codage et de connaissances à moitié prix. Mais ses capacités délibérément affaiblies en cybersécurité créent un compromis clair pour les développeurs.

2026-07-24

IA4 min read

Article dans Nature Neuroscience

La nouvelle méthode de Microsoft transforme les IA cérébrales en boîte noire en théories lisibles

Le GCT traduit les modèles cérébraux basés sur les LLM, impossibles à interpréter, en phrases courtes comme 'préparation de nourriture' ou 'noms de lieux', puis utilise un LLM pour écrire des histoires qui testent causalement ces explications chez des sujets réels. La méthode promet de faire le pont entre l'IA prédictive et la théorie scientifique lisible par l'homme.

2026-07-05

LLM & Modèles3 min read

contexte effectif, plafonds de sortie et l'impôt caché des longues fenêtres

Votre modèle d'IA prétend lire 1 million de tokens. Il ment. Voici les vrais calculs.

Les quatre LLM de pointe annoncent des contextes de 1M+ tokens, mais le rappel effectif, les limites de sortie et les coûts réels diffèrent considérablement. DeepSeek V4 Pro domine en matière de plafond de sortie et de coût, Gemini excelle sous 200K tokens, et Claude Opus remporte la palme du cache pour la revue de code interactive. Cette analyse détaille les chiffres d'avril 2026.

2026-06-30