Codage IA
OpenCode ajoute Gemini 3.6 Flash et un niveau Lite qui réduit les coûts de 80 %
OpenCode ajoute Gemini 3.6 Flash et 3.5 Flash Lite avec 1M de contexte. Le modèle Lite est 80 % moins cher que 3.5 Flash.
Emmanuel Fabrice Omgbwa Yasse Assisté par IA
2026-07-21 · 3 min de lecture

OpenCode, l'éditeur de code IA open-source qui propose les modèles comme des composants interchangeables, a ajouté deux nouvelles variantes Gemini le 21 juillet : Gemini 3.6 Flash et 3.5 Flash Lite. Les deux offrent une fenêtre de contexte de 1 million de tokens, égalant le plafond de l'offre actuelle de Google.
L'écart de prix est le point marquant. Gemini 3.5 Flash Lite sous-cote le 3.5 Flash standard de 80 % sur les tokens de sortie, selon l'annonce d'OpenCode sur X. Cela rend le niveau Lite à peu près aussi bon marché que les plus petits modèles Gemini Nano, mais avec l'architecture d'attention Flash complète, un compromis que Google a probablement fait en réduisant le nombre de paramètres experts ou la précision des logits de sortie. Le mécanisme exact n'est pas divulgué.

Gemini 3.6 Flash, quant à lui, est 17 % moins cher en sortie que son prédécesseur, 3.5 Flash. Le saut de version de 3.5 à 3.6 a attiré l'attention car Google n'a jamais commercialisé de 3.5 Pro, le cheval de bataille milieu de gamme prévu de la gamme Gemini 3.x reste absent. Une fuite plus tôt ce mois-ci provenant d'un compte X suivant les modèles Google non publiés suggérait qu'un modèle 3.6 flash était testé en interne, mais le post ne mentionnait pas de variante Pro. La nouvelle intégration OpenCode confirme que 3.6 Flash est réel, mais ne dit rien sur l'existence d'un 3.6 Pro ou sur sa date d'arrivée.
OpenCode est un outil en ligne de commande et adjacent à l'IDE qui permet aux développeurs de choisir parmi une liste de modèles hébergés, OpenAI, Anthropic, Google et des modèles à poids ouverts servis via sa propre infrastructure, et de basculer entre eux par session. L'ajout de Gemini 3.6 Flash et 3.5 Flash Lite élargit l'extrémité bas coût de ce menu. Pour un développeur menant une longue session de refactorisation, la différence entre 3.5 Flash et la nouvelle variante Lite est substantielle : une réduction de 80 % du coût de sortie signifie environ cinq fois plus de complétions pour le même budget.
La longueur de contexte de 1M est significative pour le travail de code. Une fenêtre de contexte de cette taille peut contenir une base de code modérée entière, quelques centaines de fichiers, chacun de quelques centaines de lignes, sans découpage. Cela la rend viable pour des tâches comme la refactorisation cross-fichier ou le linting sur un arbre de projet complet, bien que le débit pratique à 1M de tokens dépende fortement de la façon dont Google planifie l'attention. Les modèles Flash utilisent une architecture de mixture-of-experts avec attention sparse, ce qui maintient la latence plus basse que les modèles denses sur des contextes longs, mais peut produire une qualité variable sur les tokens à longue traîne loin du début de la requête.
Ni Google ni OpenCode n'ont publié de benchmarks comparant la qualité de sortie du niveau Lite par rapport au 3.5 Flash standard sur des tâches de code. La réduction de prix de 80 % implique une certaine dégradation, que ce soit en précision, en suivi d'instructions, ou en support multilingue, mais sans évaluations indépendantes, l'écart reste une supposition. Les développeurs adoptant 3.5 Flash Lite pour des flux de production voudront exécuter leurs propres tests de régression avant de s'y fier.
L'annonce d'OpenCode intervient alors que le secteur des outils de codage IA s'intensifie. Cursor, GitHub Copilot et Codeium ont tous ajouté des niveaux de modèles moins chers ce trimestre, et plusieurs éditeurs open-source ont commencé à offrir une sélection à la carte de modèles. La disponibilité d'un modèle à 1M de contexte à un prix fortement réduit pourrait pousser davantage d'équipes de développement à adopter l'IA au niveau du code comme un outil par défaut plutôt qu'un complément premium.
- Source : OpenCode on X
L'essentiel de la tech en 3 minutes chaque matin
Un email, chaque jour ouvré, avec ce qui compte vraiment en IA et en tech.