Modèles d'IA
Google publie Gemini 3.6 Flash, un modèle léger et une variante cybersécurité
Les nouveaux modèles Gemini de Google ciblent les agents d'IA de production avec une meilleure efficacité des tokens et une latence réduite. Le 3.6 Flash réduit l'utilisation de tokens de 17 % par rapport à son prédécesseur. Le 3.5 Flash-Lite atteint 350 tokens de sortie par seconde. Une variante axée sur la cybersécurité est réservée aux partenaires vérifiés.
Emmanuel Fabrice Omgbwa Yasse Assisté par IA
2026-07-22 · 3 min de lecture

Google a enrichi sa gamme Gemini le 21 juillet avec trois modèles destinés à différents segments de la pile d'IA de production : un modèle plus économique et efficace, un modèle léger à haute vitesse, et une variante cybersécurité réservée aux gouvernements et partenaires.
La sortie phare est Gemini 3.6 Flash, que Google positionne comme une mise à niveau directe du 3.5 Flash pour le codage, le travail de connaissances et les tâches multimodales. Selon l'Artificial Analysis Index, qui suit indépendamment les performances des modèles, le 3.6 Flash utilise 17 % de tokens de sortie en moins que le 3.5 Flash. Sur le benchmark DeepSWE de Datacurve, Google indique que la réduction atteint 65 % dans certains scénarios. Le modèle est facturé à 1,50 $ par million de tokens d'entrée et 7,50 $ par million de tokens de sortie, soit une baisse par rapport au prix du 3.5 Flash.

Google rapporte des gains de performance dans plusieurs catégories. Sur DeepSWE, le modèle a obtenu 49 % contre 37 % pour le 3.5 Flash, ce qui signifie moins d'éditions de code indésirables et des boucles d'exécution plus courtes. Sur MLE Bench, qui mesure les tâches de recherche en apprentissage automatique, le 3.6 Flash a obtenu 63,9 % contre 49,7 %. Les capacités d'utilisation informatique se sont améliorées sur OSWorld-Verified (83,0 % contre 78,4 %). Sur le benchmark de travail de connaissances GDPval-AA v2, le modèle a obtenu 1421 contre 1349.
La deuxième sortie, Gemini 3.5 Flash-Lite, est conçue pour un débit élevé et une faible latence. Google indique qu'il fonctionne à 350 tokens de sortie par seconde, ce qui en fait le modèle le plus rapide de la famille 3.5. Facturé à 0,30 $ par million de tokens d'entrée et 2,50 $ par million de tokens de sortie, il sous-cote le 3.1 Flash-Lite et surpasse son prédécesseur dans les évaluations d'agents et de codage. Sur Terminal-Bench 2.1, le modèle a obtenu 54 % contre 31 % pour le 3.1 Flash-Lite. Sur SWE-Bench Pro et OSWorld-Verified, il a battu l'ancien Gemini 3 Flash : 54,2 % contre 49,6 % et 74,0 % contre 65,1 %, respectivement.
Le troisième modèle, Gemini 3.5 Flash Cyber, emprunte une voie différente pour accéder au marché. Construit sur la base du 3.5 Flash et optimisé pour la détection et la correction des vulnérabilités de sécurité, il ne s'agit pas d'une version grand public. Google indique qu'il sera disponible uniquement pour les gouvernements et partenaires de confiance via CodeMender, l'agent de sécurité du code de l'entreprise. Au sein de CodeMender, plusieurs agents 3.5 Flash Cyber travaillent ensemble pour produire un seul rapport de vulnérabilité. Google affirme qu'il atteint des performances de pointe compétitives sur le benchmark CyberGym, bien qu'il n'ait pas publié de score spécifique.
"Compte tenu de la nature à double usage de cette technologie, nous avons adopté une approche intentionnelle pour déployer le 3.5 Flash Cyber", a écrit Google dans l'annonce. Le programme pilote à accès limité vise à donner un avantage aux défenseurs de première ligne tout en limitant les abus plus larges.
Les trois modèles arrivent alors que Google continue de combler les lacunes de sa nomenclature Gemini. L'entreprise n'a jamais sorti de 3.5 Pro, qui était attendu comme un modèle intermédiaire performant. Dans l'annonce d'aujourd'hui, Google a déclaré que Gemini 3.5 Pro est "actuellement en test avec des partenaires" et sera largement disponible lorsqu'il sera prêt. L'entreprise a également révélé avoir commencé "notre pré-entraînement le plus ambitieux à ce jour, pour Gemini 4."
Le 3.6 Flash et le 3.5 Flash-Lite sont disponibles à partir du 21 juillet dans l'API Gemini via Google AI Studio et Android Studio. Les utilisateurs professionnels peuvent y accéder via la plateforme Gemini Enterprise Agent. Le 3.6 Flash apparaît également dans l'application Gemini. Google a déclaré que le 3.5 Flash-Lite est également déployé dans Google Search.
L'essentiel de la tech en 3 minutes chaque matin
Un email, chaque jour ouvré, avec ce qui compte vraiment en IA et en tech.