El caballo de batalla de Google, más grande en la actualización 3.7
Gemini 3.7 Flash reduce su precio a la mitad y luego lo justifica
El Gemini 3.7 Flash de Google llega a la mitad del precio introductorio del 3.6 Flash mientras afirma mejoras en los puntos de referencia de programación, desarrollo web y trabajo del conocimiento. El lanzamiento se produce tres semanas después del Flash anterior y trae consigo un nuevo argumento de relación precio-rendimiento para desarrolladores de agentes.
Emmanuel Fabrice Omgbwa Yasse Asistido por IA
2026-08-16 · 3 min de lectura

Google presentó Gemini 3.7 Flash el 13 de agosto de 2026, y esta actualización comienza con algo que los lanzamientos de Flash rara vez lideran: un recorte de precio. El modelo cuesta $0.75 por millón de tokens de entrada y $3.75 por millón de tokens de salida a un precio de introducción que estará vigente hasta fin de año, la mitad del precio original de Gemini 3.6 Flash, que se lanzó tres semanas antes. Google posiciona a 3.7 Flash como su caballo de batalla para programación y agentes.
El momento no es casual. Google ha mantenido un ritmo rápido en toda la línea Gemini este año, con la generación 3.6 Flash llegando en julio junto a un Flash-Lite más ligero y rápido. El rápido cambio a 3.7 parece menos un descubrimiento y más un hábito. Google atribuye la velocidad a los comentarios de los desarrolladores y a mejoras algorítmicas que, según afirma, trasladará a futuros modelos. El ritmo ya había llamado la atención: una filtración sugería que Google estaba probando una versión de 3.6 Flash mientras el esperado modelo pro seguía ausente, según el informe de la filtración anterior.
Benchmarks y un recorte de precio del 50%
La historia más nítida está en los números que Google publicó frente al Flash anterior. La compañía reporta 43.6% en FrontierCode 1.1 Main, frente al 34.4%, y 65.3% en DeepSWE v1.1 contra 49.0%, una brecha que presenta como una mejor precisión de código en el primer intento y un resultado más listo para producción. El patrón se mantiene más allá de la programación: GPA.pdf pasa de 22.0% a 34.0% en trabajo de conocimiento con muchos documentos, AutomationBench de 17.0% a 30.4% en flujos de trabajo empresariales del mundo real, y WebDev Arena sube de 1538 a 1588 Elo.
| Benchmark | 3.7 Flash | 3.6 Flash |
|---|---|---|
| FrontierCode 1.1 Main | 43.6% | 34.4% |
| DeepSWE v1.1 | 65.3% | 49.0% |
| GDP.pdf | 34.0% | 22.0% |
| AutomationBench | 30.4% | 17.0% |
| WebDev Arena (Elo) | 1588 | 1538 |
Son cifras de Google, y se aplican las advertencias habituales sobre los benchmarks de la propia compañía. Vistos como conjunto, sin embargo, cuentan una historia específica: la compañía afirma mejoras consistentes en agentes en programación, desarrollo web y documentos, y luego cobra mucho menos por token. Un poco mejor en un benchmark, aproximadamente el doble en otro, a mitad de precio. Esa combinación es rara en un mercado donde lo barato suele significar lento, ligero o impreciso. También es un mercado donde las afirmaciones rivales sobre benchmarks cambian rápido: el Grok 4.6 de xAI empató con el GPT-5.6 Sol en 61 en un índice compuesto antes de que sus puntuaciones por componente se dividieran, según el desglose de puntuaciones.
Lo que el precio indica sobre la economía de los agentes
La palabra de Google para 3.7 Flash es deliberada. "Caballo de batalla" es una apuesta por cargas de trabajo de agentes de alto volumen, del tipo donde el costo por millón de tokens se acumula en bucles que se ejecutan repetidamente. La compañía se apoya en ese marco: el modelo está diseñado para planificación de múltiples pasos y llamadas a herramientas, y Google dice que sigue las instrucciones con mayor fidelidad, lo que se traduce en menos reintentos y menos supervisión manual en los flujos de trabajo de ingeniería. La propuesta no es exclusiva de Google. Meta apuntó su Muse Glimmer de 30B directamente a las cargas de trabajo de agentes y lo lanzó para ejecutarse en menos de 20GB, según el artículo sobre Muse Glimmer.
El marco de precio de introducción es lo que hace que el lanzamiento parezca estratégico. Un recorte permanente se leería como una historia de costos; uno temporal planta una bandera. Esto, dice Google, es lo que se necesita para ganarse a los desarrolladores para su stack de agentes, y la página de benchmarks es parte de esa propuesta. La mitad de descuento es agresiva incluso en un año de precios agresivos por token: el GLM-5.2 de Zhipu se volvió viral a $0.07 por millón de tokens, un recorte del 95% que los comentaristas llamaron "casi gratis", y una respuesta afirmaba que el precio ya se había multiplicado por 10, según el drama de precios del GLM-5.2. En ese punto, las puntuaciones importan menos que el precio y el ritmo. Si esto se vuelve rutina, Gemini 3.7 Flash es menos un anuncio de producto que una declaración sobre con qué frecuencia llegará su reemplazo.
- Fuente : Introducing Gemini 3.7 Flash
Lo esencial de la tecnología en 3 minutos cada mañana
Un correo, cada día laborable, con lo que realmente importa en IA y tecnología.