Codificación IA
OpenCode agrega Gemini 3.6 Flash y un nivel ligero que reduce costos en un 80%
OpenCode agrega Gemini 3.6 Flash y 3.5 Flash Lite con 1M de contexto. El modelo ligero es un 80% más barato que 3.5 Flash.
Emmanuel Fabrice Omgbwa Yasse Asistido por IA
2026-07-21 · 3 min de lectura

OpenCode, el editor de código de IA de código abierto que envía modelos como componentes intercambiables, agregó dos nuevas variantes de Gemini el 21 de julio: Gemini 3.6 Flash y 3.5 Flash Lite. Ambas vienen con 1 millón de tokens de ventana de contexto, igualando el límite de la oferta actual de API de Google.
La brecha de precios es lo más destacado. Gemini 3.5 Flash Lite reduce el costo de los tokens de salida en un 80% en comparación con el estándar 3.5 Flash, según el anuncio de OpenCode en X. Esto hace que el nivel ligero sea aproximadamente tan barato como los modelos más pequeños de la clase Gemini Nano, pero con la arquitectura de atención Flash completa, un compromiso que Google probablemente hizo reduciendo el número de parámetros expertos o la precisión de los logits de salida. El mecanismo exacto no se revela.

Gemini 3.6 Flash, mientras tanto, es un 17% más barato en salida que su predecesor, 3.5 Flash. El salto de versión de 3.5 a 3.6 ha llamado la atención porque Google nunca lanzó un 3.5 Pro, el esperado caballo de batalla de gama media de la línea Gemini 3.x sigue ausente. Una filtración a principios de este mes desde una cuenta de X que rastrea modelos no lanzados de Google sugirió que se estaba probando internamente un modelo 3.6 flash, pero la publicación no mencionaba una variante Pro. La nueva integración de OpenCode confirma que 3.6 Flash es real, pero no dice nada sobre si existe un 3.6 Pro o cuándo podría llegar.
OpenCode es una herramienta de línea de comandos y adyacente a IDE que permite a los desarrolladores elegir entre una lista de modelos alojados, OpenAI, Anthropic, Google y modelos de peso abierto servidos a través de su propia infraestructura, y cambiar entre ellos por sesión. Agregar Gemini 3.6 Flash y 3.5 Flash Lite expande el extremo de bajo costo de ese menú. Para un desarrollador que realiza una sesión de refactorización larga, la diferencia entre 3.5 Flash y la nueva variante ligera es sustancial: una reducción del 80% en el costo de salida significa aproximadamente cinco veces el número de completaciones por el mismo presupuesto.
La longitud de contexto de 1M es significativa para el trabajo de código. Una ventana de contexto de ese tamaño puede contener un código base moderado completo, unos pocos cientos de archivos, cada uno de unos cientos de líneas, sin fragmentación. Esto lo hace viable para tareas como refactorización entre archivos o linting contra un árbol de proyecto completo, aunque el rendimiento práctico a 1M de tokens depende en gran medida de cómo Google programa la atención. Los modelos Flash utilizan una arquitectura de mezcla de expertos con atención dispersa, lo que mantiene una latencia más baja que los modelos densos en contextos largos, pero puede producir una calidad variable en tokens de cola larga lejos del inicio del prompt.
Ni Google ni OpenCode han publicado puntos de referencia que comparen la calidad de salida del nivel ligero contra el estándar 3.5 Flash en tareas de código. El recorte de precio del 80% implica cierta degradación, ya sea en precisión, seguimiento de instrucciones o soporte multilingüe, pero sin evaluaciones independientes, la brecha es una suposición. Los desarrolladores que adopten 3.5 Flash Lite para flujos de trabajo de producción querrán ejecutar sus propias pruebas de regresión antes de confiar en él.
El anuncio de OpenCode llega en un momento en que el espacio de herramientas de codificación de IA se calienta. Cursor, GitHub Copilot y Codeium han agregado niveles de modelos más baratos en el último trimestre, y varios editores de código abierto han comenzado a ofrecer selección de modelos a la carta. La disponibilidad de un modelo de contexto de 1M a precios con grandes descuentos podría empujar a más equipos de desarrollo a adoptar IA a nivel de código como un valor predeterminado en lugar de un complemento premium.
- Fuente : OpenCode on X
Lo esencial de la tecnología en 3 minutos cada mañana
Un correo, cada día laborable, con lo que realmente importa en IA y tecnología.