Model Studio
El precio fuera de horas punta de Qwen3.7 reduce los costes de API en un 80%, y los desarrolladores de EE. UU. obtienen las mejores horas
El precio fuera de horas punta de Qwen3.7 de Alibaba ofrece hasta un 80% de descuento en llamadas API durante horas que cubren el día laboral de EE. UU. y la UE. Aquí se compara con GPT-5.5, Claude y Gemini, y qué cargas de trabajo se benefician más.
Emmanuel Fabrice Omgbwa Yasse Asistido por IA
2026-05-20 · Última actualización: 2026-07-30 · 1 min de lectura

Alibaba's Model Studio acaba de hacer más barato ejecutar IA de vanguardia. A partir del 23 de junio, cada llamada API a Qwen3.7-Max y Qwen3.7-Plus entre las 22:00 y las 08:00 hora de Pekín obtiene un descuento automático de hasta el 80%. Sin registro, sin cupones, sin cambios de código. El mismo modelo, la misma latencia, el mismo SLA, solo una factura más baja.
Las cifras son contundentes. Con tarifas fuera de horas punta, Qwen3.7-Max cuesta $0.50 por millón de tokens de entrada y $1.50 por millón de tokens de salida. Esto es 10 veces más barato en entrada y 20 veces más barato en salida que los $5 y $30 estándar de GPT-5.5. Qwen3.7-Plus, la bestia de carga multimodal, baja a $0.128 de entrada y $0.512 de salida, aproximadamente una novena parte del precio de salida de GPT-5.4-mini. Incluso frente a rivales de gama baja como Claude Haiku 4.5 a $1 entrada / $5 salida, la brecha fuera de horas punta es amplia.
Pero la verdadera historia es el arbitraje de zona horaria. La noche de Pekín es el día de Norteamérica. Para los desarrolladores de la costa oeste de EE. UU., las horas de menor actividad van de 7:00 a 17:00 hora del Pacífico, esencialmente todo el día laboral. En la costa este, es de 10:00 a 20:00. Los equipos europeos obtienen la tarde y la noche. Así, un desarrollador que llama a la API a las 10 am desde San Francisco paga automáticamente un 80% menos, sin alterar una sola línea de código. Para los equipos de APAC, la ventana cae durante la noche, lo que aún se adapta a trabajos por lotes y pipelines programados.
Este modelo de precios se adapta naturalmente a cargas de trabajo asíncronas que no necesitan respuestas en tiempo real. Procesamiento de documentos, extracción de datos estructurados de facturas y contratos, generación de datos sintéticos para entrenar modelos más pequeños y agentes de revisión de código a gran escala que analizan solicitudes de extracción durante la noche, todos se benefician de poner en cola trabajos para ejecutarlos durante las horas de menor actividad. Un pipeline por lotes que procesa millones de tokens al día puede fácilmente ver las facturas mensuales caer de $2,000 a menos de $250 en Qwen3.7-Max, o menos de $65 en Qwen3.7-Plus.
El momento es estratégico. Se espera que DeepSeek lance DeepSeek V4 en julio con precios similares fuera de horas punta, y la tendencia entre los laboratorios de IA chinos es clara: reducir los costes de inferencia para ganar adopción. Microsoft ya habría probado un modelo chino para Copilot para reducir costes en 600 millones de dólares, según The Information. El movimiento de Alibaba supera no solo a los laboratorios de frontera estadounidenses sino también a competidores como DeepSeek, cuyo precio fuera de horas punta alcanza $1.74 por millón de tokens de salida, aún más que el de Qwen3.7-Max fuera de horas punta.
¿El inconveniente? La promoción solo se extiende hasta el 30 de julio de 2026. Después de eso, los precios probablemente volverán a las tarifas estándar. Por ahora, es una oferta limpia: el mismo SLA, sin reservas de capacidad y sin inscripción. Los equipos que construyen flujos de trabajo de agentes, inferencia por lotes o pipelines de datos deberían probar dentro de esta ventana. La ventaja de coste es real, pero también temporal.
- Fuente : Qwen3.7's off-peak pricing cuts API costs by 80%, and US developers get the best hours — 2026-05-20
Lo esencial de la tecnología en 3 minutos cada mañana
Un correo, cada día laborable, con lo que realmente importa en IA y tecnología.