SevenTnewS

Qwen3.7

El vacío de las zonas horarias que reduce los costos de inferencia de IA en un 80%

Model Studio reduce automáticamente los costos de API de Qwen3.7-Max y Qwen3.7-Plus hasta en un 80% durante una ventana nocturna que coincide con las horas laborales en Estados Unidos y Europa. Sin registro, sin cambios de código, solo inferencia más barata para cualquiera que ajuste sus llamadas correctamente.

Emmanuel Fabrice Omgbwa Yasse Asistido por IA

2026-05-20 · Última actualización: 2026-07-30 · 2 min de lectura

El vacío de las zonas horarias que reduce los costos de inferencia de IA en un 80%

Model Studio de Alibaba Cloud ha introducido un descuento automático de precios que puede reducir los costos de API de sus modelos Qwen3.7 hasta en un 80% durante una ventana nocturna. ¿El truco? Solo se aplica entre las 22:00 y las 08:00 hora de Pekín (UTC+8). Para los desarrolladores en América del Norte y Europa, esa ventana cubre la mayor parte del día laboral, haciendo que el descuento sea efectivamente el precio predeterminado para cualquiera que preste atención.

La Oferta: Hasta un 80% de Descuento en IA de Frontera

No se requiere registro, ni códigos de cupón, ni cambios de código. Cualquier llamada a la API de Qwen3.7-Max o Qwen3.7-Plus que llegue dentro de la ventana de baja demanda recibe la tarifa reducida automáticamente a nivel de facturación. El descuento se determina por la marca de tiempo cuando se recibe la solicitud, no cuando se envía la respuesta. Mientras la llamada llegue antes de las 08:00 hora de Pekín, se aplica el precio más bajo.

Los ahorros son considerables. Para Qwen3.7-Max, el costo estándar de entrada es de $1.25 por millón de tokens y el de salida de $3.75. En horas de baja demanda, bajan a $0.50 y $1.50 respectivamente, una reducción del 60% en ambos, y hasta un 80% más barato que algunas tarifas pico dependiendo de la comparación. Qwen3.7-Plus pasa de $0.32 de entrada y $1.28 de salida a $0.128 y $0.512, también un recorte del 60%.

ModeloEntrada EstándarSalida EstándarEntrada de Baja DemandaSalida de Baja DemandaAhorro
Qwen3.7-Max$1.25$3.75$0.50$1.50Hasta un 80%
Qwen3.7-Plus$0.32$1.28$0.128$0.512Hasta un 60%

La promoción se ejecuta desde el 23 de junio de 2026 hasta el 30 de julio de 2026, según la página de precios de Alibaba Cloud. No hay niveles que desbloquear ni compromisos de volumen. La misma latencia y SLA se aplican durante las horas de baja demanda que durante las horas pico, solo cambia la factura.

Diseñado para el Occidente Global

La ventana de baja demanda, definida por la hora de Pekín, se corresponde con horas convenientes en América del Norte y Europa. Para la Costa Oeste de EE.UU. (PDT, UTC-7), la baja demanda va de 07:00 a 17:00, todo el día laboral. Para la Costa Este (EDT, UTC-4), es de 10:00 a 20:00. Europa Central (CEST, UTC+2) ve de 16:00 a 02:00, y el Reino Unido (BST, UTC+1) de 15:00 a 01:00. Una tabla completa de zonas horarias está disponible en el anuncio de Alibaba Cloud.

RegiónZona HorariaHora Local de Baja Demanda
Costa Oeste de EE.UU.PDT (UTC-7)07:00, 17:00
Costa Este de EE.UU.EDT (UTC-4)10:00, 20:00
Reino UnidoBST (UTC+1)15:00, 01:00
Europa CentralCEST (UTC+2)16:00, 02:00

Esta alineación significa que un equipo en San Francisco que llame a la API a las 10 a.m. obtiene la misma tarifa con descuento que un equipo en Pekín que llame a las 2 a.m., sin cambiar su flujo de trabajo. Para los equipos que evalúan los costos de infraestructura de IA, esto crea una ventaja directa sobre los competidores cuyos precios pico se aplican durante todo el día.

La ventaja de costos se vuelve notable cuando se compara con otros modelos de frontera. Las cifras publicadas por Alibaba Cloud muestran que la entrada de baja demanda de Qwen3.7-Max a $0.50 por millón de tokens, en comparación con OpenAI GPT-5.5 a $5.00 (10 veces más) y Claude Sonnet 4.6 a $3.00. En la salida, la brecha se amplía aún más: Qwen3.7-Max en baja demanda a $1.50 frente a GPT-5.5 a $30.00 (20 veces más) y Claude Sonnet 4.6 a $15.00. La salida de baja demanda de Qwen3.7-Plus a $0.512 supera incluso el nivel económico de OpenAI, GPT-5.4-mini, a $4.50.

ModeloEntrada (por 1M de tokens)Salida (por 1M de tokens)
Qwen3.7-Max (Baja Demanda)$0.50$1.50
Qwen3.7-Plus (Baja Demanda)$0.128$0.512
OpenAI GPT-5.5$5.00$30.00
OpenAI GPT-5.4-mini$0.75$4.50
Claude Sonnet 4.6$3.00$15.00
Claude Haiku 4.5$1.00$5.00
Google Gemini 3.1 Pro$2.00$12.00

Para los equipos que ejecutan cargas de trabajo de alto rendimiento, la diferencia se acumula. Una carga de trabajo que cuesta $1,000 por mes en GPT-5.5 costaría $250 en Qwen3.7-Max en baja demanda, o menos de $65 en Qwen3.7-Plus en baja demanda, según las estimaciones de Alibaba Cloud.

La promoción tiene una fecha de vencimiento. Después del 30 de julio de 2026, las tarifas de baja demanda pueden revertir a los precios estándar. Para los desarrolladores que dependen de la inferencia programada, esta ventana ofrece una oportunidad poco común de ejecutar modelos de frontera a fracciones del costo habitual durante horas laborales, nada menos.

Lo esencial de la tecnología en 3 minutos cada mañana

Un correo, cada día laborable, con lo que realmente importa en IA y tecnología.