Qwen3.7
时区漏洞让AI推理成本降低80%
Model Studio在夜间窗口期自动将Qwen3.7-Max和Qwen3.7-Plus API成本降低高达80%,该窗口期恰好覆盖美国和欧洲的工作时间。无需注册、无需修改代码,只要时机得当,任何人都能享受更便宜的推理。

阿里云的Model Studio推出了一项自动定价折扣,可在夜间窗口期内将Qwen3.7模型的API成本降低高达80%。但是?该折扣仅适用于北京时间(UTC+8)22:00至08:00之间。对于北美和欧洲的开发者来说,这个窗口覆盖了大部分工作日,使得折扣实际上成为任何关注此事的人默认价格。
交易内容:前沿AI最高省80%
无需注册、无需优惠券代码、无需修改代码。任何落在非高峰窗口内的Qwen3.7-Max或Qwen3.7-Plus API调用都会在计费层自动享受降价。折扣由请求接收的时间戳决定,而非响应发送时间。只要调用在北京时间08:00之前到达,就适用较低价格。
节省幅度很大。对于Qwen3.7-Max,标准输入每百万token $1.25,输出$3.75。非高峰时,分别降至$0.50和$1.50,两者均降低60%,根据比较,比某些高峰价格便宜高达80%。Qwen3.7-Plus从输入$0.32和输出$1.28降至$0.128和$0.512,同样降低60%。
| 模型 | 标准输入 | 标准输出 | 非高峰输入 | 非高峰输出 | 节省 |
|---|---|---|---|---|---|
| Qwen3.7-Max | $1.25 | $3.75 | $0.50 | $1.50 | 高达80% |
| Qwen3.7-Plus | $0.32 | $1.28 | $0.128 | $0.512 | 高达60% |
根据阿里云的定价页面,本次促销活动从2026年6月23日持续到2026年7月30日。无需解锁层级,也没有用量承诺。非高峰时段与高峰时段具有相同的延迟和服务等级协议,仅账单发生变化。
专为全球西方设计
非高峰窗口以北京时间为基准,映射到北美和欧洲的便利时间。对于美国西海岸(PDT,UTC-7),非高峰时间为07:00至17:00,覆盖整个工作日。东海岸(EDT,UTC-4)为10:00至20:00。中欧(CEST,UTC+2)为16:00至02:00,英国(BST,UTC+1)为15:00至01:00。阿里云公告中提供了完整的时区表。
| 地区 | 时区 | 当地非高峰时间 |
|---|---|---|
| 美国西海岸 | PDT (UTC-7) | 07:00, 17:00 |
| 美国东海岸 | EDT (UTC-4) | 10:00, 20:00 |
| 英国 | BST (UTC+1) | 15:00, 01:00 |
| 中欧 | CEST (UTC+2) | 16:00, 02:00 |
这种对齐意味着旧金山的团队在上午10点调用API与北京的团队在凌晨2点调用API获得相同的折扣率,而无需改变工作流程。对于评估AI基础设施成本的团队来说,这比那些全天保持高峰定价的竞争对手具有直接优势。
与其他前沿模型相比,成本优势更加明显。阿里云公布的数据显示,Qwen3.7-Max非高峰输入为每百万token $0.50,而OpenAI GPT-5.5为$5.00(贵10倍),Claude Sonnet 4.6为$3.00。输出方面差距更大:Qwen3.7-Max非高峰$1.50,GPT-5.5为$30.00(贵20倍),Claude Sonnet 4.6为$15.00。Qwen3.7-Plus非高峰输出$0.512甚至低于OpenAI的经济型层级GPT-5.4-mini的$4.50。
| 模型 | 输入(每百万token) | 输出(每百万token) |
|---|---|---|
| Qwen3.7-Max(非高峰) | $0.50 | $1.50 |
| Qwen3.7-Plus(非高峰) | $0.128 | $0.512 |
| OpenAI GPT-5.5 | $5.00 | $30.00 |
| OpenAI GPT-5.4-mini | $0.75 | $4.50 |
| Claude Sonnet 4.6 | $3.00 | $15.00 |
| Claude Haiku 4.5 | $1.00 | $5.00 |
| Google Gemini 3.1 Pro | $2.00 | $12.00 |
对于运行高吞吐量工作负载的团队,差异会叠加。根据阿里云的估算,在GPT-5.5上每月花费$1,000的工作负载,在Qwen3.7-Max非高峰下将运行$250,在Qwen3.7-Plus非高峰下则低于$65。
本次促销有到期日期。2026年7月30日之后,非高峰费率可能会恢复为标准定价。对于依赖计划推理的开发者来说,这个窗口提供了一个难得的机会,可以在工作时间内以通常成本的一小部分运行前沿模型。
- 来源 : The timezone loophole that cuts AI inference costs by 80% — 2026-05-20
每天早晨用 3 分钟掌握科技要闻
每个工作日一封邮件,只讲真正重要的 AI 与科技动态。