SevenTnewS

AI 编程

OpenCode 新增 Gemini 3.6 Flash 和精简版,成本降低 80%

OpenCode 新增 Gemini 3.6 Flash 和 3.5 Flash Lite,支持 1M 上下文。精简版模型比 3.5 Flash 便宜 80%。

Emmanuel Fabrice Omgbwa Yasse AI 辅助

2026-07-21 · 阅读需 3 分钟

OpenCode 新增 Gemini 3.6 Flash 和精简版,成本降低 80%
来源 : OpenCode on X

OpenCode,一款将模型作为可互换组件提供的开源 AI 代码编辑器,于7月21日新增了两个 Gemini 变体:Gemini 3.6 Flash 和 3.5 Flash Lite。两者均配备 100 万 token 的上下文窗口,与 Google 当前 API 提供的上限一致。

价格差距是重点。根据 OpenCode 在 X 上的公告,Gemini 3.5 Flash Lite 在输出 token 上比标准版 3.5 Flash 便宜 80%。这使得精简版大致与最小的 Gemini Nano 类模型同样便宜,但保留了完整的 Flash 注意力架构,这可能是 Google 通过减少专家参数数量或输出 logits 精度而做出的权衡。具体机制未披露。

图表:Gemini 模型定价比较
根据 OpenCode 公告,新 Gemini 变体相对于 Gemini 3.5 Flash 的成本降低情况。

与此同时,Gemini 3.6 Flash 的输出成本比其前代 3.5 Flash 便宜 17%。版本从 3.5 跃升至 3.6 引起了关注,因为 Google 从未发布过 3.5 Pro,预期的 Gemini 3.x 系列中档主力型号仍然缺失。本月早些时候,一个追踪未发布 Google 模型的 X 账号泄露称,内部正在测试一个 3.6 Flash 模型,但该帖子未提及 Pro 变体。新的 OpenCode 集成证实 3.6 Flash 是真实的,但未说明 3.6 Pro 是否存在或何时可能推出。

OpenCode 是一个命令行和 IDE 辅助工具,允许开发者从托管模型列表(包括 OpenAI、Anthropic、Google 以及通过其自身基础设施提供的开源权重模型)中选择,并可在每个会话中切换。新增 Gemini 3.6 Flash 和 3.5 Flash Lite 扩展了该菜单的低成本端。对于运行长时间重构会话的开发者而言,3.5 Flash 与新的精简版之间的差异是显著的:输出成本降低 80%,意味着相同预算下大约能获得五倍的补全次数。

100 万上下文长度对代码工作意义重大。这样一个大小(100 万 token)的上下文窗口可以容纳整个中等规模代码库,即几百个文件、每个几百行,无需分块。这使得它适用于跨文件重构或针对整个项目树进行 linting 等任务,尽管在 100 万 token 下实际吞吐量在很大程度上取决于 Google 如何调度注意力。Flash 模型使用混合专家架构和稀疏注意力,在长上下文中延迟低于密集模型,但可能在远离提示起始的尾部 token 上产生可变质量。

Google 和 OpenCode 均未发布基准测试,比较精简版与标准 3.5 Flash 在代码任务上的输出质量。80% 的降价意味着某些性能下降,无论是准确性、指令遵循还是多语言支持,但如果没有独立评估,差距只能猜测。采用 3.5 Flash Lite 用于生产工作流的开发者在依赖它之前,应运行自己的回归测试。

OpenCode 的公告发布之际,AI 编程工具领域正在升温。Cursor、GitHub Copilot 和 Codeium 在过去一个季度都增加了更便宜的模型层级,且多个开源编辑器已开始提供按需模型选择。拥有 1M 上下文且深度折扣定价的模型,可能推动更多开发团队将代码级 AI 作为默认选项而非高级附加组件。

每天早晨用 3 分钟掌握科技要闻

每个工作日一封邮件,只讲真正重要的 AI 与科技动态。