AI模型
谷歌发布Gemini 3.6 Flash,同时推出精简版模型与网络安全变体
谷歌最新的Gemini模型面向生产级AI代理,提供更好的令牌效率和更低的延迟。3.6 Flash相比前代模型令牌使用量减少17%。3.5 Flash-Lite每秒可输出350个令牌。一款专注于网络安全的变体仅面向经过审查的合作伙伴。

谷歌于7月21日扩展了Gemini产品线,推出三款针对生产级AI堆栈不同环节的模型:一款更便宜、更高效的主力模型,一款高速精简模型,以及一款锁定政府和合作伙伴使用的网络安全变体。
最重要的发布是Gemini 3.6 Flash,谷歌将其定位为3.5 Flash在编程、知识工作和多模态任务方面的直接升级。根据独立跟踪模型性能的人工智能分析指数(Artificial Analysis Index),3.6 Flash比3.5 Flash少使用17%的输出令牌。在Datacurve的DeepSWE基准测试中,谷歌称在某些场景下减少幅度达到65%。该模型定价为每百万输入令牌1.50美元,每百万输出令牌7.50美元,相比3.5 Flash有所降低。

谷歌报告了多个类别的基准性能提升。在DeepSWE上,该模型得分为49%,而3.5 Flash为37%,意味着更少不必要的代码编辑和更短的执行循环。在衡量机器学习研究任务的MLE Bench上,3.6 Flash得分为63.9%,而3.5 Flash为49.7%。计算机使用能力在OSWorld-Verified上提升(83.0%对比78.4%)。在知识工作基准GDPval-AA v2上,该模型得分为1421,而3.5 Flash为1349。
第二个发布的是Gemini 3.5 Flash-Lite,专为高吞吐量和低延迟而设计。谷歌称其每秒可输出350个令牌,使其成为3.5系列中速度最快的模型。定价为每百万输入令牌0.30美元,每百万输出令牌2.50美元,低于3.1 Flash-Lite,并在代理和编码评估中优于前代模型。在Terminal-Bench 2.1上,该模型得分为54%,而3.1 Flash-Lite为31%。在SWE-Bench Pro和OSWorld-Verified上,它超过了旧版Gemini 3 Flash:分别为54.2%对比49.6%和74.0%对比65.1%。
第三款模型Gemini 3.5 Flash Cyber采取了不同的市场策略。它基于3.5 Flash构建,并针对安全漏洞检测和修补进行了微调,并非通用发布的模型。谷歌表示,该模型将仅通过公司代码安全代理CodeMender向政府和受信任的合作伙伴提供。在CodeMender中,多个3.5 Flash Cyber代理协同工作,生成单一漏洞报告。谷歌声称它在CyberGym基准上达到了竞争性的前沿性能,但未公布具体分数。
谷歌在公告中写道:“考虑到这项技术的双重用途性质,我们采取了审慎的方法来部署3.5 Flash Cyber。”这个有限访问的试点项目旨在为一线防御者提供优势,同时限制更广泛的滥用。
这三款模型的发布正值谷歌持续填补其Gemini命名体系中的空白。该公司从未推出预期的中端主力模型Gemini 3.5 Pro。在今天的公告中,谷歌表示Gemini 3.5 Pro“目前正与合作伙伴测试”,并将在准备就绪时广泛提供。该公司还透露,已启动了“迄今为止最雄心勃勃的预训练运行,用于Gemini 4。”
3.6 Flash和3.5 Flash-Lite自7月21日起可通过Gemini API在Google AI Studio和Android Studio中使用。企业用户可通过Gemini企业代理平台访问。3.6 Flash也出现在Gemini应用中。谷歌表示3.5 Flash-Lite也正在谷歌搜索中推出。
每天早晨用 3 分钟掌握科技要闻
每个工作日一封邮件,只讲真正重要的 AI 与科技动态。