生态布局
Grok 4.5 最大的新闻或许在于它如何被构建
xAI 的 Grok 4.5 现已登陆 grok.com、X、iOS、Android,以及 Microsoft 365、Google Workspace、GitHub Copilot 和 Cursor。该模型采用智能体构建的训练数据,在 SWE Marathon 基准测试中领先,并引入了语音升级。

今早,xAI 将 Grok 4.5 推送到了几乎每一个开发者或专业人士接触的界面:grok.com、X、iOS、Android、Microsoft 365、Google Workspace、GitHub Copilot 和 Cursor。公告读起来像是一份集成目录,每项集成都将 Grok 添加到一个熟悉的工具中。但真正的故事不在于该模型运行在多少地方,而在于这个模型是由其早期版本大规模构建的。
与 xAI 一同训练 Grok 4.5 的 Cursor 披露,训练环境是由自主 AI 智能体而非人类工程师构建的。一个工程师团队定义了问题类型和验证方法;然后智能体构建、测试并优化每个训练环境。该公司指出,其中一些环境如果手动创建,需要数百名工程师数月的劳动。随后,强化学习管道利用这些环境来教导模型在软件工程、数据科学、金融和法律等领域进行多步推理。
这种自我强化循环是一种趋向于复利式增长的进步。如果一个模型能够帮助构建其继任者的训练基础设施,那么每一代都有可能加速下一代。xAI 在其公告中并未详述这一点,但 Cursor 明确指出了它。结果是,该模型现在在 SWE Marathon 排行榜上领先,尽管领先 Claude 4 Opus 和 GPT-5 的幅度不大。该基准测试评估的是真实世界的代码修复和功能添加,这与训练重点相符。
此次发布的范围异常广泛。Grok 4.5 作为 Grok Build(该平台的聊天内编码环境)中的默认模型出现。适用于 Microsoft Word、Excel、PowerPoint 和 Outlook 的插件使用户可以用日常英语提问、生成公式、总结线程和起草回复。Google Workspace 也获得了适用于 Sheets、Slides 和 Docs 的类似附加组件。GitHub Copilot 用户可以在 VSCode 的模型选择器中选择 Grok 4.5。API 定价为每百万输入 token 2 美元和每百万输出 token 6 美元,该公司声称其 token 效率大约是同类领先模型的两倍。
此外,xAI 还宣布了 Grok Voice Think Fast 2.0,一款升级的语音到语音模型,在整体质量指数上得分为 82.9%,高于上一版本的 75.7%。它可以在说话时推理查询,从而保持较低的响应时间。该语音模型将于 2026 年 8 月 5 日成为默认模型,费用为每分钟音频 0.08 美元。
Grok Build 中的工作流增加了另一层次:用户用日常语言描述一项任务,系统将其分发给最多 1,024 个并行智能体,验证结果并生成单一报告。内置的 /deep-research 命令自动进行多来源调查。这些并非玩具。它们反映了一种将 Grok 视为基础设施层而非聊天窗口的策略。
此次发布的广度很容易让人忽略那个更低调的标题:支持所有这些集成的模型,部分是由其自身前辈产出的。这一事实比任何单一基准分数都更具深远意义。它预示着一个未来:每一代新模型都会帮助构建下一代,而人类工程师的工作从构建训练数据转向设计智能体执行的验证逻辑。目前,Grok 4.5 无所不在。问题是下一版本会是什么样子,又将由谁构建。
每天早晨用 3 分钟掌握科技要闻
每个工作日一封邮件,只讲真正重要的 AI 与科技动态。