分析
基准测试,而非廉价:中国AI实验室达到与西方同等水平
中国AI实验室Qwen、DeepSeek、MiniMax和Kimi在推理、编码和文档解析基准测试中已赶上或超越美国前沿模型。通过激进定价和开放权重策略,它们不再只是廉价替代品,而是真正的竞争者。

在2024年的大部分时间里,传统观念认为中国AI实验室只能在价格上竞争。它们是预算选项,对于某些工作负载足够好,但没有人会把它们误认为是前沿。这一假设在过去六个月中悄然崩塌,而现在证据之多已不容忽视。
四个实验室, , 阿里巴巴的Qwen、DeepSeek、MiniMax和Moonshot AI(Kimi), , 各自发布了在特定基准测试中与Claude、GPT和Gemini持平或更优的模型。他们通过开放权重、激进的订阅定价以及超越通用对话AI的定向代理能力做到了这一点。结果是竞争格局与12个月前相比发生了根本性变化。
旧叙事崩溃
这一转变在今年早些时候就已显露出信号,当时微软开始在Copilot中测试Moonshot AI的Kimi K3,以降低推理成本高达
每天早晨用 3 分钟掌握科技要闻
每个工作日一封邮件,只讲真正重要的 AI 与科技动态。