云瓶颈
Ollama暂停销售高级计划:开源模型正在吞噬其云资源
由于对GLM-5.2和其他前沿开放模型的需求压垮了其云服务,Ollama暂停新的Max订阅,而更大模型将于下周发布。

Ollama周一暂停新Max订阅。原因:GLM-5.2等开源模型消耗云端容量的速度超过了其添加GPU的能力。该公司需要为下周即将推出的“超大型模型”预留空间。
GLM-5.2是智谱AI最近发布的开源权重模型,将Ollama的基础设施推向极限。该公司表示正在增加计算资源以维持现有Max订阅用户的满意度,但新用户注册将需等待。更便宜的Pro层级仍然开放。
这一暂停凸显了开源模型生态系统的飞速增长。Ollama今年早些时候筹集了8800万美元,旨在让运行开源模型变得极其简单,其Token量逐月翻倍有余。这种增长反映了对开源权重模型的广泛渴求,这一趋势已推动Gemma 4等模型达到3亿次下载(Gemma 4下载里程碑)。
这不仅仅是Ollama的问题。整个行业内,对开源模型的需求正在重塑云经济。例如,像Kimi K3这样的单一开源权重模型就引发了全球AI股票的重新估值(Kimi K3的市场影响)。与此同时,Hugging Face等平台正加倍押注于基础设施的易用性而非模型性能,以抓住同一波浪潮(Hugging Face的基础设施押注)。而像OpenCode这样的开源编码平台已实现4000万美元ARR,其押注是:开发者想要选择,而非锁定(OpenCode的增长故事)。
Ollama对具体细节保密,但“超大型模型”暗示参数量超过1000亿。该公司押注开源模型将继续推动流量,即使这意味着暂时拒绝付费客户。服务此类模型的经济性仍然棘手,正如微软内部对开源模型的测试所显示的,其具有大幅降低成本的潜力(微软节省89%成本)。
每天早晨用 3 分钟掌握科技要闻
每个工作日一封邮件,只讲真正重要的 AI 与科技动态。