模型对比
3 published articles
人工智能Featured2 min read
AI效率
四个小模型刚刚击败了它们的大哥。这不再是巧合。
OvisOCR2(0.8B)、Mage-Flow(4B)、Celeris-1,以及Claude Opus 5以成本效益击败Fable 5,本月都击败了更大或更昂贵的系统,不是通过规模,而是通过修复实际限制性能的具体瓶颈:分词、流水线冗余、延迟。
2026-07-30
人工智能4 min read
人工智能经济学
Claude vs Fugu 成本核算:当集群胜过单一模型
Anthropic的Claude Opus 5以一半的令牌成本提供接近旗舰的性能,但有意限制了网络安全能力。Sakana AI的Fugu平台编排多个开源模型以匹配前沿基准。决策取决于任务类型、预算和对复杂性的容忍度。
2026-07-27
大语言模型与模型Featured4 min read
开放权重分析
Gemma 4 不是聊天机器人,而这正是其设计初衷
Google DeepMind 的 Gemma 4 是一款开放权重模型,专为自托管和定制化设计,而非面向消费者的聊天应用。本文将其与 ChatGPT、Claude 和 Qwen-3.5 在许可、隐私和部署灵活性方面进行比较,揭示其在受监管行业和终端设备 AI 方面的重要性。
2026-07-10