AI 模型
9 published articles
AI战略
中国开源权重策略分裂硅谷
随着Kimi K3等中国开源权重模型在基准测试中媲美美国前沿系统且免费提供,硅谷出现分裂:一个由41家公司组成的联盟捍卫开放性,而Anthropic等企业则保持谨慎,一起失控模型的安全事件进一步加剧了分歧。
2026-07-31
AI模型
OpenAI发布针对长上下文处理的小型GPT更新
OpenAI今日推出了一项小型的GPT更新,涉及长上下文管理。此次变更旨在帮助模型更有效地处理扩展输入。
2026-07-28
一款158毫秒模型刚刚改写了速度与质量的游戏规则
打破速度-质量规则的158毫秒模型
Celeris-1在MMLU-Pro上以158毫秒延迟获得75.9%的分数,比GPT-5 mini快八倍,仅损失2.6个准确率百分点。本文分析了基准测试方法以及这种速度-质量权衡对实时AI应用的意义。
2026-07-25
成本与能力
物理测试中,1.40美元的模型击败了2.82美元的同门兄弟
四个 AI 模型被要求构建具有真实物理效果的 HTML 场景。Opus 5 以顶级模型中最低成本通过了所有三个测试,而 Fable 5 以两倍价格在每个测试中都失败了。
2026-07-25
成本分析
微软自研AI模型在生产中最高降低GPU成本89%
微软报告称,其MAI-2.5和MAI-Voice-2-Flash模型现已投入Bing、PowerPoint和Dynamics 365的生产环境,图像生成GPU成本降低84%,语音任务降低89%。自研模型战略正在带来相较于第三方替代方案可衡量的成本优势。
2026-07-24
Qwen Cloud
Qwen Cloud 将模型整合为单一订阅计划,下调团队定价
Qwen Cloud的Token Plan将多种AI模型的访问权限整合到单一订阅中,提供个人版和团队版,最低为Lite版。该公司声称,与按量付费相比,该计划可节省约40%的费用,并支持使用OpenAI和Anthropic协议的主流工具。
2026-07-24
具身AI
Qwen新机器人模型摒弃常见AI捷径
阿里巴巴Qwen团队发布了三款机器人专用基础模型和一个智能体环境世界模型,从通用视觉语言模型转向为物理行动专门构建的架构。
2026-07-18
产品发布
Anthropic 发布 Claude Sonnet 5、Claude Science 和 Claude Tag,展开重大产品攻势
Anthropic 推出了 Claude Sonnet 5(一款面向编程和专业工作的前沿 AI 模型)、Claude Science(一个面向科学家的 AI 工作台)以及 Claude Tag(用于团队工作流)。该公司还在首尔设立了办公室,并发布了关于 AI 加速的政策提案。
2026-07-08
产品发布
Claude Sonnet 5 来了,Anthropic 押注科学与企业市场
Anthropic 发布了 Claude Sonnet 5,这是一款更快、更强大的编程和智能体模型,同时为研究人员推出了 Claude Science,为团队推出了 Claude Tag。该公司还发布了一份关于人工智能指数级增长的政策框架。
2026-06-30