实验室与研究
OpenAI、Anthropic、Google DeepMind、Meta AI及相关论文
114 published articles
Qwen / 阿里云
Qwen2.5-Omni 在 OmniBench 上超越 Gemini-1.5-Pro,可在 12GB 以下显存运行
阿里开源模型 Qwen2.5-Omni 在 OmniBench 上得分超过 Gemini-1.5-Pro,并登顶 MMAU 音频推理排行榜。量化版本将显存占用降至 12GB 以下,MNN 支持将实时语音对话带到手机上。
2026-08-07
融资轮
Mistral AI 17亿欧元押注工厂车间
由ASML领投的Mistral AI C轮融资筹集了17亿欧元,估值达117亿欧元。该合作伙伴关系将这家AI初创公司与半导体制造联系起来,标志着从通用模型向工业应用的战略转向。
2026-08-06
AI政策
Anthropic为何将AI政策事务交给一位前最高法院大法官
前加州最高法院大法官蒂诺·奎利亚尔加入Anthropic,出任其首任首席全球事务官。他的加盟释放出一个信号:AI治理之争将在各国首都决出胜负,而Anthropic正在扩充人员,以便跻身那些决策场所。
2026-08-06
企业AI
忘掉模型竞赛:阿里正在将安全运维自动化
Qwen3.8-Max抢占了头条,但阿里真正的动作更为低调:在其云控制台内运行安全运维的AI Agent。我们拆解了SecOps Agent、由Qwen驱动的欺诈取证,以及分数背后的锁定战略。
2026-08-06
Qwen3.8-Max 开放权重下周上线
阿里巴巴史上最强大的模型将开源
Qwen3.8-Max 是阿里巴巴首款开放权重的 Max 级模型,参数规模 2.4 万亿,将于下周登陆 Hugging Face 和 ModelScope。此次发布重新定义了开源议题:当最前沿的最大权重可被免费下载和测试时,会发生什么?
2026-08-06
Meta AI
Muse Code:Meta 在编码智能体竞赛中的抗崩溃押注
Meta 的 Muse Code 为 macOS 和 Linux 带来了一款可抵御崩溃的终端编程代理,由 Muse Spark 1.2 驱动,该模型与其自身的工具框架联合训练,面向长周期任务。Meta 表示,更大、更强的模型已在路上。
2026-08-06
AI 整合
Reve 的研究人员将加入 OpenAI;其产品保持不变
OpenAI对独立实验室Reve的投资带来了研究人才的流动:Reve的AI研究团队部分成员加入OpenAI的多模态研究计划,而Reve的产品保持不变。未披露具体金额。
2026-08-05
AI 安全
Mistral 的 Shieldstral 将审核策略放在提示词中,而非权重里
Shieldstral 将审核框定为二元问题:一条指令、一个是/否查询,以及待判断的内容。Mistral 表示,这款 3B 模型在文本安全方面可媲美体积高达其七倍的开源护栏模型,其 Apache 2.0 权重可在单个 16GB GPU 上运行。
2026-08-05
日本AI
Sakana Namazu押注敬语,迎战最强AI时代
Sakana AI推出Namazu,一个专精日本商务文档、邮件和敬语的模型。它的问世正值亚洲企业报告称,稀缺且质量低下的本地语言模型正在阻碍AI采用。
2026-08-03
开源AI
Qwen3.8-Max 在24小时内独自击败458支人类团队
Qwen3.8-Max在24小时竞赛中独自击败了526支人类团队中的458支,阿里巴巴将于下周开源其权重。到目前为止,每一个数字都是自我报告的,这正是自主性主张值得审视的原因。
2026-08-03
产品策略
Sakana AI押注反对“最强AI”时代:编排、快速交付
Sakana AI在短时间内相继推出Sakana Chat、Marlin、Fugu和Translate。产品负责人Sota Omura阐释了为何快速交付是AI时代的打法,以及公司为何押注反对单一“最强AI”。
2026-08-03
前沿AI
Anthropic 最聪明的 Claude 是你无法使用的那一款
Anthropic 向所有人推出了 Claude Fable 5,并将 Claude Mythos 5 保留给经过审核的合作伙伴。同一模型系列,两扇访问之门。基准测试不如路由机制重要,而路由正是前沿 AI 从今往后的发布方式。
2026-08-03