SevenTnewS

实验室与研究

OpenAI、Anthropic、Google DeepMind、Meta AI及相关论文

114 published articles

4 min read

Qwen / 阿里云

Qwen2.5-Omni 在 OmniBench 上超越 Gemini-1.5-Pro,可在 12GB 以下显存运行

阿里开源模型 Qwen2.5-Omni 在 OmniBench 上得分超过 Gemini-1.5-Pro,并登顶 MMAU 音频推理排行榜。量化版本将显存占用降至 12GB 以下,MNN 支持将实时语音对话带到手机上。

2026-08-07

2 min read

融资轮

Mistral AI 17亿欧元押注工厂车间

由ASML领投的Mistral AI C轮融资筹集了17亿欧元,估值达117亿欧元。该合作伙伴关系将这家AI初创公司与半导体制造联系起来,标志着从通用模型向工业应用的战略转向。

2026-08-06

4 min read

AI政策

Anthropic为何将AI政策事务交给一位前最高法院大法官

前加州最高法院大法官蒂诺·奎利亚尔加入Anthropic,出任其首任首席全球事务官。他的加盟释放出一个信号:AI治理之争将在各国首都决出胜负,而Anthropic正在扩充人员,以便跻身那些决策场所。

2026-08-06

4 min read

企业AI

忘掉模型竞赛:阿里正在将安全运维自动化

Qwen3.8-Max抢占了头条,但阿里真正的动作更为低调:在其云控制台内运行安全运维的AI Agent。我们拆解了SecOps Agent、由Qwen驱动的欺诈取证,以及分数背后的锁定战略。

2026-08-06

4 min read

Qwen3.8-Max 开放权重下周上线

阿里巴巴史上最强大的模型将开源

Qwen3.8-Max 是阿里巴巴首款开放权重的 Max 级模型,参数规模 2.4 万亿,将于下周登陆 Hugging Face 和 ModelScope。此次发布重新定义了开源议题:当最前沿的最大权重可被免费下载和测试时,会发生什么?

2026-08-06

Featured4 min read

Meta AI

Muse Code:Meta 在编码智能体竞赛中的抗崩溃押注

Meta 的 Muse Code 为 macOS 和 Linux 带来了一款可抵御崩溃的终端编程代理,由 Muse Spark 1.2 驱动,该模型与其自身的工具框架联合训练,面向长周期任务。Meta 表示,更大、更强的模型已在路上。

2026-08-06

Featured4 min read

AI 整合

Reve 的研究人员将加入 OpenAI;其产品保持不变

OpenAI对独立实验室Reve的投资带来了研究人才的流动:Reve的AI研究团队部分成员加入OpenAI的多模态研究计划,而Reve的产品保持不变。未披露具体金额。

2026-08-05

Featured4 min read

AI 安全

Mistral 的 Shieldstral 将审核策略放在提示词中,而非权重里

Shieldstral 将审核框定为二元问题:一条指令、一个是/否查询,以及待判断的内容。Mistral 表示,这款 3B 模型在文本安全方面可媲美体积高达其七倍的开源护栏模型,其 Apache 2.0 权重可在单个 16GB GPU 上运行。

2026-08-05

Featured4 min read

日本AI

Sakana Namazu押注敬语,迎战最强AI时代

Sakana AI推出Namazu,一个专精日本商务文档、邮件和敬语的模型。它的问世正值亚洲企业报告称,稀缺且质量低下的本地语言模型正在阻碍AI采用。

2026-08-03

Featured5 min read

开源AI

Qwen3.8-Max 在24小时内独自击败458支人类团队

Qwen3.8-Max在24小时竞赛中独自击败了526支人类团队中的458支,阿里巴巴将于下周开源其权重。到目前为止,每一个数字都是自我报告的,这正是自主性主张值得审视的原因。

2026-08-03

5 min read

产品策略

Sakana AI押注反对“最强AI”时代:编排、快速交付

Sakana AI在短时间内相继推出Sakana Chat、Marlin、Fugu和Translate。产品负责人Sota Omura阐释了为何快速交付是AI时代的打法,以及公司为何押注反对单一“最强AI”。

2026-08-03

5 min read

前沿AI

Anthropic 最聪明的 Claude 是你无法使用的那一款

Anthropic 向所有人推出了 Claude Fable 5,并将 Claude Mythos 5 保留给经过审核的合作伙伴。同一模型系列,两扇访问之门。基准测试不如路由机制重要,而路由正是前沿 AI 从今往后的发布方式。

2026-08-03

← PreviousPage 3 / 10 · 114 articlesNext →