开放权重
7 published articles
视频生成
MiniMax 放弃其成熟架构,让 H3 包揽一切
MiniMax 表示,H3 将文本、图像、视频和音频生成统一到一个模型中,2K 输出的定价低于主流模型的三分之一,并计划在数日内开放权重。细则才是真正的故事:该公司为了达到这一目标,放弃了自己曾占据优势的架构。
2026-08-07
Qwen3.8-Max 开放权重下周上线
阿里巴巴史上最强大的模型将开源
Qwen3.8-Max 是阿里巴巴首款开放权重的 Max 级模型,参数规模 2.4 万亿,将于下周登陆 Hugging Face 和 ModelScope。此次发布重新定义了开源议题:当最前沿的最大权重可被免费下载和测试时,会发生什么?
2026-08-06
AI 安全
Mistral 的 Shieldstral 将审核策略放在提示词中,而非权重里
Shieldstral 将审核框定为二元问题:一条指令、一个是/否查询,以及待判断的内容。Mistral 表示,这款 3B 模型在文本安全方面可媲美体积高达其七倍的开源护栏模型,其 Apache 2.0 权重可在单个 16GB GPU 上运行。
2026-08-05
竞争对手的联盟
OpenAI、Meta等40多家企业签署AI政策公开信。这为何重要。
来自AI生态系统的41个组织联合签署了一封公开信,认为开放权重模型对美国AI领导地位至关重要。这一非同寻常的联盟包括OpenAI和Meta等竞争对手、云巨头和初创公司,标志着罕见的政策共识。
2026-07-26
AI智能体
Mistral编程智能体将笔记本电脑抛在身后:并行会话,无需紧盯
Mistral正在将编程智能体迁移到云端,通过新的Mistral Medium 3.5模型实现并行、异步任务执行。此次更新在Mistral Vibe和Le Chat中引入了远程智能体,以及用于多步骤任务的Work模式,同时保留了对敏感操作的人工监督。
2026-07-12
开放权重分析
Gemma 4 不是聊天机器人,而这正是其设计初衷
Google DeepMind 的 Gemma 4 是一款开放权重模型,专为自托管和定制化设计,而非面向消费者的聊天应用。本文将其与 ChatGPT、Claude 和 Qwen-3.5 在许可、隐私和部署灵活性方面进行比较,揭示其在受监管行业和终端设备 AI 方面的重要性。
2026-07-10
开源AI研究
百万token上下文,KV缓存仅需十分之一:DeepSeek-V4的效率赌注
DeepSeek的V4预览将一款1.6万亿参数的Pro模型与一款2840亿参数的Flash变体组合在一起,两者均支持百万token上下文。论文声称其推理FLOPs仅为V3.2的27%,KV缓存仅为其10%, , 正是这些数字让该上下文的部署变得经济可行。
2026-06-22