开源
75 published articles
开源 · Vibe 设计工作区
Open Design 从你自己的机器上向 Claude Design 发起挑战
Open Design 是一个 Apache-2.0 的 vibe 设计工作区,将自己定位为 Claude Design 的开源本地替代方案。你的代理、你的密钥、你的文件:没有厂商云,没有订阅,支持 21 个编码代理,GitHub 星标超过 85.5K。
2026-08-22
AI 安全
消融版 Qwen3.8-27B:拒绝率降至 0%,基准测试几乎未动
Qwen3.8-27B 的消融版 FP8 量化构建在 AdvBench 上对有害提示的拒绝率从 99% 降至 0%,而通用基准测试的差距保持在 1.3 个百分点以内。模型卡以非同寻常的详细程度记录了该方法。其中的警示同样值得关注。
2026-08-16
AI 智能体 · 开源
DeepSeek 推出智能体编排框架,连模型本身都是插件
DeepSeek 发布了 DeepSeek Harness,这是一个开源智能体运行时,其中的模型、工具、沙箱和用户界面均为 Cordis 插件。仅追加的会话日志和双工具极简模式指向一个更低调的野心:可审计、可复现的智能体运行。
2026-08-16
多模态 / 开源
Qwen 插件包为你的编码代理装上眼睛、双手和视频记忆
阿里巴巴 Qwen 团队发布了 Qwen-MM-Plugins,这是一个 Apache-2.0 工具包,为编码代理提供原生多模态技能:动态分辨率图像和视频读取、OCR、grounding、ASR、长视频记忆、视频生成,以及通过瘦客户端控制 Blender 和 FreeCAD。一个脚本即可在 Claude Code、Codex、Qoder、OpenClaw、Qwen Code 和 Gemini CLI 中完成安装。
2026-08-15
开源 AI
Meta 的 30B Muse Glimmer 率先登陆 Apple Silicon,NVIDIA 支持随后跟上
Meta 发布了 Muse Glimmer,一款面向 agent 工作负载的 30B 开放权重多模态模型,Ollama 同一天在 Apple Silicon 上提供了支持。DFlash 使其在 Mac 硬件上快 1.5 到 1.8 倍。NVIDIA 和 AMD 支持将在未来几天内跟进。
2026-08-13
开源AI
Muse Glimmer:Meta的300亿参数智能体占用不到20GB,无需云端
Meta 开源了 Muse Glimmer,这是一个 30B 智能体模型,可在单块消费级 GPU 上离线运行。量化使其保持在 20 GB 以下,DFlash 草稿模型在 RTX 5090 上带来最高 3.1 倍的解码加速,权重以 Apache 2.0 许可发布在 Hugging Face 上。
2026-08-10
开源AI
阿里巴巴最大模型独自编码16天,下周权重将公开发布
Qwen3.8-Max在2.4万亿参数中仅激活950亿,在Vision Arena中排名第二,并在16天的自主运行中构建了一个智能体框架。阿里巴巴将于下周首次开源发布旗舰模型的权重。
2026-08-10
Qwen / 阿里云
Qwen2.5-Omni 在 OmniBench 上超越 Gemini-1.5-Pro,可在 12GB 以下显存运行
阿里开源模型 Qwen2.5-Omni 在 OmniBench 上得分超过 Gemini-1.5-Pro,并登顶 MMAU 音频推理排行榜。量化版本将显存占用降至 12GB 以下,MNN 支持将实时语音对话带到手机上。
2026-08-07
AI视频生成
MiniMax H3视频定价为竞品的三分之一,编辑能力排名第一
MiniMax H3将文本、图像、视频和音频整合到一个模型中,输出定价为主流每秒费率的三分之一,并在Artificial Analysis的视频编辑排名中位列第一。权重文件承诺数日内发布。该模型在公司自家演示之外能否站得住脚,仍是悬而未决的问题。
2026-08-06
Qwen3.8-Max 开放权重下周上线
阿里巴巴史上最强大的模型将开源
Qwen3.8-Max 是阿里巴巴首款开放权重的 Max 级模型,参数规模 2.4 万亿,将于下周登陆 Hugging Face 和 ModelScope。此次发布重新定义了开源议题:当最前沿的最大权重可被免费下载和测试时,会发生什么?
2026-08-06
边缘 AI
Audio8 的纯 CPU 运行时让语音克隆在约 1 GiB 内存中运行
Audio8 的 ONNX 运行时完全在 CPU 上运行 0.6B TTS 预览版:INT4 自回归权重、内置 44.1 kHz 编解码器、流式 PCM 以及兼容 OpenAI 的端点。该服务在笔记本电脑上占用约 1 GiB 内存,运行时无需 PyTorch 或 Transformers。
2026-08-05
开源
一场租用 GPU 的接力赛以 200 美元训练出 NanoColibri 的 2.7B MoE
NanoColibri-Instruct 以大约 200 美元从空白权重变成了一个可用的 2.7B MoE。志愿者在 Hugging Face Hub 上传递训练接力棒,一次一台租用 GPU,通过比较并交换租约确保永远不会有两个人在同一段上训练。
2026-08-04