SevenTnewSAI 与科技新闻,深度解读

AI编程智能体

阿里巴巴Qoder押注:编程智能体将赢在运行框架,而非模型

阿里云Qoder Agent Desktop既是一款产品,也是一种主张:编程智能体的胜负将取决于运行框架,而非模型。任务取代文件成为工作的基本单元;阿里巴巴援引内部数据称,智能体输入token减少了40%。目前还没有独立验证结果发表。

Emmanuel Fabrice Omgbwa Yasse AI 辅助

2026-09-15 · 阅读需 4 分钟

阿里巴巴Qoder押注:编程智能体将赢在运行框架,而非模型

阿里云Qoder Agent Desktop是该公司对编程智能体市场一个棘手问题的回应:如果每家都能获得大致相同的前沿模型,那么一个智能体与另一个智能体之间究竟靠什么区分?阿里云社区博客上的公告文章写道,区别在于智能体外围的容器,而不是它里面的模型。阿里巴巴认为,代码仍然是工作的实质内容,只是如今它成了智能体的工作素材,而不是开发者直接编辑的文件。

这种说法直截了当。“早期工具会问:‘我们应该编辑哪些文件?’”该公司写道,“而工作台会问:‘做完了吗?’”如今工作的基本单元变成了任务;阿里巴巴把任务视为拥有状态和生命周期的事物:它可以运行数小时,因开发者的一句话而暂停,并在笔记本盖合上后接续运行。

任务取代文件夹,成为工作的基本单元

阿里巴巴自己撰写的文章朝这个方向推进已有一阵子了。其Qoder 1.0设计文章把经典IDE描述成一种约定,而这种约定一旦让智能体承担真正的工作就会悄然破裂:窗口状态、执行状态与交付状态不再指向同一处,因为你打开的文件夹未必是智能体交付成果的文件夹。解决办法是别再假装它们彼此一致。每个任务拥有自己独立的工作区、执行、制品、交付与知识边界;并行任务运行在相互隔离的工作树中,因此不会互相碰撞。

如今发布的桌面工作台将这套逻辑向外推展。一个智能体穿梭于终端、IDE与桌面之间,它提出的问题会随容器而变:

经典IDE的假设Qoder的任务模型
打开的文件夹是工作的基本单元任务是工作的基本单元
“我们应该编辑哪些文件?”“做完了吗?”
工作存在于一台机器的一个窗口里状态在终端、IDE与桌面之间传递,并在笔记本盖合上后依然保留

受众随工作基本单元的转变而改变。Qoder面向那些不靠写代码谋生的人:产品经理得到交互式原型,设计师得到可运行的设计稿,运维人员得到自动化的周报。“他们知道自己想要什么,也能判断结果,”阿里巴巴表示。这些人不应该需要先安装开发环境。

模型无关的路由,让运行框架成为卖点

Qoder在构建上刻意不关心内部使用的是哪个模型。该公司称,几乎每个月都会有新的前沿模型问世,因此Qoder不与任何单一模型绑定,而是随着新选项的出现逐一集成。专家可以自己挑选并配置模型;其他用户则使用Ultimate、Performance、Efficient与Auto这几档路由,其中Auto会在质量、速度与成本之间取得平衡。“你在意时,由你选择,”这句宣传语写道,“你不在意时,由Qoder选择。”

接下来就是运行框架的论证。“同一个模型放在不同的运行框架里,能否完成工作可能相差数倍,”阿里巴巴写道,因为真实任务是分解、失误、意外与恢复构成的长链条。Qoder提供70多个专家套件、2万多项技能与40多个连接器,并且会学习用户的工作环境,而不是要求用户把每一个假设都讲清楚。“模型能力是商品;上下文才是你的资产,”该公司总结道。

这些数字目前仍是阿里巴巴自家的

阿里巴巴用内部数据支撑这一命题。其材料称,任务边界背后的作用域内存引擎使智能体输入token减少了40%,这一结果是根据该公司自己的A/B测试测得的。阿里巴巴之外还没有人发表过对该结果的独立复现,更广泛的市场也没有接受这个前提。竞争对手的编程智能体依然在以模型实力为卖点;据我们此前的报道,至少有一款由GLM-5.2驱动的智能体据称在编程测试中略胜于Anthropic的Claude 4.8。Qoder公开押注:智能体能否在不丢失上下文的情况下把任务坚持做完,将比基准测试上的炫耀更重要。

这篇发布文章以坦诚的取舍收尾。“没有信任的自主只会带来返工;没有自主的信任不过是位谨慎的助手,”阿里巴巴写道。桌面应用之后的路线图,是跨任务的协同,以及人类与智能体的联合编排。团队是否愿意把长时间运行的工作交给这类运行框架,将决定这一押注能否成立。在这种叙事中,模型质量不再是护城河;让智能体放手去跑、并在其偏离时把它接住的能力,才是护城河。

每天早晨用 3 分钟掌握科技要闻

每个工作日一封邮件,只讲真正重要的 AI 与科技动态。