AI编程助手
7 published articles
AI代理
没人能说清他们的AI编码代理今天实际做了什么
企业在AI编码代理上投入巨资,却看不到这些代理实际做了什么;衡量其进步的基准可能对公共测试集过拟合;而且它们编写的代码默认未经审查。三个独立问题有着同一个根本原因:采用速度超过了观察工具的发展。
2026-07-30
代理可观测性
你的AI编码代理正在烧掉数百万,却没人知道钱花在哪里
企业在AI编程代理上投入巨资,却对其实际行为零可见性。阿里巴巴云的一个新开源项目旨在填补这一可观测性空白,但核心问题是行业性的:没有人能追踪这些代理在做什么。
2026-07-26
WWDC
苹果在Xcode 27中向第三方AI模型敞开围墙花园
Xcode 27带来了使用Anthropic、谷歌和OpenAI模型的智能编码功能,以及允许应用利用Apple、Claude、Gemini和其他模型的新框架。Core AI让开发者能够在设备端运行全尺寸大语言模型。
2026-07-25
AI编程代理
OpenCode通过押注开发者想要选择而非锁定,实现4000万美元ARR
OpenCode,一个开源AI编码代理,已实现460万周活跃用户和4000万美元ARR。Anthropic对某些使用模式的限制无意中推动了其增长,开发者纷纷涌向一个模型无关的替代方案。
2026-07-24
AI编码智能体
阿里Qwen-Coder-Qoder在自家测试中击败Cursor,Token消耗降低14.5%
阿里新一代编码模型Qwen-Coder-Qoder在Qoder Bench基准测试中击败Cursor Composer-1。生产指标显示代码保留率提升3.85%,工具错误率下降61.5%,Token使用量减少14.5%。该模型通过奖励者-攻击者框架基于真实智能体轨迹进行训练,以防止奖励作弊。
2026-07-23
编程智能体
Kimi K3在Next.js代码生成基准测试中击败Claude Fable 5和GPT 5.6 Sol
Kimi K3在Next.js代码任务中以92%的成功率并列第一,完成时间不到200秒。AGENTS.md文档抹平了顶级模型与中端模型之间的差距,将全部模型推至96%。
2026-07-18
Cursor推出iOS应用
你的手机正式成为合法编码工具,Cursor的iOS测试版证明了这一点
Cursor的iOS应用(公开测试版)允许开发者从手机启动AI编码代理,桥接本地与云端工作流,并在拉取请求就绪时接收推送通知。它重新定义了手机在软件开发中的角色,超越了传统的故障响应功能。
2026-07-14