人工智能
人工智能:大语言模型、智能体、扩散模型、计算机视觉、自然语言处理及顶级实验室最新动态。
565 published articles
AI检测工具
一项200万美元的图书交易因AI指控而告吹
出版商和学校正依据AI检测器的标记采取行动,其后果足以终结职业生涯:一项200万美元的图书交易被取消、学生被停学、诉讼接连不断。这些工具自己的制造商也承认,它们的准确度不足以作为行动依据。欢迎来到不信任的时代。
2026-08-16
AI 智能体 · 开源
DeepSeek 推出智能体编排框架,连模型本身都是插件
DeepSeek 发布了 DeepSeek Harness,这是一个开源智能体运行时,其中的模型、工具、沙箱和用户界面均为 Cordis 插件。仅追加的会话日志和双工具极简模式指向一个更低调的野心:可审计、可复现的智能体运行。
2026-08-16
谷歌的主力模型,在 3.7 更新中规模更大
Gemini 3.7 Flash 价格减半,随后给出理由
谷歌 Gemini 3.7 Flash 以 3.6 Flash 首发价的一半推出,同时宣称在编程、Web 开发和知识工作基准测试上取得进步。该模型在上一代 Flash 发布三周后上市,并为智能体构建者带来了新的性价比论据。
2026-08-16
开源AI:阿里巴巴开放Max层级
Qwen 3.8-Max:阿里巴巴最强大模型现已开放免费下载
阿里巴巴正在开源其有史以来最强大的模型Qwen 3.8-Max:一款2.4T参数的MoE模型,在SWE-bench Pro、PaperBench和IFBench上超越GPT-5.6 Sol。我们解析了基准测试的注意事项,以及95B活跃参数的开源旗舰对开发者意味着什么。
2026-08-16
智能体编码与提示词膨胀
灾难性记忆:为什么 CLAUDE.md 文件会增长 226% 且永不缩小
一项针对 1,867 个代码仓库的 arXiv 研究发现,CLAUDE.md 等智能体编码指令文件在其生命周期内体积增至三倍,因为一旦指令背后的理由被遗忘,删除一行就可能引发性能回退。作者将其命名为“灾难性记忆”,并表明记录推理过程可将多余指令削减 99.3%。
2026-08-15
AI 研究
停止复制粘贴技能:SkillZip 为臃肿智能体提供免评估修复方案
自进化智能体不断追加修复,直到同一条规则出现在多个分支中。SkillZip 通过寻找最短的忠实结构化解释,在无需评估 rollout 的情况下压缩其技能。一次性模式与 Zip-on-Write 模式,以及摘要中未经证实的内容。
2026-08-15
多模态 / 开源
Qwen 插件包为你的编码代理装上眼睛、双手和视频记忆
阿里巴巴 Qwen 团队发布了 Qwen-MM-Plugins,这是一个 Apache-2.0 工具包,为编码代理提供原生多模态技能:动态分辨率图像和视频读取、OCR、grounding、ASR、长视频记忆、视频生成,以及通过瘦客户端控制 Blender 和 FreeCAD。一个脚本即可在 Claude Code、Codex、Qoder、OpenClaw、Qwen Code 和 Gemini CLI 中完成安装。
2026-08-15
AI 智能体
当智能体技能适得其反,SkillProx 像梯度下降一样修剪它们
技能本应让智能体更聪明,但它们累积的每一次修复都可能让智能体变得更笨。SkillProx 运行一个受近端梯度启发的正向-反向循环,用于诊断、回滚和删除。结果:相比最强的基于梯度的基线,平均准确率提升 3.0 个百分点。
2026-08-14
AI 智能体
Grok Bot 瞄准大多数 AI 未完成的最后 10% 工作
Grok Bot 是 xAI 新推出的智能体产品,运行在专属云端电脑上,可登录你已在使用工具,通过看你操作一次来学习工作流程,并端到端地完成工作。其背后的卖点是:大多数 AI 只做到 90% 就停下了。
2026-08-14
AI经济学
阿里巴巴18美元套餐在Claude Code中运行Qwen与DeepSeek
阿里云的Token Plan Individual将Qwen及DeepSeek等第三方模型打包进单一积分池,月费6美元起,可在Claude Code和Cursor中使用。该公司声称较按量付费节省约40%,但该计划仅在新加坡可用,且仅限经批准的工具内使用。
2026-08-14
AI 模型 | NVIDIA Nemotron 3.5 Lightning
为什么 Nemotron 3.5 Lightning 认为大多数智能体步骤不需要大模型
Nvidia 的新开源模型在本地运行,具有 3B 激活参数和 100 万 token 上下文,专为持续运行的智能体打造。Nvidia 声称吞吐量最高可达同类开源模型的 4 倍,任务完成速度快 30%。
2026-08-14
视频AI研究
上下文匹配蒸馏如何阻止视频教师模型窥见未来
视频蒸馏长期以来一直训练因果学生,而教师则用未来知识对完整片段进行评分。CMD 用因果教师取代了这一评分方式,增加了前缀评分的目标,并在自回归方法中报告了最先进的结果。
2026-08-14