DeepSeek
10 published articles
AI 智能体 · 开源
DeepSeek 推出智能体编排框架,连模型本身都是插件
DeepSeek 发布了 DeepSeek Harness,这是一个开源智能体运行时,其中的模型、工具、沙箱和用户界面均为 Cordis 插件。仅追加的会话日志和双工具极简模式指向一个更低调的野心:可审计、可复现的智能体运行。
2026-08-16
AI经济学
阿里巴巴18美元套餐在Claude Code中运行Qwen与DeepSeek
阿里云的Token Plan Individual将Qwen及DeepSeek等第三方模型打包进单一积分池,月费6美元起,可在Claude Code和Cursor中使用。该公司声称较按量付费节省约40%,但该计划仅在新加坡可用,且仅限经批准的工具内使用。
2026-08-14
AI价格战
一条回复声称,智谱GLM-5.2走红的0.07美元定价已上涨约10倍
智谱GLM-5.2以每百万token 0.07美元的价格走红,发帖者称这一95%的降幅"几乎等于免费。"一条回复称,价格回升10倍是博眼球的花招。从业者补充说,GLM-5.2从未达到前沿水平。
2026-08-10
人工智能研究
为什么令牌对数概率不是监控AI推理模型的正确信号
Novelis Research表明,令牌对数概率作为量化推理模型的解码器监控器存在缺陷,无法察觉自信循环。他们引入了一种校准的e-CUSUM控制器,结合了不确定性和重复信号,在DeepSeek-R1-Distill-Qwen-1.5B上的GSM8K任务中实现了选择性。
2026-08-03
分析
基准测试,而非廉价:中国AI实验室达到与西方同等水平
中国AI实验室Qwen、DeepSeek、MiniMax和Kimi在推理、编码和文档解析基准测试中已赶上或超越美国前沿模型。通过激进定价和开放权重策略,它们不再只是廉价替代品,而是真正的竞争者。
2026-07-27
AI领导力
美国AI的护城河正在流失,东方正在拧动阀门
探讨中国和日本的开源模型如何挑战美国专有AI领先的假设。从DeepSeek到Sakana,东方正在改写规则。
2026-07-27
系统优化
DSpark 揭示:快速 AI 推理是调度问题,而非模型技巧
DeepSeek 的 DSpark 论文揭示,简单的推测解码在高并发下会降低吞吐量。其解决方案, , 置信度调度的验证, , 根据每个请求调整块长度,并改变了服务性能的帕累托前沿。
2026-07-12
人工智能
DeepSeek-OCR 2 引入视觉因果流,开源文档理解再升级
DeepSeek-OCR 2 引入视觉因果流,实现类人视觉编码。该模型现已在 GitHub 上开源,支持 vLLM 和 Transformers,具备动态分辨率(最多 1,216 个视觉标记)及文档到 Markdown 的转换功能。
2026-07-09
API 经济学
DeepSeek V4 将于七月发布,定价调整将让白天写代码的你感到肉疼
DeepSeek V4 七月中旬发布,采用高峰负载定价。办公时段 API 费用翻倍,最高每百万输出 token 1.74 美元,但低谷时段对缓存命中工作负载来说可能非常便宜。
2026-07-09
人工智能
DeepSeek新模型让效率竞争成为AI军备竞赛的前沿
DeepSeek发布了一款新的大型语言模型,通过将赌注押在效率而非蛮力上,加剧了与主要AI实验室的竞争。该模型旨在通过优化资源利用提供强大性能,反映了行业向成本效益型AI的广泛转变。
2026-06-30