SevenTnewS

DeepSeek

10 published articles

DeepSeek4 min read

AI 智能体 · 开源

DeepSeek 推出智能体编排框架,连模型本身都是插件

DeepSeek 发布了 DeepSeek Harness,这是一个开源智能体运行时,其中的模型、工具、沙箱和用户界面均为 Cordis 插件。仅追加的会话日志和双工具极简模式指向一个更低调的野心:可审计、可复现的智能体运行。

2026-08-16

Qwen / 阿里巴巴4 min read

AI经济学

阿里巴巴18美元套餐在Claude Code中运行Qwen与DeepSeek

阿里云的Token Plan Individual将Qwen及DeepSeek等第三方模型打包进单一积分池,月费6美元起,可在Claude Code和Cursor中使用。该公司声称较按量付费节省约40%,但该计划仅在新加坡可用,且仅限经批准的工具内使用。

2026-08-14

大语言模型与模型5 min read

AI价格战

一条回复声称,智谱GLM-5.2走红的0.07美元定价已上涨约10倍

智谱GLM-5.2以每百万token 0.07美元的价格走红,发帖者称这一95%的降幅"几乎等于免费。"一条回复称,价格回升10倍是博眼球的花招。从业者补充说,GLM-5.2从未达到前沿水平。

2026-08-10

大语言模型与模型3 min read

人工智能研究

为什么令牌对数概率不是监控AI推理模型的正确信号

Novelis Research表明,令牌对数概率作为量化推理模型的解码器监控器存在缺陷,无法察觉自信循环。他们引入了一种校准的e-CUSUM控制器,结合了不确定性和重复信号,在DeepSeek-R1-Distill-Qwen-1.5B上的GSM8K任务中实现了选择性。

2026-08-03

实验室与研究1 min read

分析

基准测试,而非廉价:中国AI实验室达到与西方同等水平

中国AI实验室Qwen、DeepSeek、MiniMax和Kimi在推理、编码和文档解析基准测试中已赶上或超越美国前沿模型。通过激进定价和开放权重策略,它们不再只是廉价替代品,而是真正的竞争者。

2026-07-27

人工智能Featured3 min read

AI领导力

美国AI的护城河正在流失,东方正在拧动阀门

探讨中国和日本的开源模型如何挑战美国专有AI领先的假设。从DeepSeek到Sakana,东方正在改写规则。

2026-07-27

大语言模型与模型4 min read

系统优化

DSpark 揭示:快速 AI 推理是调度问题,而非模型技巧

DeepSeek 的 DSpark 论文揭示,简单的推测解码在高并发下会降低吞吐量。其解决方案, , 置信度调度的验证, , 根据每个请求调整块长度,并改变了服务性能的帕累托前沿。

2026-07-12

DeepSeek2 min read

人工智能

DeepSeek-OCR 2 引入视觉因果流,开源文档理解再升级

DeepSeek-OCR 2 引入视觉因果流,实现类人视觉编码。该模型现已在 GitHub 上开源,支持 vLLM 和 Transformers,具备动态分辨率(最多 1,216 个视觉标记)及文档到 Markdown 的转换功能。

2026-07-09

DeepSeekFeatured2 min read

API 经济学

DeepSeek V4 将于七月发布,定价调整将让白天写代码的你感到肉疼

DeepSeek V4 七月中旬发布,采用高峰负载定价。办公时段 API 费用翻倍,最高每百万输出 token 1.74 美元,但低谷时段对缓存命中工作负载来说可能非常便宜。

2026-07-09

DeepSeek3 min read

人工智能

DeepSeek新模型让效率竞争成为AI军备竞赛的前沿

DeepSeek发布了一款新的大型语言模型,通过将赌注押在效率而非蛮力上,加剧了与主要AI实验室的竞争。该模型旨在通过优化资源利用提供强大性能,反映了行业向成本效益型AI的广泛转变。

2026-06-30