13 published articles
开源AI研究
DeepSeek的V4预览将一款1.6万亿参数的Pro模型与一款2840亿参数的Flash变体组合在一起,两者均支持百万token上下文。论文声称其推理FLOPs仅为V3.2的27%,KV缓存仅为其10%, , 正是这些数字让该上下文的部署变得经济可行。
2026-06-22