效率
3 published articles
大语言模型与模型2 min read
多模态AI
12B参数模型击败90B:扩展范式遭遇挑战
Pixtral-12B 在多模态基准测试中匹配或超越了比其大七倍的模型,且未牺牲语言性能。Mistral 还发布了一个用于实用视觉语言评估的新开放基准,挑战了“越大越好”的观念。
2026-07-17
人工智能Featured6 min read
基准测试深度解析
GPT-5.6 让AI领域的每一分钱都更有价值
OpenAI 的 GPT-5.6 系列, , Sol、Terra、Luna, , 在编程、网络安全和专业基准测试上带来了最先进的结果,而 token 成本仅为竞争对手的一小部分。多智能体“ultra”模式和分层定价旨在让更多用户能够使用前沿智能,同时分层安全措施应对双重用途风险。
2026-07-09
DeepSeek4 min read
开源AI研究
百万token上下文,KV缓存仅需十分之一:DeepSeek-V4的效率赌注
DeepSeek的V4预览将一款1.6万亿参数的Pro模型与一款2840亿参数的Flash变体组合在一起,两者均支持百万token上下文。论文声称其推理FLOPs仅为V3.2的27%,KV缓存仅为其10%, , 正是这些数字让该上下文的部署变得经济可行。
2026-06-22