上下文窗口
2 published articles
实验室与研究5 min read
AI / 智能体编码研究
Blast Radius埋葬死上下文。450具尸体无一复返
一篇新的arXiv论文Blast Radius将浪费的智能体上下文视为死物质并加以可逆埋葬:在七个OpenAI模型上节省17-26%的token,450个已归档上下文,零次召回。这篇论文更宏大的目标是让智能体编码变得可持续, , 一次回收一个token。
2026-08-19
大语言模型与模型3 min read
有效上下文、输出上限以及长窗口的隐性代价
你的AI模型说它能读取100万token,它在撒谎。这是真实的数学。
四大前沿大语言模型都宣称拥有100万+ token的上下文,但有效召回、输出限制和实际成本差异显著。DeepSeek V4 Pro 在输出上限和成本上领先,Gemini 在20万token以下表现出色,而 Claude Opus 在交互式代码审查的缓存方面胜出。本文分析了2026年4月的数据。
2026-06-30