代币效率
4 published articles
人工智能5 min read
测试时扩展
CoBa路由以58.9%更少的token追平best-of-16投票
CoBa,一篇新arXiv论文中提出的计算平衡路由策略,在0.01个百分点内追平best-of-16多数投票,同时将参数加权token削减58.9%。在跨MATH-500、AIME和AMC的3,129次评估中,它还完全胜过单样本解码,不过在预算不受限时,best-of-16仍保持微弱优势。
2026-08-19
AI代理Featured1 min read
AI编程
OpenCode押注token效率取胜,免费新增Ling 3.0 Flash
OpenCode现于Ling 3.0 Flash发布数天后免费提供该inclusionAI模型。此举延续了一项注重成本的策略,押注token效率将赢得AI编程竞赛。
2026-08-07
工具与框架2 min read
AI编程
新型Ling 3.0 Flash模型免费登陆OpenCode
OpenCode现免费提供来自inclusionAI的Ling 3.0 Flash模型,这是一款令牌效率高的模型,可能使开发者的AI编程成本更低。该模型加入平台仅在其发布几天后。
2026-07-24
人工智能Featured4 min read
AI模型
谷歌发布Gemini 3.6 Flash,同时推出精简版模型与网络安全变体
谷歌最新的Gemini模型面向生产级AI代理,提供更好的令牌效率和更低的延迟。3.6 Flash相比前代模型令牌使用量减少17%。3.5 Flash-Lite每秒可输出350个令牌。一款专注于网络安全的变体仅面向经过审查的合作伙伴。
2026-07-22