检索
2 published articles
NLP与机器学习3 min read
RAG研究
当语料库超过1000万token时,BM25胜过智能体式RAG
智能体式搜索在小语料库上占优,但muset-ai一项覆盖28个嵌套层级的研究显示,BM25在接近1000万token时超越它。智能体消耗39倍的查询token,图RAG则在构建阶段停滞。
2026-08-07
人工智能5 min read
AI基础设施
英伟达Nemotron 3 Embed暴露了每个AI代理都需支付的隐性税
英伟达发布了Nemotron 3 Embed,一系列开源权重嵌入模型,在实现最先进检索质量的同时降低了下游代理的Token成本。8B变体在RTEB上排名第一;较小的1B模型提供了生产级效率。
2026-07-16