视觉语言模型
2 published articles
人工智能4 min read
接地评估 vs. 非接地评估
为什么你的AI模型自我审查在视觉质量上失效
新研究引入“接地”作为控制测试时计算第三轴(交互缩放)的关键变量。研究结果表明,一种测量实际布局的确定性工具优于VLM截图评估,能修复视觉模态中40%到74%的缺陷,而标准指标却一无所见。
2026-07-31
大语言模型与模型4 min read
多模态AI
为什么视觉语言模型需要一个视觉中继窗来停止幻觉
新研究揭示了VLM中稳定三阶段多模态注意力再分配,并将其操作化为视觉中继窗(VRW)。TRACE框架使用轻量级训练模块按任务调度此窗口,在接地敏感基准测试中平均提高4.33个百分点,最高达6.6个百分点。
2026-07-23