视觉语言模型
4 published articles
人工智能5 min read
CARE-X 医疗AI
轻度主动脉扩张:初诊阅片仅检出12%,使用测量型VLM检出率达93%
主动脉扩张在胸部X光片上很少被量化,轻度病例常被漏诊:43例中初诊仅检出5例。工具增强的VLM检出了40例。CARE-X新研究解释了为什么放射学AI需要尺子,而不仅仅是眼睛。
2026-08-16
人工智能5 min read
人工智能
AutoVSR:以验证为优先的AI框架,连接电路原理图与符号表达式
AutoVSR利用视觉感知、可执行中间表示和工具增强的符号求解器,将电路图可靠地转换为有效的符号表达式。在五种电路类型上的实验表明,其性能优于通用视觉语言模型和专用方法,准确率分别提升30%至59%和42%至52%。
2026-08-04
人工智能3 min read
强化学习
Meta与UIUC研究者训练视觉语言模型自我核查并重新思考错误答案
SVR-R1将视觉语言模型自身的二元自我判定转化为学习信号。在图表和表格推理基准测试中,其表现大幅优于标准GRPO,同时模型逐渐需要更少的验证轮次,表明其将自我修正内化。
2026-07-25
大语言模型与模型2 min read
多模态AI
12B参数模型击败90B:扩展范式遭遇挑战
Pixtral-12B 在多模态基准测试中匹配或超越了比其大七倍的模型,且未牺牲语言性能。Mistral 还发布了一个用于实用视觉语言评估的新开放基准,挑战了“越大越好”的观念。
2026-07-17