نموذج رؤية-لغة
4 published articles
CARE-X للذكاء الاصطناعي الطبي
تمدد الأبهر الخفيف: 12% تُكتشف في القراءات الأولية، و93% مع نموذج لغوي بصري قائم على القياس
نادرًا ما يُكمَّم تمدد الأبهر على الأشعة السينية للصدر، وتُفوَّت الحالات الخفيفة: 5 من 43 في القراءات الأولية. نموذج لغوي بصري معزز بالأدوات رصد 40 حالة. أبحاث CARE-X الجديدة تشرح لماذا يحتاج ذكاء الاصطناعي الإشعاعي إلى مساطر، لا إلى عيون فقط.
2026-08-16
الذكاء الاصطناعي
AutoVSR: إطار ذكاء اصطناعي يربط المخططات الدائرية بالتعبيرات الرمزية مع التحقق أولاً
يستخدم AutoVSR الإدراك البصري، وتمثيلاً وسيطاً قابلاً للتنفيذ، وحلولاً رمزية معززة بالأدوات لتحويل المخططات الدائرية بشكل موثوق إلى تعبيرات رمزية صالحة. تظهر التجارب عبر خمسة أنواع من الدوائر تفوقه على كل من نماذج VLM العامة والطرق المتخصصة، محققاً تحسينات في الدقة تتراوح بين 30 و59% و42 و52% على التوالي.
2026-08-04
التعلم بالتعزيز
باحثون من ميتا وجامعة إلينوي في أوربانا-شامبين يدربون نماذج الرؤية واللغة على التحقق من عملهم وإعادة التفكير في الإجابات الخاطئة
يحول SVR-R1 الحكم الذاتي الثنائي لنموذج الرؤية واللغة إلى إشارة تعلم. تم اختباره على معايير تفكير الرسم البياني والجداول، ويتفوق على GRPO القياسي بهامش كبير بينما يحتاج النموذج تدريجياً إلى جولات تحقق أقل، مما يشير إلى أنه يستوعب التصحيح الذاتي.
2026-07-25
الذكاء الاصطناعي متعدد الوسائط
نموذج بحجم 12 مليار معلمة يتفوق على آخر بحجم 90 مليارًا. عقيدة التوسع في خطر
Pixtral-12B يضاهي أو يتفوق على نماذج أكبر منه بسبعة أضعاف في المقاييس متعددة الوسائط، دون التضحية بأداء اللغة. تطلق ميسترال أيضًا معيارًا مفتوحًا جديدًا لتقييم الرؤية واللغة العملي، مما يتحدى فكرة أن الأكبر دائمًا أفضل.
2026-07-17