نموذج رؤية-لغة

4 published articles

الذكاء الاصطناعي5 min read

CARE-X للذكاء الاصطناعي الطبي

تمدد الأبهر الخفيف: 12% تُكتشف في القراءات الأولية، و93% مع نموذج لغوي بصري قائم على القياس

نادرًا ما يُكمَّم تمدد الأبهر على الأشعة السينية للصدر، وتُفوَّت الحالات الخفيفة: 5 من 43 في القراءات الأولية. نموذج لغوي بصري معزز بالأدوات رصد 40 حالة. أبحاث CARE-X الجديدة تشرح لماذا يحتاج ذكاء الاصطناعي الإشعاعي إلى مساطر، لا إلى عيون فقط.

2026-08-16

الذكاء الاصطناعي5 min read

الذكاء الاصطناعي

AutoVSR: إطار ذكاء اصطناعي يربط المخططات الدائرية بالتعبيرات الرمزية مع التحقق أولاً

يستخدم AutoVSR الإدراك البصري، وتمثيلاً وسيطاً قابلاً للتنفيذ، وحلولاً رمزية معززة بالأدوات لتحويل المخططات الدائرية بشكل موثوق إلى تعبيرات رمزية صالحة. تظهر التجارب عبر خمسة أنواع من الدوائر تفوقه على كل من نماذج VLM العامة والطرق المتخصصة، محققاً تحسينات في الدقة تتراوح بين 30 و59% و42 و52% على التوالي.

2026-08-04

الذكاء الاصطناعي3 min read

التعلم بالتعزيز

باحثون من ميتا وجامعة إلينوي في أوربانا-شامبين يدربون نماذج الرؤية واللغة على التحقق من عملهم وإعادة التفكير في الإجابات الخاطئة

يحول SVR-R1 الحكم الذاتي الثنائي لنموذج الرؤية واللغة إلى إشارة تعلم. تم اختباره على معايير تفكير الرسم البياني والجداول، ويتفوق على GRPO القياسي بهامش كبير بينما يحتاج النموذج تدريجياً إلى جولات تحقق أقل، مما يشير إلى أنه يستوعب التصحيح الذاتي.

2026-07-25

نماذج اللغات الكبيرة2 min read

الذكاء الاصطناعي متعدد الوسائط

نموذج بحجم 12 مليار معلمة يتفوق على آخر بحجم 90 مليارًا. عقيدة التوسع في خطر

Pixtral-12B يضاهي أو يتفوق على نماذج أكبر منه بسبعة أضعاف في المقاييس متعددة الوسائط، دون التضحية بأداء اللغة. تطلق ميسترال أيضًا معيارًا مفتوحًا جديدًا لتقييم الرؤية واللغة العملي، مما يتحدى فكرة أن الأكبر دائمًا أفضل.

2026-07-17