إصدار arXiv

4 published articles

المختبرات والأبحاث4 min read

أبحاث الذكاء الاصطناعي

Muon يفهم الجمع المعياري أسرع، ثم تنهار حلوله

محولات مدرَّبة بـ Muon تفهم الجمع المعياري أسرع من AdamW، ثم تفقد الحل في كل تشكيل اختُبر. الورقة تحدد الانهيار عند واجهة التمثيل والقراءة، حيث تجميد أي من مجموعتي المعاملات يمنعه. تحليل فورييه يُظهر أن دائرة المهمة تبقى حية وتُهزم ببساطة بالتصويت.

2026-08-19

المختبرات والأبحاث3 min read

فيشر-R1 | اختبار الفرضيات

وكلاء الذكاء الاصطناعي ينفذون الإحصاءات بدقة تامة ومع ذلك يصلون إلى استنتاجات خاطئة

يمكن للوكلاء الذين يؤتمتون اختبار الفرضيات تنفيذ التحليلات بدقة تامة ومع ذلك الوصول إلى استنتاجات خاطئة، لأن معظم المعايير لا تتحقق أبدًا مما إذا كانت القيمة الاحتمالية (p-value) صالحة. معيار من 425 مهمة يحدد حجم الفجوة، ونموذج مفتوح الأوزان مدرب بتعلّم التعزيز يقلص جزءًا منها.

2026-08-19

وكلاء الذكاء الاصطناعي4 min read

الذكاء الاصطناعي السريري

nMAS يؤتمت ميزات فشل القلب في السجلات الصحية الإلكترونية، واختُبر على 500 مريض وهمي فقط

ولّد nMAS، خط أنابيب متعدد الوكلاء، 132 ميزة بنيوية و70 ميزة مُقيَّمة وفق معايير من 500 سجل مريض وهمي، رافعًا AUROC للتنميط الظاهري لـ HFrEF على المجموعة المحجوزة من 0.895 إلى 0.963. لم يُتحقق من البحث الأولي على بيانات مرضى حقيقيين.

2026-08-13

نماذج اللغات الكبيرة3 min read

أبحاث الذكاء الاصطناعي

جهاز تحكم صغير للمراقبة رفع درجات نماذج اللغة الكمية المضغوطة بمقدار 4.5 نقاط على اختبار MATH-500

يقترح بحث جديد جهاز تحكم خارجي للمراقبة للنماذج اللغوية الصغيرة المضغوطة، يكتشف مسارات الاستدلال المتكررة أو المتدهورة ويطلق عملية إعادة إلى الوراء وإعادة فك تشفير مقيدة. تحسنت الدقة بمقدار 4.5 نقطة مئوية على مجموعة تقييم واسعة، لكن المؤلفين يؤكدون أن النتائج ليست تأكيدية.

2026-07-30