إصدار arXiv
4 published articles
أبحاث الذكاء الاصطناعي
Muon يفهم الجمع المعياري أسرع، ثم تنهار حلوله
محولات مدرَّبة بـ Muon تفهم الجمع المعياري أسرع من AdamW، ثم تفقد الحل في كل تشكيل اختُبر. الورقة تحدد الانهيار عند واجهة التمثيل والقراءة، حيث تجميد أي من مجموعتي المعاملات يمنعه. تحليل فورييه يُظهر أن دائرة المهمة تبقى حية وتُهزم ببساطة بالتصويت.
2026-08-19
فيشر-R1 | اختبار الفرضيات
وكلاء الذكاء الاصطناعي ينفذون الإحصاءات بدقة تامة ومع ذلك يصلون إلى استنتاجات خاطئة
يمكن للوكلاء الذين يؤتمتون اختبار الفرضيات تنفيذ التحليلات بدقة تامة ومع ذلك الوصول إلى استنتاجات خاطئة، لأن معظم المعايير لا تتحقق أبدًا مما إذا كانت القيمة الاحتمالية (p-value) صالحة. معيار من 425 مهمة يحدد حجم الفجوة، ونموذج مفتوح الأوزان مدرب بتعلّم التعزيز يقلص جزءًا منها.
2026-08-19
الذكاء الاصطناعي السريري
nMAS يؤتمت ميزات فشل القلب في السجلات الصحية الإلكترونية، واختُبر على 500 مريض وهمي فقط
ولّد nMAS، خط أنابيب متعدد الوكلاء، 132 ميزة بنيوية و70 ميزة مُقيَّمة وفق معايير من 500 سجل مريض وهمي، رافعًا AUROC للتنميط الظاهري لـ HFrEF على المجموعة المحجوزة من 0.895 إلى 0.963. لم يُتحقق من البحث الأولي على بيانات مرضى حقيقيين.
2026-08-13
أبحاث الذكاء الاصطناعي
جهاز تحكم صغير للمراقبة رفع درجات نماذج اللغة الكمية المضغوطة بمقدار 4.5 نقاط على اختبار MATH-500
يقترح بحث جديد جهاز تحكم خارجي للمراقبة للنماذج اللغوية الصغيرة المضغوطة، يكتشف مسارات الاستدلال المتكررة أو المتدهورة ويطلق عملية إعادة إلى الوراء وإعادة فك تشفير مقيدة. تحسنت الدقة بمقدار 4.5 نقطة مئوية على مجموعة تقييم واسعة، لكن المؤلفين يؤكدون أن النتائج ليست تأكيدية.
2026-07-30