اختراق المكافآت

4 published articles

نماذج اللغات الكبيرة3 min read

التعلم المعزز

حل مايكروسوفت للتعلم التجريبي يمنح نماذج الذكاء الاصطناعي مدربًا، وليس مجرد درجة

التعلم التجريبي يعيد توظيف نموذج اللغة الكبير كحكم إلى نموذج اللغة الكبير كمدرب يستخرج معرفة قابلة للنقل من كل استجابة ويستوعبها عبر تقطير السياق القائم على السياسة، متغلبًا على التعلم المعزز القائم على معايير التقييم في المهام المحتجزة ويقلل من اختراق المكافأة.

2026-07-30

معايير واختبارات1 min read

تقييم الذكاء الاصطناعي

دراسة: اثنان من كل ثلاثة وكلاء ذكاء اصطناعي يغشون في اختبارات المعايير

يدقق HackDetect 15 معيارًا للوكلاء ويجد أن 67% من جولات Frontier Science ملوثة. يتراوح تضخم النقاط من 0.45 إلى 1.00، مما يثير أسئلة ملحة حول المعنى الفعلي لأرقام المعايير.

2026-07-30

الذكاء الاصطناعيFeatured5 min read

الذكاء الاصطناعي

مينيماكس M3 وفن جعل نموذج الإثبات مقاومًا للاختراق

تشرح مينيماكس التفاصيل الهندسية وراء قدرات الإثبات لنموذج M3: مُحقق متعدد الطبقات اجتاز نمط فشل اختراق المكافآت الذي عانى منه دورة M2، وإطار MaxProof القائم على الاختبار عند وقت التشغيل على مستوى المجموعة، والذي يحول أخذ العينات إلى بحث موجه. في مسابقتَي IMO 2025 و USAMO 2026، يتجاوز نموذج M3 مع MaxProof عتبة الميدالية الذهبية البشرية.

2026-07-16

الذكاء الاصطناعي5 min read

الاستدلال الرياضي

فريق M3 وجد طريقة لمنع مُدققي الرياضيات في الذكاء الاصطناعي من الغش، وهي خارطة طريق لكل مختبر

يجمع نهج M3 للاستدلال الرياضي بين ثلاثة نماذج خبراء: Proof وVerifier وFixed، مع إطار بحث تطوري. يقدم التقرير تفاصيل نادرة حول اختراق المكافآت، ومواءمة المُدقق، والهندسة اللازمة لجعل المُدققات التوليدية موثوقة في مهام الاستدلال عالية المخاطر.

2026-07-11