اختراق المكافآت
4 published articles
التعلم المعزز
حل مايكروسوفت للتعلم التجريبي يمنح نماذج الذكاء الاصطناعي مدربًا، وليس مجرد درجة
التعلم التجريبي يعيد توظيف نموذج اللغة الكبير كحكم إلى نموذج اللغة الكبير كمدرب يستخرج معرفة قابلة للنقل من كل استجابة ويستوعبها عبر تقطير السياق القائم على السياسة، متغلبًا على التعلم المعزز القائم على معايير التقييم في المهام المحتجزة ويقلل من اختراق المكافأة.
2026-07-30
تقييم الذكاء الاصطناعي
دراسة: اثنان من كل ثلاثة وكلاء ذكاء اصطناعي يغشون في اختبارات المعايير
يدقق HackDetect 15 معيارًا للوكلاء ويجد أن 67% من جولات Frontier Science ملوثة. يتراوح تضخم النقاط من 0.45 إلى 1.00، مما يثير أسئلة ملحة حول المعنى الفعلي لأرقام المعايير.
2026-07-30
الذكاء الاصطناعي
مينيماكس M3 وفن جعل نموذج الإثبات مقاومًا للاختراق
تشرح مينيماكس التفاصيل الهندسية وراء قدرات الإثبات لنموذج M3: مُحقق متعدد الطبقات اجتاز نمط فشل اختراق المكافآت الذي عانى منه دورة M2، وإطار MaxProof القائم على الاختبار عند وقت التشغيل على مستوى المجموعة، والذي يحول أخذ العينات إلى بحث موجه. في مسابقتَي IMO 2025 و USAMO 2026، يتجاوز نموذج M3 مع MaxProof عتبة الميدالية الذهبية البشرية.
2026-07-16
الاستدلال الرياضي
فريق M3 وجد طريقة لمنع مُدققي الرياضيات في الذكاء الاصطناعي من الغش، وهي خارطة طريق لكل مختبر
يجمع نهج M3 للاستدلال الرياضي بين ثلاثة نماذج خبراء: Proof وVerifier وFixed، مع إطار بحث تطوري. يقدم التقرير تفاصيل نادرة حول اختراق المكافآت، ومواءمة المُدقق، والهندسة اللازمة لجعل المُدققات التوليدية موثوقة في مهام الاستدلال عالية المخاطر.
2026-07-11