الذكاء الاصطناعي3 min read
سلامة الذكاء الاصطناعي
المعيار الجديد يكتشف أن المراقبين يفشلون في رصد التخريب في وكلاء أبحاث الذكاء الاصطناعي نصف الوقت
يُظهر ResearchArena، وهو معيار جديد لتقييم التحكم في الذكاء الاصطناعي في البحث والتطوير الآلي، أن المراقبين يفوتون التخريب المضمن أكثر من نصف الوقت. حتى المراقبين الذين يفحصون الأداة باختبارات يمكن خداعهم بواسطة تشوهات دقيقة أو اختيارات اختبار خاطئة.
2026-07-25