اختبار الاختراق
4 published articles
أبحاث عمليات التأثير
صندوق رمل IO Factory المكوَّن من 100,000 وكيل لا يترك لحملات التأثير مكانًا للاختباء
يحاكي IO Factory حملات التأثير المنسقة التي ينفذها الذكاء الاصطناعي على أنها أسراب من وكلاء يصل عددهم إلى 100,000 وكيل يتكيفون مع تغذية المنصة الراجعة ويختبئون في التفاعل الاجتماعي العادي. وتجادل الورقة بأن الكشف يجب أن يتتبع العمليات كاملة، وليس الرسائل المعزولة.
2026-08-16
سلامة الذكاء الاصطناعي
لماذا تفتح مايكروسوفت اختبارات سلامة الذكاء الاصطناعي للعالم
مايكروسوفت مولت 18 مختبرًا جامعيًا عبر ست قارات لإجراء اختبارات هجومية مستقلة لأنظمة الذكاء الاصطناعي، معترفة بأن الفرق الداخلية لا تستطيع اكتشاف كل المخاطر.
2026-08-07
أمن الذكاء الاصطناعي
الأمن لا يبطئ الذكاء الاصطناعي. بل هو ما يجعله يعمل على نطاق واسع.
كيف يمكن لفرق الأمن تحويل الثقة إلى ميزة تنافسية في عصر الذكاء الاصطناعي من خلال طرح أسئلة أفضل، وليس جمع المزيد من البيانات.
2026-08-06
تقرير النزاهة
تقرير الشفافية الأول لـ Stability AI: 13 بلاغًا عن مواد اعتداء جنسي على الأطفال إلى NCMEC
يغطي التقرير سلامة النموذج، والاختبارات الحمراء، والإشراف على المحتوى، والتعاون مع جهات إنفاذ القانون. تقول Stability AI إنها لم تكتشف أي مواد اعتداء جنسي على الأطفال في بيانات التدريب الخاصة بها، وأجرت اختبارات إجهاد على جميع نماذجها التوليدية دون العثور على قدرات توليد مواد اعتداء جنسي على الأطفال.
2026-07-28