تقرير النزاهة

تقرير الشفافية الأول لـ Stability AI: 13 بلاغًا عن مواد اعتداء جنسي على الأطفال إلى NCMEC

يغطي التقرير سلامة النموذج، والاختبارات الحمراء، والإشراف على المحتوى، والتعاون مع جهات إنفاذ القانون. تقول Stability AI إنها لم تكتشف أي مواد اعتداء جنسي على الأطفال في بيانات التدريب الخاصة بها، وأجرت اختبارات إجهاد على جميع نماذجها التوليدية دون العثور على قدرات توليد مواد اعتداء جنسي على الأطفال.

Emmanuel Fabrice Omgbwa Yasse بمساعدة الذكاء الاصطناعي

2026-07-28 · قراءة 3 دقائق

تقرير الشفافية الأول لـ Stability AI: 13 بلاغًا عن مواد اعتداء جنسي على الأطفال إلى NCMEC
المصادر : Stability AI's …·Stability AI Br…·Stability AI an…

نشرت Stability AI تقرير الشفافية السنوي الأول للنزاهة في يوليو 2025، ويغطي الفترة من أبريل 2024 إلى أبريل 2025. تكشف الوثيقة، المنشورة على صفحة سلامة الطفل بالشركة، عن عدد بلاغات مواد الاعتداء الجنسي على الأطفال (CSAM) المُرسلة إلى NCMEC، ومقاييس برنامج الاختبارات الحمراء، والضمانات المضمنة في نماذج الصور والفيديو والصوت ثلاثية الأبعاد الخاصة بها.

الرقم الرئيسي هو 13 بلاغًا إلى NCMEC. تقول الشركة إنه ربما تم تقديم بلاغات متعددة لنفس المستخدم عندما تم اكتشاف أكثر من محاولة تحميل صورة واحدة. لم يتم العثور على مواد اعتداء جنسي على الأطفال في مجموعات بيانات التدريب الخاصة بالشركة خلال فترة التقرير، كما لم تُظهر أي من نماذج الذكاء الاصطناعي التوليدية لديها قدرات توليد مواد اعتداء جنسي على الأطفال أو مواد استغلال جنسي للأطفال بعد اختبارات الإجهاد. ويشير التقرير أيضًا إلى أنه لم تصل أي بلاغات عن مواد اعتداء جنسي على الأطفال مقدمة من المستخدمين إلى Stability AI.

طبقة أمان متعددة المستويات

رسم تخطيطي: Stability AI Safety Stack
يقوم نهج الأمان متعدد الطبقات لـ Stability AI بتصفية بيانات التدريب، ومنع سوء الاستخدام على مستوى النموذج والنظام الأساسي، وفرض سياسات الاستخدام المقبولة، مما أسفر عن 13 بلاغًا عن مواد اعتداء جنسي على الأطفال إلى NCMEC وفقًا لتقرير الشفافية الصادر في يوليو 2025.

يعتمد نهج الأمان في Stability AI على ثلاث طبقات: تصفية بيانات التدريب، ومنع إساءة الاستخدام على مستوى النموذج والنظام الأساسي، وفرض سياسة الاستخدام المقبولة. تُستمد بيانات التدريب من مجموعات البيانات المفتوحة والمواقع الإلكترونية المتاحة للعموم والشركاء الخارجيين والبيانات الاصطناعية المولدة من قبل الباحثين. تقول الشركة إنها تستخدم مصنفات المحتوى غير الآمن للعمل (NSFW) الداخلية ومفتوحة المصدر، بالإضافة إلى قوائم التجزئة الصناعية لمواد الاعتداء الجنسي على الأطفال من Safer التابعة لـ Thorn ومؤسسة مراقبة الإنترنت، لتصفية بيانات التدريب مسبقًا. لم يتم الكشف عن أي مواد اعتداء جنسي على الأطفال.

على مستوى واجهة برمجة التطبيقات للنظام الأساسي، تقوم Stability AI بتشغيل مرشحات ومصنفات محتوى في الوقت الفعلي تمنع المدخلات والمخرجات المخالفة للسياسة، وتدمج تجزئة مواد الاعتداء الجنسي على الأطفال من Thorn لاكتشاف ومنع المواد المعروفة. على مستوى النموذج، تطبق الشركة ضبطًا دقيقًا ونماذج LoRA للسلامة تستند إلى اختبارات حمراء منظمة. غطت الاختبارات الحمراء 100% من نماذج الذكاء الاصطناعي التوليدية للشركة. كما تعاونت الشركة مع فريق الاستخبارات السرية على الإنترنت لمكافحة الاستغلال الجنسي للأطفال (OCCIT)، وهو وحدة إنفاذ قانون بريطانية، لاختبار نموذج Stable Diffusion 3 الخاص بها قبل الإصدار، ولم تجد أي قدرات لتوليد مواد اعتداء جنسي على الأطفال.

فجوات الإثبات

يقر التقرير بأن إثبات المحتوى عبر بيانات C2PA الوصفية يتم تنفيذه فقط للصور والفيديو والصوت المُنتَج عبر واجهة برمجة التطبيقات (تنسيق wav المستخدم للمؤثرات الصوتية ونغمات الآلات الموسيقية، والتي تقول الشركة إنها لا تحمل أي خطر لمواد استغلال جنسي للأطفال). لا تتضمن النماذج المُصدرة علنًا علامات C2PA. تقول الشركة إنها واجهت تحديات مع حلول العلامات المائية غير القائمة على C2PA التي أدت إلى تدهور جودة الصورة الناتجة، وتواصل استكشاف أساليب أكثر فعالية.

"لم يتم تطبيق إثبات المحتوى أثناء عملية توليد المحتوى لنماذجنا المُصدرة علنًا. هذه مجالات تتطلب مزيدًا من العمل لتعزيز الإثبات وإمكانية التتبع عبر أنظمتنا."

الشراكات والنظرة المستقبلية

بالإضافة إلى تقرير الشفافية، وسعت Stability AI بصمتها التجارية. أطلقت الشركة مجموعة خدمات الصور الخاصة بها على Amazon Bedrock، مما جلب أدوات مثل Inpaint وErase وRemove Background وStyle Transfer إلى بنية AWS التحتية. كما أعلنت عن شراكة استراتيجية مع Electronic Arts لتطوير نماذج الذكاء الاصطناعي التوليدية وسير العمل لتطوير الألعاب، بدءًا بتسريع إنشاء مواد PBR والتصور المسبق للبيئات ثلاثية الأبعاد من التعليمات النصية.

يقول التقرير نفسه إن الشركة تراقب التطورات التنظيمية وتخطط لمواءمة ممارساتها مع أطر الذكاء الاصطناعي المسؤولة الناشئة.

أهم أخبار التقنية في 3 دقائق كل صباح

بريد إلكتروني واحد، كل يوم عمل، بما يهم فعلاً في الذكاء الاصطناعي والتقنية.