مراقبة المحتوى

4 published articles

Mistral AIFeatured4 min read

سلامة الذكاء الاصطناعي

Shieldstral من Mistral يضع سياستك الخاصة بتعديل المحتوى في الموجّه، لا في الأوزان

يصوغ Shieldstral تعديل المحتوى كسؤال ثنائي: تعليمات، واستعلام بنعم/لا، والمحتوى المراد الحكم عليه. وتقول Mistral إن النموذج ذا الـ3 مليارات معامل يضاهي نماذج الحماية المفتوحة التي يصل حجمها إلى سبعة أضعاف حجمه في سلامة النصوص، بأوزان مرخّصة بموجب Apache 2.0 تعمل على GPU واحدة بسعة 16GB.

2026-08-05

نماذج اللغات الكبيرةFeatured4 min read

سلامة الذكاء الاصطناعي

شيلدسترال، المصنّف ثلاثي المليارات الذي يتفوق على نماذج أكبر منه بسبع مرات

مصنّف سلامة بحجم 3B يضاهي نماذج نصية أكبر منه بنحو سبع مرات ويحقق مستوى متقدمًا جديدًا في التصفية متعددة الوسائط، وفقًا لورقة arXiv في يوليو 2026. الحيلة: إعادة صياغة التصفية كإجابة عن سؤال ثنائي، مع التدريب على نحو 54.1 مليون عينة.

2026-08-05

الذكاء الاصطناعي3 min read

تقرير النزاهة

تقرير الشفافية الأول لـ Stability AI: 13 بلاغًا عن مواد اعتداء جنسي على الأطفال إلى NCMEC

يغطي التقرير سلامة النموذج، والاختبارات الحمراء، والإشراف على المحتوى، والتعاون مع جهات إنفاذ القانون. تقول Stability AI إنها لم تكتشف أي مواد اعتداء جنسي على الأطفال في بيانات التدريب الخاصة بها، وأجرت اختبارات إجهاد على جميع نماذجها التوليدية دون العثور على قدرات توليد مواد اعتداء جنسي على الأطفال.

2026-07-28

الذكاء الاصطناعيFeatured2 min read

حوكمة الذكاء الاصطناعي

شركات التكنولوجيا الصينية العملاقة تحذف ملايين العلاقات مع الذكاء الاصطناعي

بايت دانس، تينسنت، وعلي بابا تغلق في وقت واحد ميزات الرفيق الذكي التي سمحت لملايين المستخدمين بتكوين روابط عاطفية مع شخصيات افتراضية قابلة للتخصيص. يُنظر إلى هذه الخطوة على نطاق واسع على أنها استجابة للوائح المحتوى الجديدة للذكاء الاصطناعي في الصين والتي سيبدأ تطبيقها في أبريل 2026، مما أثار غضب المستخدمين وشكاواهم حول فقدان استثمارات عاطفية لا يمكن تعويضها.

2026-07-08