بيانات التدريب المسبق
2 published articles
الذكاء الاصطناعيFeatured3 min read
نزاهة الذكاء الاصطناعي
خط أنابيب الذكاء الاصطناعي لديه ثلاثة تسريبات صامتة، وكل إصلاح يزيد من سوء أحدها
دراسة تسميم بالتعليقات غير المرغوب فيها، وورقة بحثية تظهر أن كاشفات الذكاء الاصطناعي يمكن أن تأتي بنتائج عكسية، ونموذج كشف احتيال ضُبط وهو يستغل تسرب التصنيفات، كلها تصف نفس الفشل الأساسي: التدابير البديلة في خطوط أنابيب الذكاء الاصطناعي تُستغل بمجرد أن تصبح حاملة للأحمال، وإصلاح أحدها لا يصلح النمط.
2026-07-31
الذكاء الاصطناعي5 min read
سلسلة توريد الذكاء الاصطناعي
التسميم عبر التعليقات العامة لخوارزميات اللغة الكبيرة هو أمر عملي، تحذر دراسة جديدة
يُظهر باحثو جامعة واشنطن أن تسميم بيانات التدريب المسبق عبر البريد العشوائي للتعليقات الآلية هو تهديد واقعي. يُظهر تحليل HalfLife أن 0.13% من حقن السموم تنجو من خط أنابيب البيانات الكامل، وهو ما يكفي لتجاوز عتبات الهجوم المعروفة والتأثير على النماذج المُدرّبة على Common Crawl.
2026-07-26