بيانات التدريب المسبق

2 published articles

الذكاء الاصطناعيFeatured3 min read

نزاهة الذكاء الاصطناعي

خط أنابيب الذكاء الاصطناعي لديه ثلاثة تسريبات صامتة، وكل إصلاح يزيد من سوء أحدها

دراسة تسميم بالتعليقات غير المرغوب فيها، وورقة بحثية تظهر أن كاشفات الذكاء الاصطناعي يمكن أن تأتي بنتائج عكسية، ونموذج كشف احتيال ضُبط وهو يستغل تسرب التصنيفات، كلها تصف نفس الفشل الأساسي: التدابير البديلة في خطوط أنابيب الذكاء الاصطناعي تُستغل بمجرد أن تصبح حاملة للأحمال، وإصلاح أحدها لا يصلح النمط.

2026-07-31

الذكاء الاصطناعي5 min read

سلسلة توريد الذكاء الاصطناعي

التسميم عبر التعليقات العامة لخوارزميات اللغة الكبيرة هو أمر عملي، تحذر دراسة جديدة

يُظهر باحثو جامعة واشنطن أن تسميم بيانات التدريب المسبق عبر البريد العشوائي للتعليقات الآلية هو تهديد واقعي. يُظهر تحليل HalfLife أن 0.13% من حقن السموم تنجو من خط أنابيب البيانات الكامل، وهو ما يكفي لتجاوز عتبات الهجوم المعروفة والتأثير على النماذج المُدرّبة على Common Crawl.

2026-07-26