الخَلع
2 published articles
Qwen / Alibaba5 min read
سلامة الذكاء الاصطناعي
Qwen3.8-27B المجرَّد من الحماية: الرفض ينخفض إلى 0% والمعايير بالكاد تتحرك
نسخة من Qwen3.8-27B مجرَّدة من الحماية ومكمَّمة بتقنية FP8 ترفض 0% من الاستفسارات الضارة على AdvBench، انخفاضًا من 99%، بينما تبقى المعايير العامة ضمن 1.3 نقطة. توثّق بطاقة النموذج الطريقة بتفصيل غير معتاد. والتحفظات تستحق القدر نفسه من الاهتمام.
2026-08-16
الذكاء الاصطناعيFeatured5 min read
الذكاء الاصطناعي المحلي
مفارقة النموذج غير الخاضع للرقابة: رفض أقل، سلامة أقل، ولماذا لا تزال الذكاء الاصطناعي المحلي مهمًا
اختبار خمسة نماذج لغوية كبيرة غير خاضعة للرقابة تُدار محليًا يُظهر أن عملية 'الإبادة' تقلل الرفض المفرط من 44% إلى الصفر تقريبًا دون التأثير على الاستدلال، لكن نفس التعديل ينهار رفض السلامة من 41.5% إلى 9.5%، لأن كلاهما يعتمد على نفس الاتجاه الداخلي. السبب الحقيقي لتشغيل نموذج غير خاضع للرقابة قد لا يكون ما تعتقده.
2026-07-19