كمية FP8
2 published articles
Qwen / Alibaba5 min read
سلامة الذكاء الاصطناعي
Qwen3.8-27B المجرَّد من الحماية: الرفض ينخفض إلى 0% والمعايير بالكاد تتحرك
نسخة من Qwen3.8-27B مجرَّدة من الحماية ومكمَّمة بتقنية FP8 ترفض 0% من الاستفسارات الضارة على AdvBench، انخفاضًا من 99%، بينما تبقى المعايير العامة ضمن 1.3 نقطة. توثّق بطاقة النموذج الطريقة بتفصيل غير معتاد. والتحفظات تستحق القدر نفسه من الاهتمام.
2026-08-16
الذكاء الاصطناعي3 min read
الذكاء الاصطناعي
مكتبة الميغاكيرنل الجديدة من ألفا ألفا تقلل زمن استدلال نموذج الخبراء المختلط بنسبة 200%
تقوم Alpha-MoE بدمج عدة عمليات في نواة واحدة مستمرة لتحقيق مكاسب في سرعة الاستدلال تصل إلى 200% مقارنة بالنوى القائمة على تريتون في vLLM وSGLang، مستهدفة نماذج MoE بدقة FP8.
2026-07-09