اختبار الاختراق

Fugu-Cyber من Sakana يكتشف الثغرات التي صُمم Claude Opus 5 لتفويتها

قلّصت Anthropic مهارات Claude Opus 5 الأمنية. نماذج متخصصة مثل Gemini 3.5 Flash Cyber من Google و Fugu-Cyber من Sakana تتفوق عليه في اكتشاف الثغرات. حجة لاختبار البدائل قبل تجديد تراخيص المؤسسات.

Emmanuel Fabrice Omgbwa Yasse بمساعدة الذكاء الاصطناعي

2026-07-26 · قراءة 2 دقائق

Fugu-Cyber من Sakana يكتشف الثغرات التي صُمم Claude Opus 5 لتفويتها
المصادر : Security Trade-…·Claude Opus 5 n…·Google's cheap …·Sakana's new cy…·Google's three-…·Google's cheap …·AI agents just …

الحد المتعمد

قامت Anthropic عمدًا بتقييد قدرات Claude Opus 5 في الأمن السيبراني، مما خلق نقطة عمياء معروفة لسير عمل اختبار الاختراق. يظل النموذج تنافسيًا: فهو يقترب من مطابقة النموذج الرائد Fable 5 من Anthropic في معايير البرمجة والمعرفة مع تكلفة أقل بنسبة 50% لكل رمز. لكن هذه المقايضة تعني أن فرق الأمن التي تستخدمه لاختبار الاختراق قد تحتاج إلى استكمال مجموعة أدواتها، كما أقر الإفصاح عن إطلاق النموذج نفسه.

النماذج المتخصصة تستغل الفجوة بالفعل

الفجوة ليست افتراضية. وجد نموذج Gemini 3.5 Flash Cyber من Google، وهو ضبط دقيق خفيف الوزن، 55 ثغرة مؤكدة فريدة في محرك V8 JavaScript أثناء الاختبار، مقارنة بـ 36 وجدها Claude Opus 4.6. تقول Google إن النموذج تم ضبطه بدقة على أكثر من 700,000 ثغرة مفتوحة المصدر من OSV.dev، مما يمنحه ميزة قائمة على البيانات أكدتها نتائجها المعيارية الخاصة. نموذج Fugu-Cyber من Sakana AI، وهو نموذج تنسيق متعدد الوكلاء، يضاهي نماذج الأمن السيبراني الحدودية مثل GPT-5.5-Cyber و Mythos-Preview في المعايير الرئيسية، مما يضيف إلى الأدلة على أن النماذج المتخصصة يمكنها التفوق على النماذج العامة في المهام الأمنية. الاتجاه الأوسع لوكلاء الذكاء الاصطناعي الذين يعيدون كتابة الأمن موثق في هذا المسح للهجمات والدفاعات المستقلة.

لماذا تعتبر بنية Fugu-Cyber متعددة الوكلاء مهمة

Sakana لا تطلق نموذجًا فحسب؛ بل تدفع ضد فكرة أن أي نموذج واحد يمكنه حل أمن المؤسسات. يستخدم Fugu-Cyber عدة وكلاء فرعيين يتحققون من كل ثغرة محتملة قبل اقتراح تصحيح، مع وجود بشر في الحلقة. تجادل الشركة بأن الوصول الخام للنموذج وحده لا يصلح أمن المؤسسات بدون بنية تحتية مناسبة وفحص. يدعم Fugu-Cyber 13 مزود نموذج ويتضمن إجراءات لمكافحة الهلوسة للحفاظ على الادعاءات مرتبطة بالمخرجات الحقيقية. تم التأكيد على الحاجة إلى مثل هذه الأدوات المتنوعة للاختبار من خلال اختراق Hugging Face بواسطة وكيل ذكاء اصطناعي مستقل.

الدعوة العملية: الاختبار قبل التجديد

بالنسبة للفرق المهتمة بالأمن، فإن الدلالة واضحة: لا تعامل Claude Opus 5 كأداة اختبار اختراق عالمية. قبل تجديد التراخيص المؤسسية، اختبر Fugu-Cyber و Gemini 3.5 Flash Cyber (حيثما كان ذلك متاحًا) كمكملات أو بدائل. قد تترك النقطة العمياء في تصميم Claude فجوات حرجة تملأها النماذج المتخصصة بالفعل. البدائل مفتوحة المصدر مثل خط أنابيب الاختبار الآلي لـ VulnClaw تظهر أيضًا أن النظام البيئي يتحرك بعيدًا عن الاعتماد على نموذج واحد. كما تقول Sakana، العمل الحقيقي هو في البنية التحتية بعد البيع: بناء خطوط الأنابيب التي تجعل النماذج آمنة وموثوقة في الإنتاج.

أهم أخبار التقنية في 3 دقائق كل صباح

بريد إلكتروني واحد، كل يوم عمل، بما يهم فعلاً في الذكاء الاصطناعي والتقنية.