SevenTnewS

الدفاع الإلكتروني

نموذج Fugu-Cyber من Sakana AI يحقق 86.9% في معايير الأمن لكنه يرى أن النماذج الخام ليست الحل

أصدرت Sakana AI نموذج Fugu-Cyber، وهو نموذج تنسيق متعدّد الوكلاء يطابق النماذج الإلكترونية الحدودية على المعايير. وتجادل الشركة بأن الوصول إلى النموذج الخام وحده لا يمكنه إصلاح أمن المؤسسات دون خبرة بشرية وسير عمل تحقق.

Emmanuel Fabrice Omgbwa Yasse بمساعدة الذكاء الاصطناعي

2026-07-21 · قراءة 5 دقائق

نموذج Fugu-Cyber من Sakana AI يحقق 86.9% في معايير الأمن لكنه يرى أن النماذج الخام ليست الحل
المصادر : Sakana AI offic…

يصل الجدل حول ما إذا كانت النماذج الحدودية جاهزة للدفاع عن الشبكات في الإنتاج إلى ذروة جديدة. من ناحية، يدفع البائعون السردية القائلة بأن الوصول إلى نموذج قادر هو الحل السحري لأمن المؤسسات. ومن ناحية أخرى، يشير الممارسون إلى حالات فشل النشر، والإيجابيات الخاطئة، وفجوات التكامل.

Sakana AI، المعروفة بنموذج التنسيق Fugu، أصدرت للتو نسخة مبنية خصيصًا للدفاع الإلكتروني. يحقق Fugu-Cyber 86.9% في CyberGym، وهو معيار يختبر قدرة الوكيل على تحليل قواعد الأكواد المعقدة والتحقق من الثغرات الأمنية الواقعية، و72.1% في CTI-REALM، الذي يقيس مدى قدرة النموذج على ترجمة معلومات التهديدات الخام إلى قواعد كشف قابلة للتطبيق. هذه النتائج تطابق النماذج الحدودية الإلكترونية الرائدة، GPT-5.5-Cyber وMythos-Preview من Anthropic.

الإعلان ليس مجرد إصدار معايير. إنه دفع معاير ضد ما تسميه Sakana بـ"إثارة الخوف" حول القدرات الإلكترونية للنماذج الحدودية.

نموذج التنسيق وراء المعايير

مثل Fugu الأصلي، Fugu-Cyber هو نظام متعدّد الوكلاء يظهر كنقطة نهاية API واحدة. يرسل المستخدم طلبًا، ويقوم النظام داخليًا بتشغيل وكلاء متخصصين لمهام فرعية مختلفة. هذا التصميم يهدف إلى تجنب الاعتماد على بائع واحد مع الاستمرار في تقديم مخرجات تبدو وكأنها من نموذج واحد.

Sakana تجعل API متاحًا بموجب خطة رمزية مع بوابة للتحكم في الوصول: يجب على المستخدمين المهتمين تقديم نموذج طلب يشرح فيه حالة الاستخدام الخاصة بهم ويقدمون تفاصيل اتصال موثقة، والتي تراجعها الشركة يدويًا قبل منح الوصول. تحظر سياسة الاستخدام المقبولة المحدثة إساءة الاستخدام الهجومية.

فحص الواقع الذي تريد Sakana أن تخوضه الصناعة

تعليقات Sakana الخاصة تقوض السهولة الظاهرية. تستشهد الشركة بتقرير حديث من Nikkei Digital Governance وجد أن المؤسسات المالية اليابانية الكبيرة غالبًا ما تواجه صعوبة في تشغيل النماذج الحدودية، حتى تلك التي تتمتع باستدلال إلكتروني متطور. وبدون مواهب داخلية متخصصة وتكامل عميق في الشفرة الخاصة، خلص التقرير إلى أن النموذج القادر وحده لا يكشف أو يصحح الثغرات بشكل موثوق.

مخطط: سير عمل نشر Fugu-Cyber
يستخدم Fugu-Cyber من Sakana نظامًا متعدّد الوكلاء مع مراجعة بشرية وتكامل مؤسسي لسد الفجوة بين قدرة المعيار وموثوقية الإنتاج، كما هو موصوف في المقال.

يصدى فريق المؤسسات التطبيقية في Sakana بهذا الدرس من عمله الخاص مع مؤسسات يابانية كبرى. النماذج الخام، المنشورة بمعزل عن الآخرين، تولد إيجابيات خاطئة. تفتقد سياق بيئات الإنتاج الحية. تحتاج إلى أدوات تسخير وسير عمل تحقق.

"API قوي مع استدلال إلكتروني قوي هو قطعة مهمة بشكل لا يصدق من اللغز. إنه ليس الحل الكامل،" تكتب الشركة في إصدارها.

هذا التأطير ملحوظ لأنه يأتي من مزود نموذج نفسه. معظم البائعين سيتوقفون عند نتائج المعايير. بدلاً من ذلك، تصف Sakana العمل بعد البيع: بناء البنية التحتية المتخصصة لجعل النموذج آمنًا وموثوقًا في الإنتاج، بما في ذلك البشر في الحلقة والوكلاء الفرعيين الذين يتحققون من كل ثغرة محتملة قبل اقتراح تصحيح.

الفجوة المؤسسية

التوتر بين قدرة النموذج وقابلية النشر ليس جديدًا. أظهرت تقييمات الأمن الإلكتروني لـ GPT-5.5 من OpenAI قفزة كبيرة في القدرة على اكتشاف الثغرات، لكن التأثير العملي لهذه المكاسب يعتمد كليًا على كيفية دمج المؤسسة للنموذج في خطوط الكشف والاستجابة الحالية. وجد اختبار الاختراق لـ Gemma 4 من Google DeepMind أيضًا أنه حتى النموذج القوي يتطلب فحصًا خاصًا بالمجال قبل أن يمكن الوثوق به في البيئات الحساسة.

تحاول Sakana فعليًا تقصير دورة الضجيج النموذجية بوضع Fugu-Cyber كقطعة واحدة من حل مؤسسي أكبر، وليس كمنتج مستقل. القيمة الحقيقية، كما تجادل الشركة، تأتي من الجمع بين استدلال النموذج مع خبرة أمنية محلية عميقة وسير عمل تحقق صارمة.

ما تقيسه المعايير فعليًا

يستهدف CyberGym وCTI-REALM قدرتين متميزتين مهمتين للدفاع الإلكتروني. يختبر CyberGym ما إذا كان الوكيل يمكنه فهم قاعدة الأكواد بدقة كافية للتحقق من أنماط الثغرات المعروفة، وهي مهمة تتطلب فهمًا واسعًا للشفرات ومعرفة أمنية محددة. يختبر CTI-REALM الاتجاه الآخر: بالنظر إلى تقرير معلومات التهديدات المكتوب للمحللين البشريين، هل يمكن للنموذج توليد قاعدة كشف يمكن للنظام تشغيلها فعليًا؟

كلتا المهمتين متعددة الخطوات وتتطلبان استدلالًا يتجاوز مطابقة الأنماط. درجة في السبعينيات المنخفضة أو الثمانينيات العالية على هذه المعايير هي نتيجة جادة.

لكن فحص الواقع الخاص بـ Sakana يشير إلى أن درجات المعايير، حتى القوية منها، هي شرط ضروري للدفاع الإلكتروني الفعال، وليس شرطًا كافيًا. الفجوة بين معدل نجاح المعيار والنشر الموثوق في الإنتاج لا تزال واسعة بما يكفي لدرجة أن Sakana أنشأت فريق مؤسسات بأكمله لسدها.

حجة السيادة

تربط الشركة أيضًا منهجها بـ "السيادة على الذكاء الاصطناعي،" وهو مصطلح يتردد صداه بشكل خاص في الأسواق حيث المؤسسات حذرة من الاعتماد على النماذج الحدودية المملوكة لأجانب للبنية التحتية الأمنية. من خلال تنسيق نماذج متعددة في نظام موحد ونشرها من خلال الخبرة المحلية، تضع Sakana Fugu-Cyber كوسيلة للحفاظ على سير العمل الحساس داخل الحدود الموثوقة.

هذه الحجة ستلقى صدى جيدًا في اليابان، حيث مقر Sakana وحيث تحدث عمليات النشر المؤسسية الأولى لها.

الخلاصة

Fugu-Cyber هو نموذج استدلال إلكتروني قادر حقًا مع نتائج معايير تضعه في نفس المستوى مع عروض OpenAI وAnthropic. لكن الدفع المعاير المصاحب ضد سردية "النموذج سيصلح الأمن" غير معتاد ومرحب به. Sakana تخبر عملاءها أساسًا أن النموذج وحده ليس كافيًا، وأنهم بحاجة إلى الأشخاص المناسبين، والعمليات، وعمل التكامل لجعله مفيدًا.

ما إذا كانت بقية الصناعة ستتبع هذا التوجه، أو ستستمر في بيع الوصول إلى النماذج الحدودية كحل قائم بذاته، سيحدد مقدار هذه القدرة الذي سيصل فعليًا إلى شبكات الإنتاج.

أهم أخبار التقنية في 3 دقائق كل صباح

بريد إلكتروني واحد، كل يوم عمل، بما يهم فعلاً في الذكاء الاصطناعي والتقنية.