الذكاء الاصطناعي الحدودي

أذكى نماذج Claude من Anthropic هو النموذج الذي لا يمكنك استخدامه

أطلقت Anthropic نموذج Claude Fable 5 للجميع وأبقت Claude Mythos 5 للشركاء الموثوقين. فئة النماذج نفسها، وبابا وصول مختلفان. المعايير أقل أهمية من آلية التوجيه، والتوجيه هو الطريقة التي ستُطرح بها نماذج الذكاء الاصطناعي الحدودية من الآن فصاعدًا.

Emmanuel Fabrice Omgbwa Yasse بمساعدة الذكاء الاصطناعي

2026-08-03 · قراءة 5 دقائق

أذكى نماذج Claude من Anthropic هو النموذج الذي لا يمكنك استخدامه

أعلنت Anthropic عن نموذجَي Claude 5 في 9 يونيو 2026. فئة النماذج الأساسية نفسها، منتجان، وبابان.

Claude Fable 5 هو النموذج العام، بسعر 10 دولارات لكل مليون رمز إدخال و50 دولارًا لكل مليون رمز إخراج. أما Claude Mythos 5 فمقصور على شركاء مشروع Glasswing والمتعاونين الحكوميين وبرامج الوصول الموثوق المستقبلية. تضع البيانات التي رصدتها BenchLM النموذجين في صدارة نماذج Anthropic الحالية، متقدمين على Claude Opus 4.8 ومجموعة نماذج GPT وGemini المحيطة. النتائج هي الجزء السهل. الجزء المثير للاهتمام هو ما بنته Anthropic حول النموذج.

قبل شهرين، كانت هذه الفئة من النماذج أقوى من أن تُطرح على نطاق واسع. Anthropic قالت ذلك بنفسها. والآن صدرت على أي حال، بشكل لا تصل إليه بعض الطلبات أبدًا. يحتفظ Fable 5 بضمانات أمان في مجالات الأمن السيبراني والأحياء والكيمياء وعمل التقطير؛ وفي بعض عملاء Claude تُوجَّه الطلبات عالية الخطورة إلى Claude Opus 4.8، وفي Messages API تُحظر هذه الطلبات ما لم يختر المطور آلية الاحتياط. تقول Anthropic إن التوجيه يجب أن يمس أقل من 5% من الجلسات. المنتج العام لم يعد نموذجًا. إنه نموذج بالإضافة إلى مصنّف وسياسة توجيه وآلية احتياط ونظام وصول. الذكاء الاصطناعي الحدودي، كما ورد في تحليلنا للإطلاق، يتحول إلى توجيه للقدرات بدلًا من نقطة وصول واحدة شاملة.

منتجان، فئة نماذج واحدة

تصف Anthropic نموذج Fable 5 بأنه نموذج من فئة Mythos جُعل آمنًا للاستخدام العام، وهو الأقوى في هندسة البرمجيات والعمل المعرفي والرؤية الحاسوبية والبحث العلمي والمهام الطويلة. يُطرح باسم claude-fable-5 عبر Claude API وأسواق السحابة الكبرى بما في ذلك Amazon Web Services وGoogle Cloud وMicrosoft Foundry. تحصل رموز الإدخال المخزنة مؤقتًا على خصم 90%؛ ويعمل الاستدلال المقتصر على الولايات المتحدة بسعر 1.1 ضعف السعر المعلن.

Mythos 5، بحسب رواية Anthropic، هو النموذج الأساسي نفسه مع رفع بعض القيود للمستخدمين الموثوقين. الفرق في طريقة النشر، لا في الذكاء.

المنتجالقدرةالوصولالموقف الأمني
Claude Fable 5فئة Mythosتوافر عامضمانات أمان مع احتياط أو حظر
Claude Mythos 5فئة Mythosوصول موثوق للمتحقق منهمرفع بعض القيود للعمل الحساس

لسنوات، كان اسم النموذج يوحي بسطح قدرات موحد. Fable وMythos يكسران هذه القاعدة. الذكاء نفسه يظهر الآن كمنتجات متعددة بسياسات مختلفة، والتوجيه جزء من الإطلاق.

ماذا تُظهر المعايير في الواقع

أرفقوا تحفظًا واحدًا بكل صف أدناه: معظم النتائج منشورة من Anthropic، والتغطية المستقلة من طرف ثالث ضعيفة في اليوم الأول. تعاملوا مع الأرقام بجدية، لا على أنها نهائية.

النموذجالإجماليSWE-bench VerifiedSWE-bench ProTerminal-Bench 2.1OSWorld-Verifiedسعر الإدخال/الإخراج
Claude Mythos 59995.580.388.085.0مقيد
Claude Fable 59695.080.084.385.0$10/$50
Claude Opus 4.89388.669.274.683.4$5/$25
Gemini 3.1 Pro9075727776.2$2/$12
GPT-5.589-58.68278.7$5/$30

نتيجة SWE-bench Verified البالغة 95.5 و95.0 قريبة من سقف مجموعة أدوات البرمجة العامة الحالية. أما SWE-bench Pro فهو الصف الأكثر دلالة لأنه أصعب وأقل تشبعًا. يُظهر Terminal-Bench 2.1 تكلفة طبقة الضمانات الأمنية: يبلغ Mythos 88.0، بينما يبلغ Fable العام 84.3. ويتعادل النموذجان في OSWorld-Verified عند 85.0.

الفجوات المهمة هي تلك المتعلقة بالأنظمة الوكيلة. تطرح SWE-bench Pro وTerminal-Bench وOSWorld السؤال نفسه: هل يستطيع النموذج إبقاء مشروع فوضوي متحركًا عندما يتطلب النجاح الكثير من الخيارات الصغيرة؟ هنا تتمتع أنظمة فئة Fable بهامش تفوق حقيقي على بقية المجموعة.

من ضبط النفس في أبريل إلى التوجيه في يونيو

في أبريل، كانت قصة Mythos قصة ضبط النفس. تفوق النموذج على Claude Opus 4.6 بهوامش واسعة في معايير البرمجة والمعايير الوكيلة، واختارت Anthropic عدم إطلاقه. كانت الأسباب عملية. النموذج العام الجيد في البرمجة والاستدلال واستخدام الأدوات جيد أيضًا في اكتشاف الثغرات، وبمجرد أن يصبح النموذج جيدًا بما يكفي، لا يوجد خط واضح يفصل بين البحث الدفاعي والبحث الهجومي.

Fable 5 هو إجابة Anthropic. فبدلًا من انتظار ضمانات أمان مثالية، قسّمت عملية النشر. الخطر لم يختفِ. لقد انتقل إلى بنية المنتج. تقسيم أقوى نموذج إلى قسمين يغيّر طريقة نشر الذكاء الاصطناعي، وAnthropic ليست وحدها: عرضت OpenAI نماذج GPT-5.6 Sol وTerra وLuna بنصف السعر، مقتصرة على نحو 20 شريكًا معتمدًا من الحكومة. الفجوة البالغة 17 يومًا بين الإطلاقين هي القراءة الأوضح لاتجاه سوق 2026.

قصة الاستقلالية تحت النماذج

أهم ادعاءات Fable ليست حول الدردشة. إنها حول العمل طويل الأمد. يستشهد إعلان إطلاق Anthropic بشركة Stripe، قائلًا إن Fable ساعد في ترحيل قاعدة كود Ruby مكونة من 50 مليون سطر في يوم واحد تقريبًا مقابل تقدير يدوي داخلي بنحو شهرين. الحكايات الواردة من البائعين تستحق التشكك؛ فهي منتقاة لتحقيق أقصى تأثير. ومع ذلك، فإن الاتجاه ما زال متسقًا مع ملف المعايير.

مقال Ethan Mollick عن الوصول المبكر على One Useful Thing يُظهر ما يعنيه هذا التحول عمليًا. اختبر Fable خارج مجال الأمن السيبراني. بنى النموذج ألعابًا قابلة للعب من أوامر غامضة، مولّدًا فنونًا وأصولًا ثلاثية الأبعاد من الكود والرياضيات لعدم توفر مولّد صور. أنتج خريطة isochrone عبر إرسال وكلاء فرعيين لجمع جداول الرحلات وبيانات السكك الحديدية وسرعات الطرق بينما واصل هو البرمجة. عمل لمدة تسع ساعات ونصف متواصلة لبناء Concord، أداة معايرة للأحكام البشرية وأحكام الذكاء الاصطناعي عبر مجموعات بيانات بحثية. لم تكن النتيجة مثالية، ووجد Mollick أخطاء وثغرات. لكن النطاق تجاوز ما رآه من النماذج السابقة، ووصف التنظيف اللاحق بأنه عمل يمكن لمهندس إنجازه بدلًا من مشروع يُتخلص منه.

سير العمل يتغير مع هذا. يتوقف الخبير عن الإشراف على كل خطوة ويبدأ في تكليف العمل ومراجعة الناتج وتصحيح النتيجة. أقوى مخاوف Mollick هو ثمن ذلك: كلما طالت مدة التشغيل، قلّت رؤية العملية. مئات الخيارات الصغيرة تحدث بينما لا يراقبها أحد، ثم تنطبع في الناتج. النموذج يكتسب نفوذًا. لكن الإنسان ما زال يتحمل العواقب.

بالنسبة للمشترين، يتحول المقياس من الدولارات لكل مليون رمز إلى التكلفة لكل مهمة مكتملة ومُراجعة. النموذج الذي يبلغ سعره ضعف سعر الرموز ما زال قادرًا على الفوز إذا احتاج إلى عدد أقل من إعادة المحاولة وإصلاح بشري أقل. بالنسبة للجميع، القراءة الهيكلية أكثر أهمية. النموذج أصبح أفضل. الحدود حوله أصبحت أكثر أهمية. معظم المستخدمين لن يلمسوا Claude Mythos 5 أبدًا؛ سيحصلون على نسخة موجَّهة ومحمية من الذكاء نفسه، والعمل داخل تلك الحدود أصبح الآن جزءًا من استخدام النماذج الحدودية.

أهم أخبار التقنية في 3 دقائق كل صباح

بريد إلكتروني واحد، كل يوم عمل، بما يهم فعلاً في الذكاء الاصطناعي والتقنية.