الذكاء الاصطناعي مفتوح المصدر

Kimi K3 هو أكبر نموذج مفتوح على الإطلاق. لكنه ليس الأفضل بعد.

Kimi K3 هو أكبر نموذج مفتوح بـ 2.8 تريليون معامل، لكنه يفشل في التفوق على أفضل النماذج المملوكة في المعايير العامة. بينما يتفوق في مهام الترميز والوكالة المحددة، فإن الفجوة مع القادة الحدوديين مثل Claude Fable 5 و GPT 5.6 Sol تكشف حدود التوسع دون اختراقات معمارية وبياناتية.

Emmanuel Fabrice Omgbwa Yasse بمساعدة الذكاء الاصطناعي

2026-07-27 · قراءة 3 دقائق

Kimi K3 هو أكبر نموذج مفتوح على الإطلاق. لكنه ليس الأفضل بعد.
المصادر : Kimi K3 launch …·Seventnews inte…

Kimi K3 هو أكبر نموذج مفتوح حتى الآن، بـ 2.8 تريليون معامل، تم بناؤه بواسطة Moonshot AI بهندسة انتباه مبتكرة ونافذة سياق تبلغ مليون رمز. لكن رقمًا واحدًا في جدول معاييره يبرز أكثر من غيره: الأداء العام لا يزال متخلفًا عن Claude Fable 5 وGPT 5.6 Sol، حيث أن Claude Opus 5 تفوق مؤخرًا على أداء Fable بنصف التكلفة، وفقًا نتائج اختبارات Claude Opus 5. هذه الفجوة مهمة، ليس لأن K3 ضعيف (ليس كذلك)، ولكن لأنها تعقد السردية القائلة بأن النماذج المفتوحة تلحق بالركب.

أين يتفوق K3

يتصدر K3 في العديد من المعايير الفردية. في SWE Marathon، سجل 59.7، متقدمًا على Claude Fable 5 البالغ 57.4 وGPT 5.6 Sol البالغ 56.5. في Terminal-Bench 2.1، وصل K3 إلى 45.8، متغلبًا على جميع المنافسين المغلقين. يمنحه متغير BrowseComp ذو سياق مليون 89.5، مرة أخرى فوق المنافسة، كما يؤكد تحليل معيار بمعيار. تشير هذه الدرجات إلى نقاط قوة حقيقية في البرمجة طويلة الأفق، واستخدام الأدوات الذاتي، والبحث العميق على الويب. في المهام التي تتطلب تفكيرًا مستدامًا وتفاعلًا مع البيئات، غالبًا ما يتصدر K3، مما يعكس تقدمًا في كيفية تعامل النماذج مع التفاعل المستمر، وهو مجال أظهرت فيه تقنيات مثل تقطير SEED نتائج واعدة.

لكن في المعايير الشاملة مثل DeepSWE وProgram Bench وKCB 2.0، يقع K3 خلف أفضل النماذج المغلقة بعدة نقاط، وهو نمط يتوافق مع الملاحظة أنه حتى أفضل الوكلاء يسجلون 49٪ في مهام التصنيف المعقدة، كما أظهر معيار HSCodeComp. الصورة العامة هي تشتت من الانتصارات والخسائر، وليس انتصارًا واضحًا.

ماذا تخبرنا الهندسة المعمارية

القصة التقنية لـ K3 أكثر إثارة للاهتمام من الأرقام الرئيسية. Kimi Delta Attention وAttention Residuals هي ابتكارات حقيقية مصممة للتعامل مع الشبكات العميقة والتسلسلات الطويلة دون التدهور المعتاد. Stable LatentMoE ينشط 16 من أصل 896 خبيرًا، وطرق التدريب (Quantile Balancing وPer-Head Muon والتدريب الواعي بالتكميم باستخدام MXFP4) تعالج آلام التوسع الحقيقية التي واجهتها النماذج الكبيرة السابقة بشدة. هذه اختراقات هندسية يمكن أن تتسرب إلى مشاريع مفتوحة المصدر الأخرى، حتى لو لم يتصدر K3 نفسه كل لوحات الصدارة.

التسعير كاستراتيجية

تسعر Moonshot AI بشكل عدواني. تفرض واجهة برمجة تطبيقات Kimi 0.30 دولار لكل مليون رمز للإدخال مع إصابة ذاكرة التخزين المؤقت، و3.00 دولار للإدخال بدون إصابة، و15.00 دولار للإخراج. هذا يقلل من فئات الأسعار المماثلة من Anthropic وOpenAI. تدعي الشركة أن معدل إصابة ذاكرة التخزين المؤقت يتجاوز 90٪ في أعباء عمل البرمجة، بفضل بنية الاستدلال المفككة Mooncake. يعتمد التسعير على الاستدلال الفعال، وهو محور عمل حديث مثل حسابات الاستدلال المفتوح من Together AI. إلى جانب إصدار الأوزان المفتوحة المقرر في 27 يوليو 2026، يجعل التسعير K3 جذابًا للمؤسسات التي تريد نموذجًا بـ 2.8 تريليون معامل يمكنها فحصه واستضافته بنفسها.

ماذا يعني للحدود مفتوحة المصدر

تم بيع المجال سردية: النماذج المفتوحة تلحق بالركب. يتحدى K3 تلك السردية وجهاً لوجه. إنه أكبر نموذج مفتوح بهامش واسع، ومع ذلك لا يتفوق باستمرار على نماذج ذات معاملات أقل ولكن بيانات أفضل وتدريب لاحق. يشير ذلك إلى أن الفجوة لا تتعلق بالحوسبة وحدها. تنظيم البيانات وتقنيات المحاذاة وخطوط الأنابيب التدريبية الخاصة لا تزال تعطي النماذج المغلقة ميزة لا يمكن للحجم الخام محوها. تتعقد السردية أكثر بسبب حقيقة أن الطلب على النموذج المفتوح يرتفع، مع تعليق Ollama لخطتها المميزة بسبب حركة المرور، وائتلاف من 41 شركة يجادل بأن الذكاء الاصطناعي مفتوح الأوزان هو أفضل رهان لأمريكا. وفي الوقت نفسه، تعمل النماذج مفتوحة المصدر من الشرق على تآكل الميزة الأمريكية، كما يظهر في الاتجاه من الشرق.

K3 إنجاز جاد. إنه يثبت أن النماذج المفتوحة يمكنها الوصول إلى نطاق فئة 3 تريليونات مع الاستمرار في العمل بشكل موثوق، وهو إنجاز هندسي غير تافه. لكن نتائج المعايير تحذر أيضًا من افتراض أن عدد المعاملات هو وكيل للذكاء. الحدود هي أكثر من مجرد رقم.

أهم أخبار التقنية في 3 دقائق كل صباح

بريد إلكتروني واحد، كل يوم عمل، بما يهم فعلاً في الذكاء الاصطناعي والتقنية.