ذكاء اصطناعي مفتوح المصدر

Boris-2 يغذّي نموذجه 125M بـ90 مليار توكن، بينما يحصل نموذجه 250M على 60 مليارًا فقط

يعلن Boris-2 مسبقًا عن ثلاثة نماذج صغيرة بميزانيات توكن غير متوازنة: يحصل نموذج 125M على 90 مليار توكن، بينما يحصل 250M على 60 مليارًا فقط. يمتد التدريب من 12 أغسطس إلى 10 سبتمبر، دون مشاركة أي معايير قياس، فقط الطموح المعلن للوصول إلى قوة SmolLM2-135M.

Emmanuel Fabrice Omgbwa Yasse بمساعدة الذكاء الاصطناعي

2026-08-16 · قراءة 3 دقائق

Boris-2 يغذّي نموذجه 125M بـ90 مليار توكن، بينما يحصل نموذجه 250M على 60 مليارًا فقط

Boris-2 غير موجود بعد، ومنشور الإعلان مرتاح لذلك. وضع المشروع خططًا لثلاثة نماذج صغيرة، هي 75M و125M و250M، بنوافذ تدريب تمتد من 12 أغسطس إلى 10 سبتمبر، وميزانيات توكن تبدو وكأن أحدهم توقف عن فرزها حسب الحجم.

الرقم الذي يلفت الانتباه هو الأوسط. من المقرر أن يتدرب نموذج 125M على 90 مليار توكن، أي نحو مرة ونصف مقارنة بالـ60 مليارًا المخطط لها لنموذج 250M. يرد المنشور على السؤال الواضح قبل أن يُطرح. يقول: «الجواب المباشر هو الوقت». تدريب نموذج أكبر يستهلك وقتًا أطول، ويتوقع المشروع أن يتفوق نموذج 250M على أي حال بفضل السعة الخام.

حسابات التوكن خلف ميزانية الـ90 مليارًا لنموذج 125M

حوّل هذه الميزانيات إلى توكنات لكل معامل، يصبح التوزيع أكثر إثارة للاهتمام. يمر نموذج 75M بنحو 347 توكنًا لكل معامل من أصل إجمالي 26 مليارًا، ونموذج 125M بنحو 720، و250M بـ240 فقط. يحصل النموذج الأوسط على الحصة الأكبر، و250M على الأقل، مع بقاء 75M في المنتصف. هذا مقصود. يوضح المنشور: «إنه يوفر الوقت، مع السماح لنموذج 250M بتجاوز نموذج 125M».

النموذجالمعاملاتتوكنات التدريبتوكن لكل معاملالبدء المتوقع
Boris-2-75M75M26B~34712 أغسطس
Boris-2-125M125M90B72020 أغسطس
Boris-2-250M250M60B24010 سبتمبر
BananaMind 2 Micro (مرجعي)2.9M75B~25,9003 أغسطس

مشروع آخر للنماذج الصغيرة، BananaMind، يدفع النسبة بقوة أكبر بكثير في النافذة الزمنية نفسها. يضم BananaMind 2 Micro 2.9 مليون معامل وميزانية توكن تبلغ 75 مليارًا، أي نحو 25,900 توكن لكل معامل، على حد تعبير الفريق: «للحصول على أقصى ذكاء لكل معامل». أثقل نسبة لدى Boris-2، وهي 720، لا تقترب من تلك الكثافة، لذلك يعتمد طرح المشروع نفسه على «البنية الفريدة ونظام الطبقات» الذي يقول إنه يحاول تنفيذه.

هدف يسنده الأمل لا المعايير

ما يقدمه Boris-2 كمعيار مرجعي هو فئة النماذج مفتوحة المصدر بحجم 135M. يقول المشروع إنه يأمل في الاقتراب من قوة SmolLM2-135M و«أن يكون قريبًا من مستوى AxiomicLabs/GPT-X2.5-135M أو BananaMind/BananaMind-2-Pro-Preview». عبارة «لنشبّك أصابعنا» هي العبارة المحورية. لم يبدأ التدريب بعد، ولم تُشارك أي معايير قياس، والهدف مؤطر كطموح لا كنتيجة.

التواريخ هي الالتزامات الصارمة الوحيدة على الطاولة. من المتوقع أن يبدأ تدريب 75M في 12 أغسطس، و125M في 20 أغسطس، و250M في 10 سبتمبر. لا شيء من هذه التواريخ هو موعد إصدار، والمنشور لا يذكر متى قد تُطرح النماذج.

موجة الإفراط في التدريب تصل إلى أصغر النماذج

يظهر Boris-2 في لحظة تُغذَّى فيها النماذج الصغيرة مفتوحة المصدر بكميات بيانات ضخمة عن قصد. وضع BananaMind الرهان نفسه على نموذج 2 Micro، مع تدريب مقرر أن يبدأ في 3 أغسطس وإصدار مُقدَّر بين 4 و6 أغسطس، إلى جانب معاينة عامة لـBananaMind 2 Pro. هناك أيضًا، لم تُشارك أي معايير قياس. الرهان المشترك هو أن كثافة البيانات يمكن أن تعوض حجم النموذج، ولا يملك أي من المشروعين دليلًا على ذلك بعد.

ما يمكن التحقق منه هو الحسابات، والحسابات تُظهر رهانين مختلفين. يدفع BananaMind التوكنات لكل معامل إلى أقصى حد. ينفق Boris-2 ميزانية توكناته بشكل غير متساوٍ، مفضلًا النموذج الأوسط، بينما يأمل في أن تتيح البنية للنماذج الثلاثة تحقيق أداء يتفوق على عدد معاملاتها.

نسخ مختلفة، والانتظار الطويل حتى 12 أغسطس

لا تنتهي الخريطة الزمنية عند الأحجام الأساسية الثلاثة. يقول Boris-2 إنه سيتبعها بنسخ Pro وInstruct وPro-Instruct. يختتم المنشور بعبارة «المزيد من المعلومات قريبًا»، وهو الجدول الزمني الوحيد المقدم إلى جانب تواريخ التدريب.

حتى تبدأ أول عملية تدريب، يظل Boris-2 مواصفات بتواريخ ملحقة بها. الأرقام علنية، والمنطق علني، والنتيجة غير مثبتة تمامًا. بالنسبة لمتابعي النماذج الصغيرة، هذه هي النقطة: رهان معلن على الملأ قبل جولة تدريب واحدة.

أهم أخبار التقنية في 3 دقائق كل صباح

بريد إلكتروني واحد، كل يوم عمل، بما يهم فعلاً في الذكاء الاصطناعي والتقنية.