فرط التدريب
2 published articles
نماذج اللغات الكبيرة3 min read
ذكاء اصطناعي مفتوح المصدر
Boris-2 يغذّي نموذجه 125M بـ90 مليار توكن، بينما يحصل نموذجه 250M على 60 مليارًا فقط
يعلن Boris-2 مسبقًا عن ثلاثة نماذج صغيرة بميزانيات توكن غير متوازنة: يحصل نموذج 125M على 90 مليار توكن، بينما يحصل 250M على 60 مليارًا فقط. يمتد التدريب من 12 أغسطس إلى 10 سبتمبر، دون مشاركة أي معايير قياس، فقط الطموح المعلن للوصول إلى قوة SmolLM2-135M.
2026-08-16
نماذج اللغات الكبيرة4 min read
سباق النماذج الصغيرة
بانانا مايند 2 مايكرو: 2.9 مليون معامل، 75 مليار توكن، ورهان تدريب مفرط متطرف
سيضم BananaMind 2 Micro 2.9 مليون معامل وسيُدرَّب على 75 مليار توكن، أي ما يقارب 25,900 توكن لكل معامل. يبدأ التدريب في 3 أغسطس، والإصدار المتوقع في الفترة من 4 إلى 6 أغسطس، وتصل معاينة عامة لـ BananaMind 2 Pro في اليوم نفسه. لم تتم مشاركة أي معايير أداء.
2026-08-06