نماذج لغوية صغيرة
4 published articles
مصدر مفتوح
نماذج أقل من 200 مليون معلمة تزدهر بينما تنفق الحدود الأمامية المليارات
نشرت هاغينغ فيس شكرًا للمجربين الذين يقفون وراء انفجار في الضبط الدقيق والتدريب المسبق لنماذج أقل من 200 مليون معلمة. لا معايير، ولا إطلاقات، مجرد إشارة إلى أن مركز ثقل الذكاء الاصطناعي مفتوح المصدر يتحول.
2026-08-18
ذكاء اصطناعي مفتوح المصدر
Boris-2 يغذّي نموذجه 125M بـ90 مليار توكن، بينما يحصل نموذجه 250M على 60 مليارًا فقط
يعلن Boris-2 مسبقًا عن ثلاثة نماذج صغيرة بميزانيات توكن غير متوازنة: يحصل نموذج 125M على 90 مليار توكن، بينما يحصل 250M على 60 مليارًا فقط. يمتد التدريب من 12 أغسطس إلى 10 سبتمبر، دون مشاركة أي معايير قياس، فقط الطموح المعلن للوصول إلى قوة SmolLM2-135M.
2026-08-16
سباق النماذج الصغيرة
بانانا مايند 2 مايكرو: 2.9 مليون معامل، 75 مليار توكن، ورهان تدريب مفرط متطرف
سيضم BananaMind 2 Micro 2.9 مليون معامل وسيُدرَّب على 75 مليار توكن، أي ما يقارب 25,900 توكن لكل معامل. يبدأ التدريب في 3 أغسطس، والإصدار المتوقع في الفترة من 4 إلى 6 أغسطس، وتصل معاينة عامة لـ BananaMind 2 Pro في اليوم نفسه. لم تتم مشاركة أي معايير أداء.
2026-08-06
نماذج اللغات الكبيرة والنماذج
وصفة التقطير المتسلسل من ميسترال تقلص حجم نماذج اللغات الكبيرة دون قتل التفكير المنطقي
التقطير المتسلسل من ميسترال يقلص حجم النماذج الكبيرة إلى نماذج صغيرة مع الحفاظ على التفكير المنطقي والرؤية. يقدم إصدار 3B قدرات كانت تتطلب سابقًا عشرة أضعاف عدد المعلمات، وكل ذلك بموجب ترخيص Apache 2.0.
2026-07-17