نماذج اللغات الكبيرة
نماذج لغوية كبيرة: GPT، Claude، Gemini، Mistral والنماذج مفتوحة المصادر
93 published articles
توليد الموسيقى بالذكاء الاصطناعي
Music 3.0 تستبدل الوصف أحادي الوسم بخط زمني يُبقي أغاني الذكاء الاصطناعي على مسارها
تميل مسارات الذكاء الاصطناعي إلى الانحراف عن الموجز أثناء تطورها: الآلات الموسيقية تتساقط، والعاطفة تتسطح، وأسلوب الغناء يأتي ويذهب. تستبدل Music 3.0 الوصف أحادي الوسم بوصف منظم زمني تسلسلي (Structured Caption)، مدعومًا بنموذج هجين 8B/0.6B Hybrid-LM يفصل البنية عن التفاصيل.
2026-08-21
ذكاء اصطناعي مفتوح الأوزان
dots3-note من شياوهونغشو: نموذج MoE مفتوح الأوزان بـ 280 مليار معامل يُفعّل 16 مليارًا فقط
أصدر استوديو dots التابع لشياوهونغشو نموذج dots3-note preview، أول نموذج بأوزان مفتوحة لديها: نموذج MoE متعدد الوسائط بـ 280 مليار معامل، 16 مليارًا نشطًا، ونافذة سياق تبلغ 512 ألف رمز. يستهدف التصميم المتناثر خفض تكلفة التشغيل على عقدة واحدة مزوّدة بـ 8 وحدات معالجة رسومية، لكن البطاقة التعريفية لم تنشر أرقام المقاييس بعد.
2026-08-20
ذكاء اصطناعي مفتوح المصدر
Boris-2 يغذّي نموذجه 125M بـ90 مليار توكن، بينما يحصل نموذجه 250M على 60 مليارًا فقط
يعلن Boris-2 مسبقًا عن ثلاثة نماذج صغيرة بميزانيات توكن غير متوازنة: يحصل نموذج 125M على 90 مليار توكن، بينما يحصل 250M على 60 مليارًا فقط. يمتد التدريب من 12 أغسطس إلى 10 سبتمبر، دون مشاركة أي معايير قياس، فقط الطموح المعلن للوصول إلى قوة SmolLM2-135M.
2026-08-16
توليد الفيديو بالذكاء الاصطناعي
نموذج Wan3.0 من علي بابا يبيع الفيديو بالثانية: 6 دولارات لمقطع مدته 30 ثانية
يمكن لنموذج Wan3.0 تحويل ملف PDF أو عرض تقديمي للعلامة التجارية إلى فيديو مدته 30 ثانية في توليد واحد، مع تسعير API بالثانية يبلغ أقصاه 0.20 دولار لجودة 1080P. نحلل حسابات تكلفة المقطع الواحد والفجوات التي تعترف بها علي بابا في اختباراتها الخاصة.
2026-08-16
TTS مفتوح الأوزان
Magpie TTS يستهلك 32 مللي ثانية من ميزانية زمن استجابة وكيل الصوت الخاص بك
يُفيد Magpie TTS بتحقيق زمن وصول إلى أول صوت يبلغ 32 مللي ثانية على معالج NVIDIA B200، ويضيف العربية والكورية والبرتغالية البرازيلية، ليرفع قائمته إلى 12 لغة. طرح الأوزان المفتوحة: توليف الكلام المستضاف ذاتيًا لم يعد يخسر حجة زمن الاستجابة.
2026-08-16
وكلاء الذكاء الاصطناعي على الأجهزة
LFM2.5-2.6B: الوكيل الصغير الذي يتفوق على نماذج أكبر منه بأربعة أضعاف
يضع LFM2.5-2.6B من Liquid AI نموذجًا وكيلًا في 2.6 مليار معامل وأقل من 2.5 غيغابايت من الذاكرة، متصدرًا كل معايير اتباع التعليمات التي اختُبر عليها. يعمل بسرعة 220 رمزًا في الثانية على حاسوب محمول؛ والبرمجة هي الفجوة الواضحة الوحيدة.
2026-08-12
حرب أسعار الذكاء الاصطناعي
السعر الفيروسي لـGLM-5.2 من Zhipu البالغ 0.07 دولار قفز 10 أضعاف بالفعل، حسبما يدّعي ردّ واحد
انتشر GLM-5.2 من Zhipu فيروسيًا بسعر 0.07 دولار لكل مليون توكن، وهو خفض بنسبة 95% وصفه أصحاب المنشورات بأنه "مجاني تقريبًا." ويقول ردّ واحد إن السعر ارتدّ 10 أضعاف كحيلة لجذب الأنظار. ويضيف ممارسون أن GLM-5.2 لم يرقَ أبدًا إلى مستوى النماذج المتطورة.
2026-08-10
أبحاث
نموذج الذكاء الاصطناعي الذي يستخدم الأدوات يجعل الأسئلة السهلة أصعب
ورقة بحثية جديدة من KlingTeam تقيس متى تحتاج النماذج متعددة الوسائط إلى الأدوات فعلًا ومتى تضرّها الأدوات. نموذج Beacon المقترح، المدرَّب بمكافآت تراعي الضرورة، يحسّن الدقة وانضباط استخدام الأدوات معًا.
2026-08-09
توليد الفيديو
MiniMax تخلّت عن معماريتها المُثبتة لكي يقوم H3 بكل شيء
تقول MiniMax إن H3 يوحّد توليد النصوص والصور والفيديو والصوت في نموذج واحد، ويسعّر مخرجات 2K بأقل من ثلث أسعار النماذج السائدة، ويخطط لفتح الأوزان خلال أيام. لكن التفاصيل الصغيرة هي القصة الحقيقية: تخلت الشركة عن المعمارية التي منحتها ميزة للوصول إلى ذلك.
2026-08-07
سباق النماذج الصغيرة
بانانا مايند 2 مايكرو: 2.9 مليون معامل، 75 مليار توكن، ورهان تدريب مفرط متطرف
سيضم BananaMind 2 Micro 2.9 مليون معامل وسيُدرَّب على 75 مليار توكن، أي ما يقارب 25,900 توكن لكل معامل. يبدأ التدريب في 3 أغسطس، والإصدار المتوقع في الفترة من 4 إلى 6 أغسطس، وتصل معاينة عامة لـ BananaMind 2 Pro في اليوم نفسه. لم تتم مشاركة أي معايير أداء.
2026-08-06
سلامة الذكاء الاصطناعي
شيلدسترال، المصنّف ثلاثي المليارات الذي يتفوق على نماذج أكبر منه بسبع مرات
مصنّف سلامة بحجم 3B يضاهي نماذج نصية أكبر منه بنحو سبع مرات ويحقق مستوى متقدمًا جديدًا في التصفية متعددة الوسائط، وفقًا لورقة arXiv في يوليو 2026. الحيلة: إعادة صياغة التصفية كإجابة عن سؤال ثنائي، مع التدريب على نحو 54.1 مليون عينة.
2026-08-05
الذكاء الاصطناعي
ترميزات LFM2.5 تدعم حجة النماذج الصغيرة: أسرع بـ3.7× من ModernBERT على وحدة المعالجة المركزية
ترميزات LFM2.5 مفتوحة الأوزان من Liquid AI تدعم الحجة بأن معالجة اللغة الطبيعية الإنتاجية تنتمي إلى النماذج الصغيرة. ترميز 230M يتفوق على ModernBERT-base في المعايير ويفحص مستندات كاملة في حوالي 28 ثانية على وحدة معالجة مركزية لجهاز محمول، أي أسرع بنحو 3.7×.
2026-08-05