تكلفة الاستنتاج
4 published articles
استدلال مفتوح الأوزان
نموذج نيموترون-4 من إنفيديا سريع ومفتوح ويستهدف الفجوة بين لاما وجي بي تي
يتحدى خط نيموترون-4 من إنفيديا كلاً من لاما 3.3 وميسترال لارج بنتائج تنافسية في MMLU وتوفير 30% محتمل في الاستدلال. يضع الترخيص المفتوح واستراتيجية الحجم المزدوج النموذج كبديل عملي للفرق التي تدير أحمال عمل عاملية على نطاق واسع.
2026-07-25
هندسة التكاليف
مايكروسوفت تختبر نموذجًا صينيًا لخفض تكاليف كوبايلوت بما يصل إلى 600 مليون دولار
تستعد مايكروسوفت لاختبار نموذج Kimi K3 من Moonshot AI داخل Copilot في محاولة لخفض تكاليف استدلال الذكاء الاصطناعي بما يصل إلى 600 مليون دولار. تبحث الشركة عن بدائل أرخص لنماذج OpenAI و Anthropic، لكن النموذج الصيني مفتوح الوزن لا يزال بحاجة إلى اجتياز فحوصات الجودة وزمن الاستجابة.
2026-07-21
البنية التحتية للذكاء الاصطناعي
نموذج نيموترون 3 ألترا من إنفيديا يقلب معادلة تكلفة سير العمل الوكيل رأسًا على عقب
نيموترون 3 ألترا، نموذج الوكيل الكثيف-المتناثر من إنفيديا، يعد بخفض تكاليف الاستدلال بنسبة تصل إلى 30٪ مقارنة بالنماذج المفتوحة المماثلة مع الحفاظ على تفكير متقدم. مع نافذة سياق تبلغ مليون رمز وتكميم أصلي NVFP4، تم وضعه كحصان العمل لأحمال عمل استدعاء الأدوات في المؤسسات.
2026-06-04
Qwen3.7
ثغرة المنطقة الزمنية التي تخفض تكاليف استدلال الذكاء الاصطناعي بنسبة 80%
استوديو النماذج يخفض تلقائيًا تكاليف واجهة برمجة التطبيقات لـ Qwen3.7-Max و Qwen3.7-Plus بنسبة تصل إلى 80% خلال نافذة ليلية تتزامن مع ساعات العمل في جميع أنحاء الولايات المتحدة وأوروبا. لا حاجة للتسجيل، ولا تغييرات في الكود، فقط استدلال أرخص لمن يوقت استدعاءاته بشكل صحيح.
2026-05-20