تكلفة الاستنتاج

4 published articles

الذكاء الاصطناعي3 min read

استدلال مفتوح الأوزان

نموذج نيموترون-4 من إنفيديا سريع ومفتوح ويستهدف الفجوة بين لاما وجي بي تي

يتحدى خط نيموترون-4 من إنفيديا كلاً من لاما 3.3 وميسترال لارج بنتائج تنافسية في MMLU وتوفير 30% محتمل في الاستدلال. يضع الترخيص المفتوح واستراتيجية الحجم المزدوج النموذج كبديل عملي للفرق التي تدير أحمال عمل عاملية على نطاق واسع.

2026-07-25

الذكاء الاصطناعيFeatured2 min read

هندسة التكاليف

مايكروسوفت تختبر نموذجًا صينيًا لخفض تكاليف كوبايلوت بما يصل إلى 600 مليون دولار

تستعد مايكروسوفت لاختبار نموذج Kimi K3 من Moonshot AI داخل Copilot في محاولة لخفض تكاليف استدلال الذكاء الاصطناعي بما يصل إلى 600 مليون دولار. تبحث الشركة عن بدائل أرخص لنماذج OpenAI و Anthropic، لكن النموذج الصيني مفتوح الوزن لا يزال بحاجة إلى اجتياز فحوصات الجودة وزمن الاستجابة.

2026-07-21

الذكاء الاصطناعيFeatured5 min read

البنية التحتية للذكاء الاصطناعي

نموذج نيموترون 3 ألترا من إنفيديا يقلب معادلة تكلفة سير العمل الوكيل رأسًا على عقب

نيموترون 3 ألترا، نموذج الوكيل الكثيف-المتناثر من إنفيديا، يعد بخفض تكاليف الاستدلال بنسبة تصل إلى 30٪ مقارنة بالنماذج المفتوحة المماثلة مع الحفاظ على تفكير متقدم. مع نافذة سياق تبلغ مليون رمز وتكميم أصلي NVFP4، تم وضعه كحصان العمل لأحمال عمل استدعاء الأدوات في المؤسسات.

2026-06-04

الذكاء الاصطناعيFeatured2 min read

Qwen3.7

ثغرة المنطقة الزمنية التي تخفض تكاليف استدلال الذكاء الاصطناعي بنسبة 80%

استوديو النماذج يخفض تلقائيًا تكاليف واجهة برمجة التطبيقات لـ Qwen3.7-Max و Qwen3.7-Plus بنسبة تصل إلى 80% خلال نافذة ليلية تتزامن مع ساعات العمل في جميع أنحاء الولايات المتحدة وأوروبا. لا حاجة للتسجيل، ولا تغييرات في الكود، فقط استدلال أرخص لمن يوقت استدعاءاته بشكل صحيح.

2026-05-20