التوليد التخميني
4 published articles
LLMs & الاستدلال
الرياضيات وراء التسريع: كيف يخفي الترميز التخميني زمن الاستجابة دون تغيير المخرجات
يعمل الترميز التخميني على تسريع التوليد التلقائي من خلال اقتراح رموز مرشحة بآلية مسودة رخيصة والتحقق منها في تمريرة أمامية واحدة للنموذج المستهدف، دون تغيير المخرجات. يحلل هذا التقرير الرياضيات، والطرق الرئيسية (نماذج المسودة، EAGLE-3، DFLASH، توقع الرموز المتعددة، n-gram)، وما تعنيه معدلات القبول فعليًا لزمن الاستجابة في العالم الحقيقي.
2026-07-21
تحسين الأنظمة
DSpark يثبت أن الاستدلال السريع للذكاء الاصطناعي هو مشكلة جدولة وليس خدعة نموذجية
ورقة DSpark من DeepSeek تكشف أن فك التشفير التخميني الساذج يقلل من الإنتاجية تحت التزامن العالي. حلها، التحقق المجدول بالثقة، يكيف طول الكتلة لكل طلب ويغير حدود باريتو لأداء الخدمة.
2026-07-12
فك الترميز التخميني شبه الذاتي التراجعي يصل إلى مرحلة الإنتاج
DSpark من DeepSeek يعالج عائقين رئيسيين كانا يعيقان تسريع استدلال الذكاء الاصطناعي
إطار عمل فك ترميز تخميني جديد من DeepSeek يعالج عائقين رئيسيين كانا يحدان من أداء المشتقات المتوازية: تدهور اللاحقة والتحقق المهدر. يحقق DSpark تسريعًا في سرعة التوليد بنسبة 60-85% في بيئة الإنتاج من خلال دمج بنية شبه ذاتية تراجعية مع جدولة تعتمد على الثقة تقوم باستبعاد الرموز منخفضة القيمة قبل أن يقوم النموذج المستهدف بالتحقق منها.
2026-07-08
أداء
Gemma 4 يعمل أسرع بنحو 90 بالمائة في Ollama 0.31 مع التنبؤ متعدد الرموز
يقدم Ollama 0.31 التنبؤ متعدد الرموز لـ Gemma 4 على Apple Silicon، مما يحقق توليدًا أسرع بنسبة تقارب 90% للرموز في معايير البرمجة. يأتي التسريع من نموذج أولي مضبوط تلقائيًا ونواة MLX مخصصة تلغي قراءات الأوزان الزائدة.
2026-06-29