نموذج 158 مللي ثانية يعيد كتابة دليل السرعة والجودة

النموذج الذي حطم قاعدة السرعة والجودة في 158 مللي ثانية

يسجل Celeris-1 نسبة 75.9% على MMLU-Pro بزمن استجابة 158 مللي ثانية، أسرع ثماني مرات من GPT-5 mini مع خسارة 2.6 نقطة دقة فقط. يفحص التحليل منهجية القياس وما تعنيه هذه المقايضة بين السرعة والجودة لتطبيقات الذكاء الاصطناعي في الوقت الفعلي.

Emmanuel Fabrice Omgbwa Yasse بمساعدة الذكاء الاصطناعي

2026-07-25 · قراءة 1 دقائق

النموذج الذي حطم قاعدة السرعة والجودة في 158 مللي ثانية
المصادر : How we test Cel…

حدود السرعة والجودة

تقول الحكمة التقليدية إنه لا يمكنك الحصول على السرعة والدقة معًا. النماذج الأعلى في لوحات تصنيف التفكير تستغرق ثوانٍ. النماذج السريعة تفقد الكثير من الذكاء. يهدف سيليريس-1، الذي نشرته فريق غير منتسب، إلى كسر هذه المفاضلة. أرقامه على MMLU-Pro: 75.9% دقة بمتوسط زمن استجابة 158 مللي ثانية. ليس أعلى درجة، ولكن بجزء صغير من كامن النماذج الرائدة. التصميم المرتكز على زمن الاستجابة قد أسفر بالفعل عن نتائج في أماكن أخرى: حقق ميسترال نانو 85% من قدرات التفكير لنظيره الأكبر على أجهزة ذات ذاكرة أقل من 1 جيجابايت.

السياق: يسجل GPT-5 81.9% على نفس الاختبار ولكنه يستغرق 2.0 ثانية. يتصدر Gemini 3.5 Flash Lite بنسبة 83.0% ولكنه يحتاج 1.2 ثانية. يتنازل سيليريس-1 عن حوالي 5 إلى 7 نقاط دقة مقابل ميزة سرعة تتراوح بين 8 إلى 16 مرة. بالنسبة للتطبيقات التي تهم فيها كل ملي ثانية، فإن هذه المفاضلة هي الصحيحة. النموذج مصمم للمسار الساخن: كل دورة محادثة، كل خطوة في حلقة وكيل، كل ضغطة مفتاح.

نتائج القياس

قام فريق سيليريس بتشغيل مجموعة اختبار MMLU-Pro الكاملة بتكوين سلسلة أفكار من خمس محاولات مع تسجيل صارم، وضبط ميزانية التفكير على صفر لكل نموذج يسمح بذلك. تم تشغيل Mercury 2 في وضعه الفوري. يوضح الجدول أدناه الدقة وزمن الاستجابة لجميع النماذج الستة.

النموذجالدقةزمن الاستجابة (p50)أساس التوقيت
Celeris-175.9%158 msمبلغ عنه من الخادم
Gemini 3.5 Flash Lite83.0%1,232 msمن النهاية إلى النهاية، في نفس الموقع
GPT-581.9%2,046 msمبلغ عنه من الخادم
GPT-5 mini78.5%2,495 msمبلغ عنه من الخادم
Gemini 2.5 Flash73.0%2,600 msمن النهاية إلى النهاية، في نفس الموقع
Inception / Mercury 263.7%257 msمبلغ عنه من الخادم

يصل سيليريس-1 إلى 75.9%، متأخرًا عن GPT-5 mini بـ 2.6 نقطة ولكنه أسرع بـ 16 مرة. يتفوق على Mercury 2، النموذج الآخر الوحيد في نفس فئة زمن الاستجابة، بأكثر من 12 نقطة مع استجابة أسرع بـ 100 مللي ثانية. يبقى Gemini 3.5 Flash Lite الأكثر

أهم أخبار التقنية في 3 دقائق كل صباح

بريد إلكتروني واحد، كل يوم عمل، بما يهم فعلاً في الذكاء الاصطناعي والتقنية.