التكميم

4 published articles

ميتا إيه آيFeatured4 min read

ذكاء اصطناعي مفتوح المصدر

Muse Glimmer: وكيل Meta بـ30 مليار معامل بحجم أقل من 20 جيجابايت، والسحابة اختيارية

أصدرت ميتا نموذج Muse Glimmer مفتوح المصدر، وهو نموذج وكيل بـ 30 مليار معلمة يعمل دون اتصال على وحدة معالجة رسوم استهلاكية واحدة. التكميم يبقيه تحت 20 جيجابايت، وتوفر مسودة DFlash تسريعًا في فك التشفير يصل إلى 3.1x على RTX 5090، والأوزان متاحة على Hugging Face بموجب Apache 2.0.

2026-08-10

Qwen / Alibaba4 min read

Qwen / Alibaba Cloud

Qwen2.5-Omni يتفوق على Gemini-1.5-Pro في OmniBench ويعمل بأقل من 12GB

تفوّق نموذج Qwen2.5-Omni مفتوح المصدر من Alibaba على Gemini-1.5-Pro في OmniBench وتصدّر لوحة صدارة MMAU للاستدلال الصوتي. وتخفض النسخ المكمّمة ذاكرة VRAM إلى أقل من 12GB، بينما يوفّر دعم MNN دردشة صوتية فورية على الهواتف.

2026-08-07

نماذج اللغات الكبيرة3 min read

بحث في الذكاء الاصطناعي

لماذا يُعد الاحتمال اللوغاريتمي للرموز إشارة خاطئة لمراقبة نماذج التفكير في الذكاء الاصطناعي

تظهر Novelis Research أن الاحتمال اللوغاريتمي للرموز يفشل كمراقب لفك الترميز لنماذج التفكير المكممة، كونه أعمى عن الحلقات الواثقة. يقدمون وحدة تحكم e-CUSUM معايرة تجمع بين إشارات عدم اليقين والتكرار، محققة انتقائية على GSM8K مع DeepSeek-R1-Distill-Qwen-1.5B.

2026-08-03

مفتوح المصدر3 min read

تكميم النماذج

Unsloth تضغط نموذج Inkling من 975 مليار معامل إلى 270 جيجابايت مع احتفاظ بنسبة 74% من الدقة

تضغط تقنية التكميم الديناميكي GGUF من Unsloth نموذج Inkling المفتوح، البالغ عدد معاملاته 975 مليارًا، من 1.9 تيرابايت إلى 270 جيجابايت بدقة 1-بت مع احتفاظ بنسبة 74.2% من الدقة. تحافظ الطريقة انتقائيًا على الطبقات عالية الدقة، مما يتيح الاستدلال المحلي على أجهزة بحجم 290 جيجابايت من RAM+VRAM.

2026-07-16