GGUF
2 published articles
مفتوح المصدر3 min read
تكميم النماذج
Unsloth تضغط نموذج Inkling من 975 مليار معامل إلى 270 جيجابايت مع احتفاظ بنسبة 74% من الدقة
تضغط تقنية التكميم الديناميكي GGUF من Unsloth نموذج Inkling المفتوح، البالغ عدد معاملاته 975 مليارًا، من 1.9 تيرابايت إلى 270 جيجابايت بدقة 1-بت مع احتفاظ بنسبة 74.2% من الدقة. تحافظ الطريقة انتقائيًا على الطبقات عالية الدقة، مما يتيح الاستدلال المحلي على أجهزة بحجم 290 جيجابايت من RAM+VRAM.
2026-07-16
الأدوات والأطرFeatured3 min read
الذكاء الاصطناعي المحلي
Ollama 0.30 يجلب تسريعًا أسرع لوحدة معالجة الرسوميات ودعمًا أصليًا لنماذج GGUF
يعزز إصدار Ollama 0.30 سرعة استدلال NVIDIA بنسبة تصل إلى 20%، ويمكّن دعم Vulkan لوحدة معالجة الرسوميات افتراضيًا لأجهزة AMD وIntel، ويوسع توافق نماذج GGUF، بما في ذلك النماذج المضبوطة بدقة من Hugging Face ودعم استدعاء الأدوات مع وكلاء البرمجة.
2026-06-05