السياق الطويل
4 published articles
الذكاء الاصطناعي
ترميزات LFM2.5 تدعم حجة النماذج الصغيرة: أسرع بـ3.7× من ModernBERT على وحدة المعالجة المركزية
ترميزات LFM2.5 مفتوحة الأوزان من Liquid AI تدعم الحجة بأن معالجة اللغة الطبيعية الإنتاجية تنتمي إلى النماذج الصغيرة. ترميز 230M يتفوق على ModernBERT-base في المعايير ويفحص مستندات كاملة في حوالي 28 ثانية على وحدة معالجة مركزية لجهاز محمول، أي أسرع بنحو 3.7×.
2026-08-05
نماذج الذكاء الاصطناعي
OpenAI تصدر تحديثًا طفيفًا لـ GPT يستهدف معالجة السياق الطويل
طرحت OpenAI اليوم تحديثًا طفيفًا لـ GPT يعالج إدارة السياق الطويل. يهدف التغيير إلى مساعدة النموذج في معالجة المدخلات الممتدة بشكل أكثر فعالية.
2026-07-28
التقنيات العميقة
التوجيه المشترك عبر الطبقات يعطي الانتباه المتناثر تسريعًا بمقدار 7 أضعاف دون التأثير على الجودة
تستخدم CLSA تمريرة توجيه واحدة لكل تسلسل بدلاً من تمريرة واحدة لكل طبقة، مما يقلل حمل KV-cache مع الحفاظ على انتقائية مستوى الرمز. تُظهر المقاييس تحسنًا في الإنتاجية بمقدار 17.1 ضعفًا في سياق 128 ألف رمز.
2026-07-26
أبحاث الذكاء الاصطناعي مفتوحة المصدر
سياق مليون رمز بعُشر ذاكرة KV: رهان DeepSeek-V4 على الكفاءة
تجمع معاينة V4 من DeepSeek بين نموذج Pro بمعاملات 1.6T ونسخة Flash بمعاملات 284B، وكلاهما بسياق من مليون رمز. تدّعي الورقة أن النموذج يستهلك 27% من عمليات FLOPs للاستدلال و10% من ذاكرة KV الخاصة بـ V3.2، وهي الأرقام التي تجعل تقديم هذا السياق فعالًا من حيث التكلفة.
2026-06-22