NLP والتعلم الآلي
معالجة اللغة الطبيعية، التعلم الآلي والتعلم العميق.
15 published articles
التعلم الموحّد
عندما لا يمكن مشاركة المستخدمين، تشارك FedCGR لغةً بدلاً من ذلك
تعامل FedCGR التوصية عبر النطاقات الموحّدة كتوليدٍ فوق لغة عناصر دلالية مستقرة. تتحول العناصر إلى معرّفات دلالية منفصلة مستمدة من بيانات وصفية عامة، بحيث يتوافق العملاء دون تبادل تفاعلات خاصة. المقايضة: عنق زجاجة دلالي بحت يجب أن تملأه أدلة الترشيح التعاوني المحلي.
2026-08-18
الرسوم البيانية المعرفية والذكاء الاصطناعي الحضري
المحطات ليست جزرًا: كيف يعيد RTSKG توصيل بيانات النقل الحضري
تتجاهل نماذج النقل على مستوى المدينة في كثير من الأحيان كيفية ارتباط المحطات بالطرق والأعمال التجارية. RTSKG، وهي مجموعة بيانات قائمة على الرسم البياني المعرفي منشورة على arXiv، تنمذج تلك التفاعلات بشكل صريح وتُبلغ عن تحسّن في توصية المتاجر والتنبؤ بعدد الركاب.
2026-08-18
أبحاث RAG
BM25 يتفوق على RAG الوكيلية عندما تتجاوز المجموعات النصية 10 ملايين توكن
يفوز البحث الوكيل على المجموعات الصغيرة، لكن دراسة من muset-ai عبر 28 طبقة متداخلة تُظهر تفوّق BM25 عليه قرب 10 ملايين توكن. يحرق الوكيل 39 ضعفًا من توكنات الاستعلام، ويتعثر RAG القائم على الرسوم البيانية في مرحلة البناء.
2026-08-07
أبحاث الذكاء الاصطناعي
«ذاكرة الصوت» (Voice Memory): ملف بحجم 776 بايت يخبر التعرف على الكلام متى لا يفعل شيئًا
طريقة جديدة تعتمد على الاستنتاج فقط في التعرف على الكلام تتعلم ضبط النفس: مُصحِّح مجمَّد يقرأ ملف ذاكرة خاصًا بكل مجال ويقرر متى يمتنع عن التصحيح. التصحيح غير المقيد يكسر الرموز الصحيحة في ما يصل إلى 64% من التعديلات؛ وتخفض «ذاكرة الصوت» (Voice Memory) هذه النسبة إلى 35%، مع خفض معدل خطأ الكلمات الموزون من 8.36% إلى 7.52%.
2026-08-06
بحث
الذاكرة المشتركة سيف ذو حدين: توسيع خوارزميات الممثل-الناقد إلى ما بعد خمسة عوامل يُظهر عوائد متناقصة
قام الباحثون بمشاركة مخازن التكرار عبر عوامل الممثل-الناقد في مهام الإجراءات المعلمية. قفز أداء GAC بشكل ملحوظ، لكن SAC و TQC تقدما فقط بخطوات بطيئة. بعد خمسة عوامل، ترتفع التكلفة الحاسوبية دون عائد ذي معنى. تقدم الورقة حدًا عمليًا لمدى قدرة طرق الخبرة المشتركة على التقدم قبل أن تتوقف.
2026-07-27
الذكاء الاصطناعي وعلوم الأعصاب
الخلايا العصبية المشوشة لنموذج لغوي أعادت إنتاج آثار السكتة الدماغية على الكلام
قام الباحثون بإزعاج نموذج LLaVA 1.6 لمحاكاة أخطاء تسمية الصور المرتبطة بالحبسة الكلامية وتطابقوا مع ملفات تعريف المرضى الفردية في ما يصل إلى سبع فئات من الأخطاء في 79.5% من الحالات. ظهرت ستة من أصل سبعة أنواع من الأخطاء بشكل طبيعي عبر تكوينات الإزعاج المختلفة، مما يشير إلى أن النماذج متعددة الوسائط ذات الأغراض العامة يمكن أن تعمل كتوائم رقمية لعجز اللغة بعد السكتة الدماغية.
2026-07-24
الذكاء الاصطناعي المتجسد
العقل الروبوتي لـ Xiaomi مفتوح المصدر و38 مليار معلمة. وهذا يغير عنق الزجاجة للبيانات
باستخدام نموذج يحتوي على 38 مليار معلمة يوحد أربع مهام روبوتية ويفتح المصدر لخط الأنابيب بالكامل، تهدف Xiaomi إلى كسر عنق الزجاجة للبيانات في الذكاء الاصطناعي المتجسد. تظهر المعايير الأولية تحسنًا بنسبة 26% في معدلات إنجاز المهام عند التدريب على البيانات المعززة بالنموذج.
2026-07-15
الذكاء الاصطناعي الفيزيائي
تشغل كيوين من علي بابا الآن أدمغة 150 ألف روبوت وسيارة ونظارة وطائرة درون
تعمل عائلة نماذج كيوين من علي بابا الآن على تشغيل أكثر من 150 ألف جهاز، بدءًا من الروبوتات البشرية وحتى كاميرات الأطفال، حيث تتحول الشركة من روبوتات المحادثة إلى الذكاء الاصطناعي الفيزيائي، لتدمج النماذج متعددة الوسائط في الروبوتات والسيارات والنظارات والطائرات بدون طيار.
2026-07-14
أبحاث الذكاء الاصطناعي
لماذا يهيمن GPT-5.5 على معيار يختبر كيف يحسن الوكلاء أنفسهم
يعزل EvoPolicyGym قدرة حرجة ولكنها غير مدروسة بشكل كافٍ: قدرة الوكيل على تحسين سياسة قابلة للتنفيذ من خلال تعديلات متكررة مقيدة بردود الفعل. يكشف المعيار أن GPT-5.5 هو أقوى أداء عبر 16 بيئة، ويوفر تشخيصات على مستوى المسار تكشف كيف تخصص الوكلاء المختلفون الميزانية ويحولون ردود الفعل إلى معلمات مضبوطة.
2026-07-11
إدارة الذاكرة
السر وراء سرعة Bing: كيف تفوق mimalloc على مقايضة تخصيص الذاكرة بـ 12,000 سطر
يستخدم مُخَصِّص mimalloc من Microsoft Research آلاف القوائم الحرة لكل صفحة وتقنية ذكية لسرقة الصفحات لتحقيق التزامن العالي وانخفاض هدر الذاكرة، كما توضح مجموعة RiSE في مدونة تقنية جديدة.
2026-07-10
تاريخ معالجة اللغة الطبيعية
المعيار الذي جعل نماذج اللغة تتحدث: كيف غيّر معيار GLUE لعام 2018 مسار الذكاء الاصطناعي للأبد
معيار GLUE، الذي أُطلق في عام 2018، غيّر معالجة اللغة الطبيعية من خلال توفير مقياس موحد لفهم اللغة. لا يزال إرثه حيًا في كل معيار حديث لنماذج اللغات الكبيرة، من SuperGLUE إلى أحدث التقييمات على غرار الساحة التي تحدد سباق الذكاء الاصطناعي اليوم.
2026-07-08
أبحاث التعلم الآلي
Fast-LeWM: التنبؤ بالبادئة الموازية للأفعال يقلل من تكاليف تخطيط النماذج الكامنة للعالم
يقدم الباحثون Fast-LeWM، وهو نموذج عالمي كامن يسرع التخطيط البصري من خلال التنبؤ بالحالات المستقبلية من بادئات الأفعال بالتوازي. يقلل النهج من التكاليف الحسابية وتراكم الأخطاء، متجاوزًا النماذج السابقة للتحول أحادي الخطوة.
2026-07-07