نماذج لغوية كبيرة
7 published articles
معيار الاستدلال المالي
نماذج اللغة الكبيرة تعرف الصيغ المحاسبية. FinIndices يُظهر أنها لا تستطيع تطبيقها
يمكن لنماذج اللغة الكبيرة أن تردد الصيغ المحاسبية، لكن FinIndices، وهو معيار مبني على بيانات مالية صينية حقيقية، يُظهر أنها تكافح لتطبيقها. انخفضت دقة Gemini-3.1-Pro من 70.70% إلى 38.22% عند إزالة تلميحات الصيغ، وكان توليد الجداول يضعف استدلال النماذج بشكل مباشر.
2026-08-20
ذاكرة الوكلاء
TEPA: بالنسبة لوكلاء الذكاء الاصطناعي، الذاكرة المتقادمة أسوأ من غيابها
يجادل بحث أولي جديد على arXiv بأن ذاكرة الوكلاء تعاني مشكلة قابلية الدحض: فالحقائق القديمة تظل قابلة للاسترجاع وتلوث الاستعلام (البرومبت). تلغي آلية TEPA الذكريات التي تجاوزتها الأدلة، وفي اختبارات الانجراف سجلت الذاكرة الساذجة (0.210) أدنى من غياب الذاكرة (0.309) بينما بلغت TEPA 0.950.
2026-08-19
أوزان Qwen3.8-Max المفتوحة تصل الأسبوع المقبل
أقوى نموذج من علي بابا على الإطلاق يصبح مفتوح المصدر
Qwen3.8-Max، أول نموذج مفتوح الأوزان من فئة Max لدى علي بابا بعدد معاملات يبلغ 2.4 تريليون، سيصدر على Hugging Face وModelScope الأسبوع المقبل. يعيد هذا الإطلاق صياغة سؤال المصادر المفتوحة: ماذا يحدث عندما تكون أكبر أوزان النماذج الحدودية متاحة للتنزيل والاختبار مجانًا؟
2026-08-06
الذكاء الاصطناعي مفتوح المصدر
Kimi K3 هو أكبر نموذج مفتوح على الإطلاق. لكنه ليس الأفضل بعد.
Kimi K3 هو أكبر نموذج مفتوح بـ 2.8 تريليون معامل، لكنه يفشل في التفوق على أفضل النماذج المملوكة في المعايير العامة. بينما يتفوق في مهام الترميز والوكالة المحددة، فإن الفجوة مع القادة الحدوديين مثل Claude Fable 5 و GPT 5.6 Sol تكشف حدود التوسع دون اختراقات معمارية وبياناتية.
2026-07-27
فلسفة الذكاء الاصطناعي
لا، الذكاء الاصطناعي ليس عقلًا منافسًا. إنه امتداد لعقولنا
بالبحث في ظواهرية هوسرل، يجادل الباحثون بأن أنظمة الذكاء الاصطناعي تُفهم بشكل أفضل كامتدادات للذكاء الطبيعي، وليس كعقول مستقلة. يفسر هذا المنظور ظاهرة الهلوسة والإخفاقات التركيبية، مع تحويل نقاشات السلامة من مخاوف الذكاء الاصطناعي المارق إلى هندسة مسؤولة وحوكمة.
2026-07-09
الخصوصية الرقمية
ذكاؤك الاصطناعي كتب تأبينك في 17 شريحة. هذه هي المشكلة.
ملخص حياة مكون من 17 شريحة يولده الذكاء الاصطناعي يبدو وكأنه اختراق إنتاجي، لكنه يثير أسئلة غير مريحة حول مدى تنازلنا طواعية للآلات التي تتعلم كل عاداتنا.
2026-07-07
بيانات اصطناعية
لا رئيس، لا عنق زجاجة: لماذا يعيد إطار نظير إلى نظير التفكير في توليد البيانات الاصطناعية
Matrix هو إطار لامركزي يستخدم رسائل متسلسلة تمر عبر قوائم انتظار موزعة لتوليد البيانات الاصطناعية بواسطة وكلاء متعددين. بإلغاء المنسق المركزي، يحقق إنتاجية أعلى بمقدار 2-15 ضعفاً على نفس الأجهزة.
2026-06-06