نماذج اللغات الكبيرة
نماذج لغوية كبيرة: GPT، Claude، Gemini، Mistral والنماذج مفتوحة المصادر
93 published articles
التعلم المعزز
حل مايكروسوفت للتعلم التجريبي يمنح نماذج الذكاء الاصطناعي مدربًا، وليس مجرد درجة
التعلم التجريبي يعيد توظيف نموذج اللغة الكبير كحكم إلى نموذج اللغة الكبير كمدرب يستخرج معرفة قابلة للنقل من كل استجابة ويستوعبها عبر تقطير السياق القائم على السياسة، متغلبًا على التعلم المعزز القائم على معايير التقييم في المهام المحتجزة ويقلل من اختراق المكافأة.
2026-07-30
التفسير الآلي
ما تعرفه جيما-4 فعلياً عن الفيزياء: ورقة بحثية جديدة تثبت أن التمثيلات حقيقية
يكشف بحث جديد على gemma-4-E4B-it أن التمثيلات الداخلية للنموذج لآليات علوم المواد مرتبطة سببيًا بإجاباته. تجمع الدراسة بين تقنيات متعددة للاستقصاء والتدخل لإظهار أن المعرفة الفيزيائية مشفرة في تحولات الحالة، وليس فقط في أنماط ثابتة.
2026-07-29
أبحاث الذكاء الاصطناعي
تدقيق جديد يكشف أن معظم ادعاءات المخاطر من رؤوس التعلم المعزز التوزيعي خاطئة
يُظهر تدقيق واسع النطاق أن وكلاء التعلم المعزز التوزيعي يُنتجون بشكل منهجي مقايضات مخاطر وهمية في الحالات التي من المرجح أن يثق بها الممارسون أكثر. عبر QR-DQN و C51 و IQN على MinAtar، لم يكن أي من أقوى الادعاءات قابلاً للتأكيد، وكان العمل بناءً على نصيحة CVaR للوكلاء يؤدي أحيانًا إلى أداء أسوأ بكثير من الصدفة.
2026-07-29
الذكاء الاصطناعي مفتوح المصدر
نموذج AV-Flamingo من Nvidia يتصدى لفهم الفيديو الطويل حيث تفشل معظم النماذج
تطلق Nvidia نموذج AV-Flamingo، وهو نموذج لغوي كبير سمعي-بصري مفتوح المصدر مصمم لفهم الفيديو الطويل والمعقد. يستخدم منهجًا تدريبيًا ثلاثي المراحل وإطار استدلال متسلسل مع طابع زمني للتعامل مع الاستدلال الزمني والمتعدد الوسائط الذي يعيق معظم النماذج.
2026-07-28
علم السلوك
القرارات البشرية التي تستطيع نماذج اللغة الكبيرة محاكاتها بشكل أفضل من الاستبيانات
تُظهر دراسة استخدمت 3000 عامل استنادًا إلى GPT-5 في تجارب اختيار الطريق أن نماذج اللغة الكبيرة تعيد إنتاج تحيزات نظرية الاحتمال التراكمي، والنفور من الخسارة، والاعتماد على المرجع، وترجيح الاحتمالات، بدقة عالية. يتجاوز هذا النهج عنق الزجاجة المتمثل في تقدير المعاملات الذي يحد من النمذجة السلوكية التقليدية.
2026-07-28
نماذج الذكاء الاصطناعي
تصميم Macaron-V1-Venti بأربع متخصصات و748 مليار معلمة يتفوق على GPT-5.5 وOpus 4.8
نموذج Macaron-V1-Venti من MindLab Research يتصدر المعايير في الذكاء الشخصي، البرمجة، استخدام الطرفية، وواجهة المستخدم التوليدية، باستخدام بنية جديدة من Mixture of LoRA تحافظ على صغر حجم النموذج مع التخصص.
2026-07-27
الذكاء الاصطناعي مفتوح المصدر
Kimi K3 هو أكبر نموذج مفتوح على الإطلاق. لكنه ليس الأفضل بعد.
Kimi K3 هو أكبر نموذج مفتوح بـ 2.8 تريليون معامل، لكنه يفشل في التفوق على أفضل النماذج المملوكة في المعايير العامة. بينما يتفوق في مهام الترميز والوكالة المحددة، فإن الفجوة مع القادة الحدوديين مثل Claude Fable 5 و GPT 5.6 Sol تكشف حدود التوسع دون اختراقات معمارية وبياناتية.
2026-07-27
التمويل العاملي
الصندوق الأسود لمحفظتك على وشك الانفتاح: من الداخل في أول متتبّع حي للتمويل العاملي
يسجل NextFund كل قرار يتخذه وكيل تداول بالذكاء الاصطناعي في الأسواق الحية، مما يسمح للمستخدمين بمقارنة النماذج، وفحص الأساس المنطقي، وتشخيص حالات الفشل. يُظهر اختبار عبر ثمانية نماذج LLM على أسهم الولايات المتحدة والصين وهونغ كونغ أن الإشارات الوسيطة المتشابهة يمكن أن تتباعد إلى سلوكيات محفظة مختلفة بشكل كبير، وأن التصنيفات الربع سنوية تتغير اعتمادًا على المقياس الأكثر أهمية.
2026-07-27
أبحاث الذكاء الاصطناعي
عندما تعرف الرسم البياني ما لم تتعلمه: نموذج متعلم من نوع جديد
يجمع MR-ConceptGCN بين الرسوم البيانية المعرفية الشخصية وشبكات GCN متعددة العلاقات وتضمينات SBERT لإنتاج نماذج متعلم متسلسلة. في دراسة شملت 31 شخصًا، حسّن دقة التوصيات وفائدتها وتنوعها ورضى المستخدمين مقارنة بالأساليب الأساسية.
2026-07-26
التكلفة مقابل القدرة
النموذج الذي يكلف 1.40 دولار يفوز على شقيقه البالغ 2.82 دولار في اختبار الفيزياء
طُلب من أربعة نماذج ذكاء اصطناعي بناء مشاهد HTML مع فيزياء حقيقية. اجتاز أوبوس 5 جميع الثلاثة بأقل تكلفة بين الأداء المتميز، بينما فشل فابل 5 في كل واحدة بسعر مضاعف.
2026-07-25
بحث
فجوة الإشراف في التعلم المعزز للوكلاء تحصل على حل من منظور الماضي
SEED (التقطير الذاتي التطور داخل السياسة) يسمح لنموذج لغوي كبير بتحليل مساراته السابقة، واستخراج مهارات قابلة لإعادة الاستخدام بلغة طبيعية من منظور الماضي، ثم تقطير تلك الدروس مرة أخرى في سياسته أثناء التعلم المعزز. النتيجة: إشراف أكثر كثافة ومتوافق مع السياسة يحسن كفاءة العينة ويعمم على مهام غير مرئية.
2026-07-25
نماذج الذكاء الاصطناعي
كلود أوبوس 5 يحقق أداءً قريبًا من الحدود الأمامية بنصف التكلفة، مع نقطة عمياء متعمدة في الأمن السيبراني
يطلق كلود أوبوس 5 بنتائج قريبة من فابل في معايير البرمجة والمعرفة بنصف السعر. لكن قدراته الضعيفة عمدًا في الأمن السيبراني تخلق مقايضة واضحة للمطورين.
2026-07-24