معايير الذكاء الاصطناعي

19 published articles

المختبرات والأبحاث1 min read

تحليل

المعايير، وليس الصفقات: مختبرات الذكاء الاصطناعي الصينية تصل إلى التكافؤ

أظهرت مختبرات الذكاء الاصطناعي الصينية: تشيوان، ديب سيك، ميني ماكس، وكيمي أنها تضاهي أو تتفوق على النماذج الحدودية الأمريكية في معايير الاستدلال والبرمجة وتحليل المستندات. بفضل التسعير القوي واستراتيجيات الأوزان المفتوحة، لم تعد مجرد بدائل رخيصة، بل أصبحت منافسين حقيقيين.

2026-07-27

نماذج اللغات الكبيرةFeatured3 min read

الذكاء الاصطناعي مفتوح المصدر

Kimi K3 هو أكبر نموذج مفتوح على الإطلاق. لكنه ليس الأفضل بعد.

Kimi K3 هو أكبر نموذج مفتوح بـ 2.8 تريليون معامل، لكنه يفشل في التفوق على أفضل النماذج المملوكة في المعايير العامة. بينما يتفوق في مهام الترميز والوكالة المحددة، فإن الفجوة مع القادة الحدوديين مثل Claude Fable 5 و GPT 5.6 Sol تكشف حدود التوسع دون اختراقات معمارية وبياناتية.

2026-07-27

الذكاء الاصطناعي4 min read

الذكاء الاصطناعي

أربعة وكلاء أفضل من واحد: ARCANA تحل ARC-AGI-2 بالتحاور الذاتي

باحثون من عدة مؤسسات يقترحون ARCANA، وهو نظام متعدد الوكلاء يحلل ألغاز ARC-AGI-2 إلى إدراك، توليد فرضيات، تنفيذ رمزي، وتحسين تأملي. بنيته المعيارية ووحدة التحكم الفوقية المُتعلمة تعزز كفاءة التفكير، لكن الورقة تترك أسئلة رئيسية حول التعميم وتكلفة الحوسبة دون إجابة.

2026-07-19

الذكاء الاصطناعي1 min read

Orchestrator swap

بيربلكسيتي تجعل جروك 4.5 نموذج التنسيق الأعلى في كمبيوتر، متغلبًا على أوبوس 4.8 بنصف التكلفة

تقول بيربلكسيتي إن جروك 4.5 تفوق على خمسة تكوينات تنسيق أخرى في اختبار WANDR الداخلي، متجاوزًا كلود أوبوس 4.8 في الدقة بتكلفة تقارب النصف، وهو متاح الآن في "كمبيوتر" لمشتركي Pro وMax.

2026-07-14

الذكاء الاصطناعيFeatured1 min read

Benchmark integrity

GPT-5.6 Sol (max) يتصدر معيار CritPt، وهو معيار جديد لمشكلات أبحاث الفيزياء غير المنشورة

يتصدر GPT-5.6 Sol (max) معيار CritPt، وهو معيار فيزياء جديد مبني من مشكلات أبحاث غير منشورة على مستوى الدراسات العليا، مسجلاً حوالي 5 نقاط أعلى من GPT-5.5 و4 نقاط أعلى من Claude Fable 5، وفقًا لاختبارات مستقلة أجرتها شركة Artificial Analysis.

2026-07-13

برمجة ذكية7 min read

نشر الذكاء الاصطناعي الحدودي

كلود فابل 5 وميثوس 5: مستقبل الذكاء الاصطناعي هو الذكاء المقيد بالقدرات

يجلب كلود فابل 5 من أنثروبيك قدرات من فئة ميثوس إلى المستخدمين العموميين، بينما يظل ميثوس 5 للوصول الموثوق فقط. يمثل نموذج النشر، توجيه القدرات، مصنفات التجاوز، والوصول المتدرج، تحولاً جوهرياً في كيفية إصدار واستخدام الذكاء الاصطناعي الحدودي.

2026-07-10

الذكاء الاصطناعي4 min read

الذكاء الاصطناعي

IFBench: المعيار الجديد لاختبار اتباع الذكاء الاصطناعي للتعليمات

يقيس IFBench قدرة نماذج اللغة على اتباع تعليمات دقيقة باللغة الطبيعية، وهي قدرة رئيسية ولكن غالبًا ما يتم تجاهلها. تُظهر النتائج المبكرة تقدم نماذج xAI's Grok، بينما تتخلف نماذج Claude رغم حصولها على درجات ذكاء إجمالية عالية.

2026-07-07

← PreviousPage 2 / 2 · 19 articlesNext →