Features

In-depth special reports combining feature, analysis, interview and profile reporting.

31 published features

6 min read

نماذج الفيديو الحدودية: تقرير خاص

Perceptron Mk1 يراهن على مستقبل ذكاء الفيديو في المشاهدة لا في التوليد

Perceptron Mk1 نموذج لغوي-بصري مغلق المصدر مُسعّر للاستخدام المستمر، موجّه نحو فهم الفيديو الموقّع زمنيًا والاستدلال المتجسّد. سباق ذكاء الفيديو الحقيقي لا يدور حول صنع مقاطع أجمل، والمعايير التي تمزج الفئتين معًا تضلل.

2026-08-06

Featured4 min read

سلامة الذكاء الاصطناعي

شيلدسترال، المصنّف ثلاثي المليارات الذي يتفوق على نماذج أكبر منه بسبع مرات

مصنّف سلامة بحجم 3B يضاهي نماذج نصية أكبر منه بنحو سبع مرات ويحقق مستوى متقدمًا جديدًا في التصفية متعددة الوسائط، وفقًا لورقة arXiv في يوليو 2026. الحيلة: إعادة صياغة التصفية كإجابة عن سؤال ثنائي، مع التدريب على نحو 54.1 مليون عينة.

2026-08-05

Featured5 min read

تقييم الذكاء الاصطناعي

المعايير القديمة للذكاء الاصطناعي تعطلت. إليك ما حل محلها.

المعايير الثابتة مثل MMLU وGSM8K مشبعة وملوثة. انتقلت الصناعة إلى إعادة التوليد الديناميكي والامتحانات الخبيرة وبيئات المهام الوكيلية للحصول على قياس حقيقي لقدرة الذكاء الاصطناعي.

2026-08-04

5 min read

عوامل الذكاء الاصطناعي

معاملة إجراءات التشغيل القياسية كرمز برمجي: بيئة تشغيل جديدة مكدسة الصفحات تفصل بين العوامل القوية والضعيفة

تظهر أبحاث جديدة من هونغ كونغ والصين القارية أن تجميع إجراءات التشغيل القياسية في كود زائف قابل للتنفيذ وتشغيلها على آلة افتراضية مكدسة الصفحات يفصل بوضوح بين العوامل القادرة والعوامل الهشة. ينتج عن العمل قاعدة نشر دقيقة: قم بالتجميع أولاً، ثم قم بالترقيم فقط بعد التحقق من الانضباط على مستوى النموذج.

2026-08-04

Featured8 min read

تقرير خاص: تقييم الذكاء الاصطناعي

حالة قياس أداء الذكاء الاصطناعي في عام 2026: انهيار الاختبارات الثابتة والأنظمة التي حلت محلها

جولة شاملة في مشهد قياس أداء الذكاء الاصطناعي لعام 2026: لماذا انهارت MMLU وGSM8K وHumanEval، وكيف حلت محلها المعايير الديناميكية والامتحانات الخبيرة مثل HLE وGPQA Diamond، وما يكشفه اختبار العوامل والذكاء المتعرج، وكيف تكمل الآن التفضيلات البشرية، ومحكمو نماذج اللغات الكبيرة، والمراقبة الإنتاجية مجموعة التقييم الكاملة.

2026-08-03

5 min read

الذكاء الاصطناعي

كيف علم نظام الذاكرة المزدوجة الذكاء الاصطناعي تشخيص الأعطال التي ينسى باستمرار

يجمع OpsMem بين ذاكرة قصيرة المدى (STM) لحالة التشخيص المتطورة وذاكرة طويلة المدى (LTM) للخبرات التشغيلية القابلة لإعادة الاستخدام. من خلال آلية تسمى الرنين عبر الذاكرة، يقوم النظام بتنشيط الخبرات ذات الصلة بالحالة من LMT لتوجيه التشخيص متعدد الوكلاء. على مجموعة بيانات خدمات مصغرة من هواوي، تفوق على خطوط الأساس القائمة على الاستدلال الوكيل والمعرفة بفارق كبير.

2026-08-03

5 min read

تفسير الذكاء الاصطناعي

يمكن الآن تتبع قرارات شبكتك العصبية إلى حالات تدريبية محددة

يظهر الباحثون أن درجات إجراءات الشبكة العصبية يمكن التعبير عنها كمجموعات موزونة بدقة من عوائد حالات التدريب باستخدام هندسة غرام. يسمح هذا بإشارات تدقيق بعد التدريب تحدد الحالات المؤثرة، وتقيس تماسك الإجراءات، وتكشف عن الدعم الضعيف، دون إعادة تدريب أو الوصول إلى مسار التحسين الأصلي.

2026-08-03

3 min read

بحث في الذكاء الاصطناعي

لماذا يُعد الاحتمال اللوغاريتمي للرموز إشارة خاطئة لمراقبة نماذج التفكير في الذكاء الاصطناعي

تظهر Novelis Research أن الاحتمال اللوغاريتمي للرموز يفشل كمراقب لفك الترميز لنماذج التفكير المكممة، كونه أعمى عن الحلقات الواثقة. يقدمون وحدة تحكم e-CUSUM معايرة تجمع بين إشارات عدم اليقين والتكرار، محققة انتقائية على GSM8K مع DeepSeek-R1-Distill-Qwen-1.5B.

2026-08-03

4 min read

بحوث الذكاء الاصطناعي

رغوة في سلسلة الأفكار: معيار جديد يكشف كيف تهدر LLMs الرموز في استدلال صحيح لكنه عديم الفائدة

غالبًا ما تولد LLMs سلاسل استدلال صحيحة ولكنها محشوة بخطوات غير ضرورية. يظهر معيار تشخيصي جديد وطريقة ضغط أن المقيمين الحاليين يغفلون تمامًا عن هذا عدم الكفاءة وأن نصف خطوات الاستدلال التي كتبها البشر قد تكون قابلة للضغط.

2026-07-31

3 min read

الرياضيات الشكلية

كيف تمكن مختبر صيني من كسر عنق الزجاجة في البرهان الرياضي المعزز بالذكاء الاصطناعي

إطار عمل ToMap من جامعة نانجينغ يحقق نتائج متطورة في التحليل الشكلي الكامل للبرهان من خلال تحديد خطوة التفكيك كعنق الزجاجة الحرج. باستخدام تطور متكرر موجه بـ Pareto لتفكيك البرهان، يرفع ToMap الدقة التركيبية-الدلالية المشتركة بنسبة 19% على معيار ProofFlowBench مع تقليل تكاليف وقت الاختبار.

2026-07-30

5 min read

بحث

ست كلمات قد تعيد تشكيل كيفية استكشاف وكلاء الذكاء الاصطناعي والبقاء آمنين: تعطيل، تحقق، وسيط

تقترح بنية فريق وكيل غير متجانسة جديدة فصل الاستكشاف التباعدي، وفحص السلامة في وقت التشغيل، واسترجاع المعرفة عبر المجالات إلى أدوار متخصصة. يولد المُعطل مقترحات عالية الإنتروبيا، ويطبق المُتحقق فحوصات صلبة لاستدعاءات الأدوات، ويستورد الوسيط تشبيهات خارج المجال عبر استرجاع التباين الجديد. تُجمع إخفاقات التنفيذ في رقع قيود موقعة تُسمى الندوب، مخزنة مؤقتاً للأجيال القادمة. في التقييمات، حقق الفريق اكتشاف هدف ناءٍ بنسبة 95%، وصفر انتهاكات منفذة، وتوفير بنسبة 15.1% في الرموز من الندوب، مع تخفيض التكلفة بنسبة 55.9% تحت قيود الموارد عبر تخصيص عرض النطاق الترددي القائم على الائتمان.

2026-07-30

4 min read

تحليلات المؤسسات

QwenPaw-Data من علي بابا تريد أن تكون الطبقة المفقودة بين محللي الأعمال وبياناتهم

يقدم QwenPaw-Data من علي بابا بنية ثلاثية الأنظمة الفرعية، DataBridge، وSkill-Hub، وHost، لتحويل بيانات المؤسسات المجزأة إلى أصول تحليلية قابلة لإعادة الاستخدام. تظهر التقييمات المبكرة مكاسب كبيرة مقارنة بالأنظمة الحالية في كل من المعايير العامة وأعباء العمل الخاصة بالذكاء التجاري الصناعي.

2026-07-30

← PreviousPage 1 / 3 · 31 featuresNext →