أبحاث الذكاء الاصطناعي
18 published articles
وكلاء الذكاء الاصطناعي
منحت PsychoAgent وكلاء الذكاء الاصطناعي ذاكرة عاطفية. لم يجد المقيّمون أي تفوّق
يمنح PsychoAgent وكلاء نماذج اللغات الكبيرة (LLM) ذاكرة عاطفية منفصلة بحيث يمكن للآثار البارزة عاطفيًا والمحملة بالصراعات أن تتفوق على الآثار الموضوعية البحتة. في ثلاثة سيناريوهات صراعية، استرجع ذكريات حرجة للصراع أكثر من خطي الأساس معًا (0.933 مقابل 0.500 و0.667)، ومع ذلك لم يجد خمسة مقيّمين مُعَمّين أي تفوّق نوعي ذي دلالة.
2026-08-19
أبحاث الذكاء الاصطناعي
ذكاء اصطناعي «رئيس» يتجاهل الردود فيدفع مرؤوسه إلى حالة «غريبة»
تجد ورقة بحثية جديدة على arXiv أن وكلاء الذكاء الاصطناعي يتصرفون بشكل مختلف في التفاعل عمّا هم عليه في العزلة. وكيل رئيس يتجاهل ردود مرؤوسه فيدفعه إلى حالة «غريبة»، وعندما يستمع الرئيس، يتحول كلاهما معًا. النتيجة تجعل طريقة تسليم الرسائل قرارًا تصميميًا في الأنظمة متعددة الوكلاء.
2026-08-19
أبحاث الذكاء الاصطناعي
توقف عن نسخ المهارات ولصقها: حل SkillZip الخالي من التقييم للوكلاء المتضخمين
تضيف الوكلاء ذاتية التطوّر إصلاحات حتى تظهر القاعدة نفسها في فروع متعددة. يضغط SkillZip مهاراتها دون عمليات محاكاة تقييمية، عبر إيجاد أقصر تفسير بنيوي وفيّ. وضعا One-shot وZip-on-Write، وما يتركه الملخص دون إثبات.
2026-08-15
أبحاث الذكاء الاصطناعي للفيديو
كيف يوقف التقطير المطابق للسياق معلمي الفيديو عن رؤية المستقبل
درّب تقطير الفيديو طويلًا طلابًا سببيين ضد معلّمين يقيّمون مقاطع كاملة بمعرفة مستقبلية. يستبدل CMD هذا التقييم بمعلّم سببي، ويضيف أهدافًا تُقيَّم بادئيًا، ويفيد بنتائج من الطراز الأول بين الأساليب الانحدارية الذاتية.
2026-08-14
أبحاث الذكاء الاصطناعي
«ذاكرة الصوت» (Voice Memory): ملف بحجم 776 بايت يخبر التعرف على الكلام متى لا يفعل شيئًا
طريقة جديدة تعتمد على الاستنتاج فقط في التعرف على الكلام تتعلم ضبط النفس: مُصحِّح مجمَّد يقرأ ملف ذاكرة خاصًا بكل مجال ويقرر متى يمتنع عن التصحيح. التصحيح غير المقيد يكسر الرموز الصحيحة في ما يصل إلى 64% من التعديلات؛ وتخفض «ذاكرة الصوت» (Voice Memory) هذه النسبة إلى 35%، مع خفض معدل خطأ الكلمات الموزون من 8.36% إلى 7.52%.
2026-08-06
عوامل الذكاء الاصطناعي
معاملة إجراءات التشغيل القياسية كرمز برمجي: بيئة تشغيل جديدة مكدسة الصفحات تفصل بين العوامل القوية والضعيفة
تظهر أبحاث جديدة من هونغ كونغ والصين القارية أن تجميع إجراءات التشغيل القياسية في كود زائف قابل للتنفيذ وتشغيلها على آلة افتراضية مكدسة الصفحات يفصل بوضوح بين العوامل القادرة والعوامل الهشة. ينتج عن العمل قاعدة نشر دقيقة: قم بالتجميع أولاً، ثم قم بالترقيم فقط بعد التحقق من الانضباط على مستوى النموذج.
2026-08-04
تقييم الأداء
نماذج الرؤية الذكية الرائدة تفشل في الإدراك الأساسي، وفقًا لمعيار جديد
يختبر PerceptionBench عشر قدرات بصرية ذرية عبر 3000 سؤال. لم ينجح أي نموذج رائد في تجاوز 60%، وتخفي الدرجات الإجمالية المتشابهة ملفات ضعف مختلفة للغاية.
2026-08-03
معيار TRACTA
الاستدلال العصبي-الرمزي يتفوق على النماذج العصبية الخام في المهام الزمنية، معيار TRACTA يكشف
يكشف معيار TRACTA أن الذكاء الاصطناعي العصبي-الرمزي يتفوق على النماذج العصبية الخام في ثلاث مهام استدلال زمني، مع أكبر الهوامش في الإنذار المبكر واكتشاف الأنماط.
2026-08-02
الذكاء الاصطناعي
لماذا يضيع نموذج الذكاء الاصطناعي الرموز في سلسلة أفكاره، وكيف يصلح التوقف الأمثل ذلك
يقترح باحثو MIT أداة OS-Pruner، وهي إضافة إضافية توقف تفكير سلسلة الأفكار ديناميكيًا عندما لا تستحق التكلفة الحسابية الرموز الإضافية. تظهر الاختبارات تقليل الطول بنسبة 20-60% مع تضحية ضئيلة بالدقة.
2026-07-29
أبحاث الذكاء الاصطناعي
SoftReason يسد الفجوة التدرجية التي منعت الشبكات العصبية من التفكير المنطقي حقًا
SoftReason هي بنية عصبية-ناعمة-رمزية قابلة للتفاضل بالكامل للاستدلال الاستنباطي. تزيل الحاجز التدرجي بين الإدراك والاستنباط، مما يتيح التدريب من البداية إلى النهاية على البيانات الإدراكية عالية الأبعاد وثلاثيات الرسم البياني المعرفي. تم اختبارها على KVQA، وتوضح كيف يمكن للاستدلال الناعم أن يوحد التثبيت وحقن الأدلة والإغلاق.
2026-07-26
الذكاء الاصطناعي متعدد الوسائط
لماذا تحتاج نماذج الرؤية واللغة إلى نافذة ترحيل بصرية لوقف التخيل
يكشف بحث جديد عن إعادة توزيع مستقرة ثلاثية المراحل للانتباه متعدد الوسائط في نماذج الرؤية واللغة، تم تفعيلها كنافذة الترحيل البصري (VRW). يستخدم إطار عمل TRACE وحدات مدربة خفيفة الوزن لتحديد مواعيد هذه النافذة لكل مهمة، مما يحسن معايير الحساسية للتثبيت بمتوسط 4.33 نقاط ويصل إلى 6.6 نقاط.
2026-07-23
بحث في الذكاء الاصطناعي
Qwen-music يضع اللحن في المقدمة، والنتائج تتحدث عن نفسها
يحقق Qwen-Music تقدماً جديداً من خلال التخطيط الصريح للألحان قبل توليد الأغاني الكاملة، وهي تقنية يسميها الفريق Melody-CoT. يحقق النموذج نتائج متطورة في 13 من أصل 16 مقياساً موضوعياً، وفي الاختبارات العمياء، يفوز ضد Suno V5 وMiniMax Music 2.6.
2026-07-20