وكلاء الذكاء الاصطناعي
العوامل المستقلة، سير العمل متعدد الوكلاء والتنسيق.
45 published articles
أدوات التصميم
أوبن ديزاين 0.18.0 ينهي اجتماع «هل هذه أحدث نسخة؟»
يوفّر أوبن ديزاين 0.18.0 مساحة عمل جماعية مشتركة بمرايا مباشرة للقراءة فقط، ويتيح لـ Codex استدعاء محرك التصميم بدون واجهة. وصل 115 طلب سحب من 22 مساهمًا في يومين. إليك ما تغيّر واتجاه أدوات الوكلاء الذي يندرج فيه.
2026-08-21
ذاكرة الوكلاء
TEPA: بالنسبة لوكلاء الذكاء الاصطناعي، الذاكرة المتقادمة أسوأ من غيابها
يجادل بحث أولي جديد على arXiv بأن ذاكرة الوكلاء تعاني مشكلة قابلية الدحض: فالحقائق القديمة تظل قابلة للاسترجاع وتلوث الاستعلام (البرومبت). تلغي آلية TEPA الذكريات التي تجاوزتها الأدلة، وفي اختبارات الانجراف سجلت الذاكرة الساذجة (0.210) أدنى من غياب الذاكرة (0.309) بينما بلغت TEPA 0.950.
2026-08-19
وكلاء الذكاء الاصطناعي
منحت PsychoAgent وكلاء الذكاء الاصطناعي ذاكرة عاطفية. لم يجد المقيّمون أي تفوّق
يمنح PsychoAgent وكلاء نماذج اللغات الكبيرة (LLM) ذاكرة عاطفية منفصلة بحيث يمكن للآثار البارزة عاطفيًا والمحملة بالصراعات أن تتفوق على الآثار الموضوعية البحتة. في ثلاثة سيناريوهات صراعية، استرجع ذكريات حرجة للصراع أكثر من خطي الأساس معًا (0.933 مقابل 0.500 و0.667)، ومع ذلك لم يجد خمسة مقيّمين مُعَمّين أي تفوّق نوعي ذي دلالة.
2026-08-19
البرمجة بالوكلاء وتضخّم التعليمات
التذكّر الكارثي: لماذا تنمو ملفات CLAUDE.md بنسبة 226% ولا تنكمش أبدًا
دراسة على arXiv لـ1,867 مستودعًا تجد أن ملفات تعليمات البرمجة بالوكلاء مثل CLAUDE.md تتضاعف ثلاث مرات في الحجم على مدى عمرها، لأن حذف سطر يخاطر بحدوث انتكاسات بمجرد فقدان مبرره. يسمّي المؤلفون ذلك التذكّر الكارثي ويُظهرون أن توثيق المنطق يقلّص التعليمات الزائدة بنسبة 99.3%.
2026-08-15
أبحاث الذكاء الاصطناعي
توقف عن نسخ المهارات ولصقها: حل SkillZip الخالي من التقييم للوكلاء المتضخمين
تضيف الوكلاء ذاتية التطوّر إصلاحات حتى تظهر القاعدة نفسها في فروع متعددة. يضغط SkillZip مهاراتها دون عمليات محاكاة تقييمية، عبر إيجاد أقصر تفسير بنيوي وفيّ. وضعا One-shot وZip-on-Write، وما يتركه الملخص دون إثبات.
2026-08-15
وكلاء الذكاء الاصطناعي
عندما تأتي مهارات الوكلاء بنتائج عكسية، يقلّمها SkillProx مثل النزول التدرجي
كان من المفترض أن تجعل المهارات الوكلاء أكثر ذكاءً، لكن كل إصلاح يتراكم لديهم قد يجعلهم أكثر غباءً. يدير SkillProx حلقة أمامية-خلفية مستوحاة من التدرج التقريبي تشخّص الانحدارات وتتراجع عنها وتحذفها. النتيجة: تحسن متوسط في الدقة بمقدار 3.0 نقاط مقارنة بأقوى خط أساس قائم على التدرج.
2026-08-14
أمان الطرفية
فخ '$HOME': وكلاء البرمجة بالذكاء الاصطناعي يحتاجون إلى صناديق رمل، لا إلى مطالبات 'allow?'
يحظر صندوق رمل الطرفية في Qoder ما يقارب مئة أمر وكيل مدمر يوميًا. الحالات التي تقف خلف هذا الحظر تشرح لماذا تفشل مطالبات 'allow?': مجلد مشروع باسم $HOME، وعملية تنظيف استهدفت /root، ونقرة كادت تكلف قرصًا كاملًا.
2026-08-13
الذكاء الاصطناعي السريري
nMAS يؤتمت ميزات فشل القلب في السجلات الصحية الإلكترونية، واختُبر على 500 مريض وهمي فقط
ولّد nMAS، خط أنابيب متعدد الوكلاء، 132 ميزة بنيوية و70 ميزة مُقيَّمة وفق معايير من 500 سجل مريض وهمي، رافعًا AUROC للتنميط الظاهري لـ HFrEF على المجموعة المحجوزة من 0.895 إلى 0.963. لم يُتحقق من البحث الأولي على بيانات مرضى حقيقيين.
2026-08-13
Qoder Computer Use
مهندس واحد أطلق وكيل macOS دون أن يعرف Swift
أصدر مهندس لا يستطيع قراءة Swift برنامج macOS بجودة إنتاجية باستخدام Computer Use من Qoder. منهجه: الحكم على الكود من خلال السلوك، وجعل الوكيل يولد اختباراته الخاصة، والاحتفاظ بكل درس في نظام الملفات حتى لا تبدأ أي جولة من الصفر.
2026-08-12
وكلاء الذكاء الاصطناعي وDevOps
سؤال من جملة واحدة في Qoder ينهي البحث عن السبب الجذري الذي استغرق 40 دقيقة
إضافة STAROps من Alibaba Cloud تضفي تشخيص السبب الجذري باللغة الطبيعية إلى بيئة التطوير المتكاملة Qoder. عرضها التجريبي يتناول قفزة في P95 من أقل من 60 مللي ثانية إلى 1.9 ثانية، ويعيد سلسلة أدلة بدرجة ثقة 80%، وينتهي بطلب دمج مُنشأ تلقائيًا. استغرقت عمليات استكشاف الأخطاء التقليدية أكثر من 40 دقيقة عبر خمس منصات.
2026-08-09
واجهات وكيلية
Qoder Canvas: نظام تصميم صُنع للوكلاء، لا للبشر
يرى فريق Qoder في Alibaba أن نافذة الدردشة ليست الحاوية المناسبة لمخرجات الوكلاء المعقدة. يطبّق Qoder Canvas تفكير أنظمة التصميم على واجهات الوكلاء، ليعلم الوكلاء بناء مصنوعات تفاعلية واعية بقاعدة التعليمات البرمجية بدلًا من جدران Markdown.
2026-08-07
البرمجة بالذكاء الاصطناعي
OpenCode يراهن على كفاءة التوكنات بإضافة Ling 3.0 Flash مجانًا
يعرض OpenCode الآن نموذج Ling 3.0 Flash من inclusionAI مجانًا، بعد أيام من إطلاقه. وتُوسّع هذه الخطوة استراتيجية مراعية للتكلفة تراهن على أن كفاءة التوكنات هي التي تكسب سباق البرمجة بالذكاء الاصطناعي.
2026-08-07