هندسة الوكلاء المتعددين
تجربة Qoder مع الوكلاء المتعددين: أخطاء أقل بنسبة 60%، ولكن بأي ثمن؟
تحليل لوضع خبراء Qoder من Alibaba Cloud، الذي ينشر وكلاء ذكاء اصطناعي متخصصين كفريق منسق. يتم فحص ادعاءات تقليل الأخطاء الكبيرة مقابل حالات الاستخدام الواقعية والمقايضات المرتبطة بتعقيد الوكلاء المتعددين.
Emmanuel Fabrice Omgbwa Yasse بمساعدة الذكاء الاصطناعي
2026-07-31 · قراءة 2 دقائق

لأشهر، اتبعت أدوات البرمجة بالذكاء الاصطناعي إلى حد كبير الصيغة نفسها: توجيه، توليد، تكرار. تختبر Qoder من Alibaba Cloud نهجًا مختلفًا مع وضع الخبراء (Experts Mode)، وهو نظام يقسّم المهام المعقدة إلى أجزاء ويسلّم كل جزء إلى وكيل متخصص يعمل بالتوازي مع بقية الوكلاء، وهي استراتيجية يحددها بحث جديد بأنها ساحة المعركة التالية للتنسيق.
وعد البرمجة متعددة الوكلاء
بدلًا من نموذج واحد يعمل خطوة بخطوة بشكل تسلسلي، يجمّع وضع الخبراء فريقًا افتراضيًا. يقوم وكيل قائد الفريق (Team Lead) بتفكيك المتطلبات، ثم يوزع العمل على وكلاء الواجهة الأمامية (Frontend) والخلفية (Backend) وضمان الجودة (QA) والمراجعة (Review)، وكلٌّ منها مُعاير لمجاله. تقول الشركة إن هذا يقلل من تبديل السياق والاستدلال المكرر، منتجًا ما تدّعي أنه نتائج أكثر دقة مما يمكن لأي وكيل منفرد تحقيقه. ويستند هذا إلى فلسفة "الرؤية أولًا" التي قدمتها Qoder سابقًا، عبر توسيعها لتشمل التنسيق على مستوى الفريق، على غرار كيفية توجيه Claude Code للمهام إلى نماذج مختلفة.
قياس تحسُّن الـ60%
تُظهر المعايير الداخلية لـ Qoder على المهام المعقدة مثل تطوير الحزمة الكاملة (full-stack) وإعادة الهيكلة عبر اللغات وتنفيذ الميزات، انخفاضًا في معدل الأخطاء بنسبة 60%، ومهام إعادة تنفيذ أقل بنسبة 50%، وزيادة بنحو 11.6 نقطة في معدل النجاح. وتشير الشركة إلى أن التكاليف تظل ثابتة أو تنخفض مقارنة بخط الأساس أحادي الوكيل على المهام نفسها. هذه الأرقام مثيرة للإعجاب، لكنها تأتي من مجموعة الاختبارات الخاصة بشركة Alibaba، وليس من تقييم خارجي. الدرس الأوسع، الذي يتردد صداه في انتقادات النطاق الضيق لـ HumanEval، ينطبق هنا: الاختبارات المنتقاة تميل إلى صالح النظام الذي يجري اختباره، وتُدخل ظروف الإنتاج ضوضاء لا يمكن لأي معيار التقاطها بالكامل.
سيناريوهات العالم الحقيقي: أين يتألق وضع الخبراء
حالات الاستخدام الثلاث التي تسلط Qoder الضوء عليها مُنتقاة بعناية. بناء وحدة إدارة مستخدمين كانت تستغرق أيامًا سابقًا يمكن الآن تسليمها في غضون ساعات عبر التنفيذ المتوازي وكتابة الاختبارات في الوقت نفسه. تصحيح اختناق الأداء عبر الخدمات المصغرة يتحول إلى تتبع تعاوني عبر السجلات وسلاسل الاستدعاءات. البحث في جدوى الانتقال إلى GraphQL يحصل على مدخلات من وجهات نظر متعددة في آن واحد. كل سيناريو يتضمن ملفات أو خدمات متعددة، ومسائل فرعية واضحة، ونتائج قابلة للقياس. هذه هي بالضبط نوع المهام التي يجب أن يضيف فيها التنسيق متعدد الوكلاء قيمة، والتي تتدهور فيها عادةً أدوات الوكيل الواحد مع امتلاء نوافذ السياق. ومع ذلك، فإن القفزة من العرض التجريبي إلى الاستخدام اليومي ليست بالأمر الهيّن. فغالبًا ما يكشف الاستخدام في الإنتاج أنماط فشل تتجاهلها العروض التجريبية، مثل خلاف الوكلاء حول الواجهات أو الأخطاء المتتالية عندما يسيء أحد المتخصصين تفسير متطلب ما، وهو نمط يُعرف باسم فخ التخطيط في الأنظمة الوكيلية.
القيود وخيار الوكيل المنفرد
تعترف Alibaba بأنه بالنسبة لتعديلات الملفات البسيطة، فإن
أهم أخبار التقنية في 3 دقائق كل صباح
بريد إلكتروني واحد، كل يوم عمل، بما يهم فعلاً في الذكاء الاصطناعي والتقنية.