معايير البرمجة
2 published articles
وكلاء البرمجة بالذكاء الاصطناعي
نموذج Qwen-Coder-Qoder من علي بابا يتفوق على Cursor في اختبارها الخاص ويخفض استهلاك الرموز بنسبة 14.5%
نموذج البرمجة الجديد من علي بابا Qwen-Coder-Qoder يتفوق على Cursor Composer-1 في معيار Qoder Bench. تُظهر مقاييس الإنتاج زيادة بنسبة 3.85% في الاحتفاظ بالكود، وانخفاضًا بنسبة 61.5% في أخطاء الأدوات، وتقليصًا بنسبة 14.5% في استهلاك الرموز. يدرب النموذج على آثار الوكلاء الحقيقية من خلال إطار عمل المكافأة والمهاجم لمواجهة اختراق المكافآت.
2026-07-23
وكلاء الذكاء الاصطناعي
وكلاء الذكاء الاصطناعي لا يستطيعون إكمال ترحيل Java دون أن يمنعهم خادم البناء
تقدم IBM Research معيار ScarfBench المفتوح لتقييم وكلاء الذكاء الاصطناعي في ترحيل إطار عمل Java للمؤسسات. تكشف الاختبارات المبكرة أن الوكلاء المتقدمين مفرطون بشكل منهجي في الثقة بنتائجهم الخاصة، وأن طبقات التكوين تهيمن على الجهد، وأن المشكلات البيئية مثل ذاكرة التخزين المؤقت لـ Docker تعرقل عمليات الترحيل بانتظام حتى عندما تنجح تحويلات التعليمات البرمجية.
2026-07-06