معايير البرمجة

2 published articles

Qwen / AlibabaFeatured4 min read

وكلاء البرمجة بالذكاء الاصطناعي

نموذج Qwen-Coder-Qoder من علي بابا يتفوق على Cursor في اختبارها الخاص ويخفض استهلاك الرموز بنسبة 14.5%

نموذج البرمجة الجديد من علي بابا Qwen-Coder-Qoder يتفوق على Cursor Composer-1 في معيار Qoder Bench. تُظهر مقاييس الإنتاج زيادة بنسبة 3.85% في الاحتفاظ بالكود، وانخفاضًا بنسبة 61.5% في أخطاء الأدوات، وتقليصًا بنسبة 14.5% في استهلاك الرموز. يدرب النموذج على آثار الوكلاء الحقيقية من خلال إطار عمل المكافأة والمهاجم لمواجهة اختراق المكافآت.

2026-07-23

وكلاء الذكاء الاصطناعي4 min read

وكلاء الذكاء الاصطناعي

وكلاء الذكاء الاصطناعي لا يستطيعون إكمال ترحيل Java دون أن يمنعهم خادم البناء

تقدم IBM Research معيار ScarfBench المفتوح لتقييم وكلاء الذكاء الاصطناعي في ترحيل إطار عمل Java للمؤسسات. تكشف الاختبارات المبكرة أن الوكلاء المتقدمين مفرطون بشكل منهجي في الثقة بنتائجهم الخاصة، وأن طبقات التكوين تهيمن على الجهد، وأن المشكلات البيئية مثل ذاكرة التخزين المؤقت لـ Docker تعرقل عمليات الترحيل بانتظام حتى عندما تنجح تحويلات التعليمات البرمجية.

2026-07-06