وكلاء البرمجة بالذكاء الاصطناعي
7 published articles
وكلاء الذكاء الاصطناعي
لا أحد يستطيع أن يقول ما الذي أنجزه وكلاء الترميز بالذكاء الاصطناعي اليوم بالفعل
تنفق الشركات بكثافة على وكلاء البرمجة بالذكاء الاصطناعي ولا يمكنها رؤية ما فعله هؤلاء الوكلاء بالفعل، والمعايير التي تقيس تحسنهم قد تكون مُجهزة بشكل زائد (overfit) لمجموعات الاختبار العامة، والكود الذي يكتبونه لا يُراجع افتراضيًا. ثلاث مشاكل منفصلة بنفس السبب الجذري: التبني تجاوز الأدوات اللازمة لمراقبته.
2026-07-30
مراقبة الوكلاء
وكلاء البرمجة بالذكاء الاصطناعي يحرقون الملايين ولا أحد يعرف أين
تنفق المؤسسات بكثافة على وكلاء البرمجة بالذكاء الاصطناعي دون أي رؤية لسلوكهم الفعلي. مشروع مفتوح المصدر جديد من Alibaba Cloud يهدف إلى سد فجوة المراقبة هذه، لكن المشكلة الأساسية على مستوى الصناعة: لا يمكن لأحد تتبع ما يفعله هؤلاء الوكلاء.
2026-07-26
مؤتمر المطورين العالمي (WWDC)
آبل تفتح حديقتها المسورة أمام نماذج الذكاء الاصطناعي من طرف ثالث في إكس كود 27
إكس كود 27 يجلب البرمجة الوكيلة بنماذج من أنثروبيك، وجوجل، وأوبن إيه آي، بالإضافة إلى أطر ذكاء جديدة تتيح للتطبيقات استخدام نماذج من آبل، وكلود، وجيميني، وغيرها. يتيح كور إيه آي للمطورين تشغيل نماذج لغوية كبيرة كاملة على الجهاز.
2026-07-25
وكلاء البرمجة بالذكاء الاصطناعي
OpenCode تحقق 40 مليون دولار من الإيرادات السنوية المتكررة برهانها على أن المطورين يريدون الخيارات وليس الاحتكار
OpenCode، وكيل البرمجة بالذكاء الاصطناعي مفتوح المصدر، وصل إلى 4.6 مليون مستخدم نشط أسبوعيًا و40 مليون دولار من الإيرادات السنوية المتكررة. أدى تشديد Anthropic على أنماط استخدام معينة إلى تغذية نموه عن غير قصد، حيث توافد المطورون إلى بديل محايد للنموذج.
2026-07-24
وكلاء البرمجة بالذكاء الاصطناعي
نموذج Qwen-Coder-Qoder من علي بابا يتفوق على Cursor في اختبارها الخاص ويخفض استهلاك الرموز بنسبة 14.5%
نموذج البرمجة الجديد من علي بابا Qwen-Coder-Qoder يتفوق على Cursor Composer-1 في معيار Qoder Bench. تُظهر مقاييس الإنتاج زيادة بنسبة 3.85% في الاحتفاظ بالكود، وانخفاضًا بنسبة 61.5% في أخطاء الأدوات، وتقليصًا بنسبة 14.5% في استهلاك الرموز. يدرب النموذج على آثار الوكلاء الحقيقية من خلال إطار عمل المكافأة والمهاجم لمواجهة اختراق المكافآت.
2026-07-23
وكلاء البرمجة
Kimi K3 يتفوق على Claude Fable 5 و GPT 5.6 Sol في معيار توليد كود Next.js
يتعادل Kimi K3 على المركز الأول بنسبة نجاح 92% في مهام كود Next.js، مع إكمال المهام في أقل من 200 ثانية. وثائق AGENTS.md تمحو الفجوات بين النماذج الرائدة والنماذج المتوسطة، رافعةً جميعها إلى 96%.
2026-07-18
Cursor يطلق تطبيق iOS
هاتفك أصبح أداة برمجة حقيقية، تطبيق Cursor لنظام iOS يثبت ذلك
يتيح تطبيق Cursor لنظام iOS في نسخته التجريبية العامة للمطورين إطلاق وكلاء برمجة بالذكاء الاصطناعي من هواتفهم، ودمج سير العمل المحلي والسحابي، والحصول على إشعارات فورية عند اكتمال طلبات السحب. إنه يعيد تعريف دور الهاتف المحمول في تطوير البرمجيات بعد أن كان مقتصرًا على الاستجابة للحوادث.
2026-07-14