الأنظمة الوكيلة
3 published articles
الذكاء الاصطناعي
ما تكشفه التجربة العملية للأنظمة الوكيلة والذي تغفله المقاييس المرجعية
يسلط برنامج تعليمي جديد حول الأنظمة الوكيلة الضوء على الفجوة بين النجاح في المقاييس المرجعية والموثوقية في الإنتاج. يشارك الباحثون أنماطًا ملموسة للتعامل مع حالات الفشل، من خطوط أنابيب التحقق إلى التصميم القائم على التدخل البشري، بالاستعانة بدراسات حالة في اكتشاف الأدوية والتمويل.
2026-07-24
تصميم الأنظمة / البنية التحتية للنماذج اللغوية الكبيرة
لماذا يُعد توجيه النماذج مشكلة أنظمة وليس مشكلة تصنيف
عبر 417 مهمة وكيلية، أثبت GPT-4.1 أنه مكلف تقريبًا ضعف Sonnet على الرغم من انخفاض سعره المعلن، لأن التخزين المؤقت وليس الأسعار الأساسية هو الذي سيطر على التكلفة. تحليل متعمق لسبب فشل توجيه النماذج عند معالجته كتصنيف، وكيفية بناء موجهات تحسن عبر التكلفة وزمن الاستجابة والدقة في وقت واحد.
2026-07-15
تحليل بحثي
فساد المستندات الناتج عن الذكاء الاصطناعي في سير العمل الموكل: ما يكشفه اختبار إجهاد جديد
يقيم معيار DELEGATE-52 أنظمة الذكاء الاصطناعي في مهام تحرير المستندات الموكل بها طويلة الأمد، ليجد أن النماذج المتطورة تتراكم فيها خسائر في الدقة الدلالية بنسبة 19, 34% على مدار 20 تكرارًا. أظهرت سير عمل بايثون تدهورًا أقل من 1% في المتوسط، لكن الدراسة تشير إلى أن التفويض الموثوق به طويل الأمد لا يزال تحديًا مفتوحًا.
2026-07-04