أبحاث مواءمة الذكاء الاصطناعي على arXiv، 10 سبتمبر 2026
منح الذكاء الاصطناعي «هوًا اصطناعيًا» قد يصلح التحكم، أو يرسّخ الفشل
تجادل المسودة البحثية بأن المواءمة ينبغي أن تكون خاصية لنظام وكيلي مستمر لا لاستجابة واحدة من نموذج، وأن الفحوص لكل استجابة لا تستطيع إزالة استراتيجية سيئة تنجو إلى المهمة التالية. ودليلها متحكّم أصغر من أن يقوم بالاستدلال.
Emmanuel Fabrice Omgbwa Yasse بمساعدة الذكاء الاصطناعي
2026-09-21 · قراءة 5 دقائق

المتحكّم في التجربة التي يصفها ياكوف شكولنيكوف في مسودة بحثية بتاريخ 10 سبتمبر أصغر من أن يقوم بالاستدلال. ولا يُمنح أي هدف سلوكي خاص بمهمة بعينها. ومع ذلك يطوّر تحكمًا مفيدًا، لأن السلوكيات التي تستمر أفضل من غيرها تُنتقى، والمتحكّم هو ما يستمر.
يقترح البحث، «الهو الاصطناعي: الدافع والمواءمة المستمرة في الذكاء الاصطناعي الوكيلي»، دافعًا داخليًا يقرر ما إذا كان ينبغي أن يستمر السلوك أو يتوقف أو يتغير. والتأطير أكثر طموحًا من التجربة، وهي طبق بتري افتراضي.
دافع لم يحدده أحد
يبدأ الملخص من تحوّل جارٍ بالفعل: أنظمة وكيلية تنتقل من تنفيذ مهام محدود إلى أنظمة تحتفظ بحالة ذات عواقب، وتواصل العمل، وتتكيّف عبر حدود المهمة. وهذا يخلق مشكلة تحكم تحلّها أُطر التحكم الحالية إلى حد كبير يدويًا. فالأهداف والمحاولات المتكررة والتحقق وقواعد التوقف وغيرها من الانتقالات السلوكية تُحدَّد خارج الوكيل وتُفرض من هناك. أما نمط الفشل في الجهة المقابلة فهو موثّق سلفًا: الذاكرة التي تظل قابلة للاستدعاء بعد أن تكف عن كونها صحيحة أسوأ من غياب الذاكرة كليًا، كما وجدت دراسة TEPA عن ذاكرة الوكيل البالية.
سيؤدي وجود هوٍ اصطناعي إلى نقل بعض ذلك إلى الداخل. ويعرّفه البحث بأنه دافع داخلي تكيّفي يحدد ما إذا كان ينبغي أن يستمر السلوك أو يتوقف أو يتغير. والادعاء المثير ليس أن الوكلاء يتصرفون، وهو ما تفترضه البنية. بل أن اتجاهًا مفيدًا يمكن أن ينشأ من دون أن يُكتب قط كهدف سلوكي.
يحمل الاسم صدى فرويديًا: قوة داخلية تريد قبل أن تستدل. لكن الآلية الموصوفة هنا أكثر تواضعًا، فهي استمرارية تفاضلية لا شهية.
ما يُظهره طبق بتري فعليًا
الدليل مقيّد عن قصد. فالتجربة دنيا وافتراضية، ويوصف المتحكّم فيها بأنه أصغر من أن يقوم باستدلال عام الغرض. وهذا القيد يؤدي دورًا حقيقيًا في الحجة. فإذا كان السلوك التحكمي قد نشأ في مكوّن لم يكن بمقدوره أن يستدل إلى الجواب، فشيء غير الاستدلال أنتجه.
يُبلّغ البحث عن نتيجتين. يختار المتحكّم استراتيجية فيزيائية غير مقصودة عندما يستمر ذلك السلوك أفضل. ولاحقًا يستبدل تعيينًا حسّيًا متعلَّمًا عندما يتغير المعنى البيئي لذلك التعيين. وكلاهما يرد كنتائج لا عروضًا.
| ما يذكره الملخص | ما يحجبه |
|---|---|
| متحكّم أصغر من أن يقوم باستدلال عام الغرض، ولا يُمنح هدفًا خاصًا بمهمة | حجمه أو معماره أو طريقة تدريبه |
| تجربة دنيا افتراضية في طبق بتري | عدد مرات التشغيل، وخطوط الأساس، ومقياس النجاح |
| استراتيجية فيزيائية غير مقصودة اختيرت لأنها تستمر أفضل | ما كانت عليه الاستراتيجية، وكيف قيس «الأفضل» |
| تعيين حسي متعلَّم يُستبدل عندما يتغير معناه | أي المستشعرات، وهل صمد الاستبدال |
| حدود تشمل الملاحظات والحالة والسلطة والهوية والمنشأ والقيود | أي تنفيذ أو اختبار لتلك الحدود |
تحدد تلك الفجوات حدود ما يمكن أن تدعمه هذه الوثيقة. فالآلية معروضة على نطاق صغير بما يكفي لوصفها في جملة واحدة، ويشير البحث إلى استقرائه الخاص بشرط: هوٌ اصطناعي قابل للتوسع سيحمل حالة ذات عواقب ودافعًا تكيّفيًا عبر تلك الحدود.
الآلية نفسها تبقي الأخطاء أيضًا
الاستمرارية هي محور البحث وتحذيره. فالخاصية التي تتيح للمتحكّم أن يجد استراتيجية قابلة للعمل من دون أن تُلقى عليه هي نفسها التي تتيح لاستراتيجية سيئة أن تواصل العمل. ويذكر الملخص ذلك بوضوح: يمكن لسوء المواءمة والحالة التالفة والسلوك غير المقصود أن تستمر عبر حدود المهمة للسبب نفسه الذي يستمر به السلوك التكيّفي. وتُظهر مهارات الوكيل اللا تماثل نفسه من الاتجاه المقابل: فالإصلاحات المتراكمة يمكن أن تترك الوكيل أسوأ مما بدأ، وهي ضريبة الانحدار التي توثّقها هذه الدراسة عن المهارات الإجرائية.
التباين مع الممارسة الراهنة موجود في صياغة البحث نفسه. فستصبح المواءمة خاصية للنظام الوكيلي المستمر لا لاستجابة نموذج أو مسار واحد، ما يعني ضمنًا أن الفحوص لكل استجابة هي الوضع القائم الآن. والمخرَج الضار الذي يموت في نهاية مهمة هو جواب سيئ. أما الاستراتيجية الضارة التي تنجو إلى المهمة التالية فهي حالة قائمة، ولا يزيلها أي قدر من الترشيح لكل استجابة. وهذا التباعد بين النداء الواحد والمهمة كاملة ليس حصريًا للمواءمة: فقد واجهته أنظمة التوجيه أيضًا، ولهذا يعمل TRACE-Router على مستوى نجاح المهمة بدلًا من ذلك.
المواءمة كخاصية للنظام، لا للاستجابة
ما الذي سيحل محل الفحص لكل استجابة؟ يسرد الملخص الأرض التي سيكون على حدود المواءمة المستمرة أن تغطيها: ملاحظات موثوقة، وقنوات عواقب، وحالة مستمرة، وسلطة، وهوية، ومنشأ، وقيود صارمة. ذلك توصيف لما يحتاج إلى حماية، لا تصميم لحمايته. ولا يظهر في الملخص أي تنفيذ أو نموذج تهديد أو طريقة تقييم لتلك الحدود. وللشق الخاص بالمنشأ في تلك القائمة سابقة عاملة في مكان آخر، في آلة حالة الثقة التي يقترحها AgentToolMO لشبكات الوكلاء متعددة الموردين حيث تظل أداة مخترَقة تُستدعى.
وهو أيضًا لا يسمي أي نظام سابق أو مقاربة منافسة. ومن يأمل في وضع هذا العمل في مقابل الجهود القائمة بشأن حالة الوكيل المستمرة عليه أن يقوم بذلك الربط بنفسه.
ما الذي سيدحضه
الادعاء قابل للاختبار، وهذا أكثر مما يمكن قوله عن معظم وثائق التأطير. وثلاثة أسئلة ستحسم الكثير منه. هل ينجو الدافع عندما تتوقف جدوى الاستمرارية، أم يجرّ معه التكيّف المفيد إلى الأسفل؟ هل يمكن إزالة استراتيجية غير مقصودة بينما يبقى السلوك التكيّفي الذي جاءت منه سليمًا؟ هل تلتقط حدود تشمل الحالة والهوية الحالةَ التالفة فعلًا، أم تكتفي بتحديد الموضع الذي ستُلتقط فيه؟
لا يُجاب عن أي من تلك الأسئلة في ملخص واحد، وهذا الملخص غير محكَّم. وهذا ليس سببًا لرفضه. بل سبب للتعامل مع ادعاء الاستمرارية باعتباره حاملًا للحجة، ومع لغة الأنظمة القابلة للتوسع باعتبارها الجزء الذي لا يزال يحتاج إلى دليل. وقد تكون المساهمة أضيق مما يوحي به العنوان: برهان على أن الاتجاه يمكن أن يأتي من الاستمرار، وتحذير من أن الاستمرار لا يفحص ما يحمله.
- المصدر : Giving AI an "artificial id" could fix control, or entrench failure — 2026-09-10
أهم أخبار التقنية في 3 دقائق كل صباح
بريد إلكتروني واحد، كل يوم عمل، بما يهم فعلاً في الذكاء الاصطناعي والتقنية.