سلامة الذكاء الاصطناعي
19 published articles
السلامة والقدرات في الذكاء الاصطناعي
Anthropic تطلق Claude Mythos 5: نموذج مزدوج الاستخدام للأمن السيبراني وعلم الأحياء
نموذج Claude Mythos 5 من Anthropic يُطرح الآن لمجموعة مختارة من المؤسسات الأمريكية بعد إزالة قيود التصدير. يحقق النموذج مستويات قياسية جديدة في معايير الأمن السيبراني وعلم الأحياء، لكنه يظل محدودًا للغاية بسبب مخاطر الاستخدام المزدوج.
2026-07-09
فلسفة الذكاء الاصطناعي
لا، الذكاء الاصطناعي ليس عقلًا منافسًا. إنه امتداد لعقولنا
بالبحث في ظواهرية هوسرل، يجادل الباحثون بأن أنظمة الذكاء الاصطناعي تُفهم بشكل أفضل كامتدادات للذكاء الطبيعي، وليس كعقول مستقلة. يفسر هذا المنظور ظاهرة الهلوسة والإخفاقات التركيبية، مع تحويل نقاشات السلامة من مخاوف الذكاء الاصطناعي المارق إلى هندسة مسؤولة وحوكمة.
2026-07-09
سلامة الذكاء الاصطناعي
مقياس أنثروبيك لخطورة الاختراقات يقترح إعادة تنظيم سلامة الذكاء الاصطناعي
تقترح أنثروبيك نظام تسجيل رباعي المحاور لخطورة اختراقات الذكاء الاصطناعي، من 'معلوماتي' إلى 'حرج'، وتفصل المصنفات التي تمنع الاستخدامات الإلكترونية الخطيرة لنموذج Fable 5. يهدف الإطار، الذي تم تطويره مع شركاء Glasswing، إلى توحيد طريقة حديث الصناعة والمنظمين عن إساءة استخدام النموذج.
2026-07-08
تنظيم الذكاء الاصطناعي
كلود فابل 5 يعود بعد رفع الولايات المتحدة لضوابط التصدير. إليكم ما غيرته أنثروبيك
تعيد أنثروبيك نشر كلود فابل 5 وميثوس 5 بعد رفع ضوابط التصدير الأمريكية. توضح الشركة تحديثات الضمانات، وإطارًا مقترحًا لخطورة الاختراق، والتزامات جديدة للتعاون الحكومي في أمن الذكاء الاصطناعي.
2026-07-07
التوسع الدولي
أنثروبيك تفتتح مكتبًا في سيول وتوسع شراكات النظام البيئي للذكاء الاصطناعي في كوريا
تفتتح أنثروبيك مكتبًا في سيول وتعلن عن شراكات مع NAVER وNexon وLG CNS وHanwha Solutions وSamsung SDS وغيرها. تركز مذكرة تفاهم مع وزارة العلوم وتكنولوجيا المعلومات والاتصالات الكورية على سلامة الذكاء الاصطناعي والأمن السيبراني.
2026-07-07
الذكاء الاصطناعي
الذكاء الاصطناعي كامتداد للذكاء البشري وليس بديلاً عنه
أنظمة الذكاء الاصطناعي الحديثة قوية ليس لأنها تحاكي الذكاء البشري، بل لأنها توسع هياكل موجودة بالفعل في الإدراك واللغة البشرية. يساعد هذا المنظور في تفسير كل من قدرات الذكاء الاصطناعي وحدوده المتكررة، بما في ذلك الهلوسات والفجوات التركيبية، ويحول تركيز سلامة الذكاء الاصطناعي من روايات الذكاء الاصطناعي المارقة إلى الحوكمة على مستوى النظام والمسؤولية البشرية.
2026-07-04
أبحاث سلامة الذكاء الاصطناعي
نماذج الذكاء الاصطناعي لا تستطيع التوقف عن التفكير بصوت عالٍ. هذه أخبار جيدة وكابوس للسلامة في آن واحد.
كلود سونيت 4.5 يمكنه التحكم في سلسلة تفكيره بنسبة 2.7% فقط من الوقت، مقابل 61.9% للمخرجات النهائية. تثير الفجوة أسئلة مفتوحة حول متانة مراقبة سلسلة التفكير كآلية سلامة، ولا أحد يعرف لماذا توجد.
2026-03-09