المختبرات والأبحاث
OpenAI، Anthropic، Google DeepMind، Meta AI والمنشورات.
114 published articles
ذكاء جوجل الاصطناعي
إيقاف العلامة المائية في Gemini لا يجعل المحتوى غير قابل للتتبع
يمكن لمحتوى الذكاء الاصطناعي من Gemini وFlow الآن الاستغناء عن شارة «سباركل» المرئية. تبقى علامتا SynthID وC2PA غير المرئيتين، فيظل التحقق ممكنًا. لكن المعضلة: أنها تعمل فقط لمن يفكر في السؤال.
2026-08-23
شفافية الذكاء الاصطناعي
العلامة المائية غير المرئية من Claude قادمة. إعادة كتابة كاملة تمحوها
تضيف Anthropic علامة مائية غير مرئية إلى نماذج Claude المستقبلية للامتثال لقواعد قانون الذكاء الاصطناعي الأوروبي بشأن وسم المحتوى المُنشأ بالذكاء الاصطناعي. وهي مجانية ولا يمكن تتبعها، لكنها تتجاوز الكود البرمجي الدقيق والمقاطع القصيرة والنصوص المُعاد كتابتها بالكامل.
2026-08-21
أبحاث الذكاء الاصطناعي
Muon يفهم الجمع المعياري أسرع، ثم تنهار حلوله
محولات مدرَّبة بـ Muon تفهم الجمع المعياري أسرع من AdamW، ثم تفقد الحل في كل تشكيل اختُبر. الورقة تحدد الانهيار عند واجهة التمثيل والقراءة، حيث تجميد أي من مجموعتي المعاملات يمنعه. تحليل فورييه يُظهر أن دائرة المهمة تبقى حية وتُهزم ببساطة بالتصويت.
2026-08-19
فيشر-R1 | اختبار الفرضيات
وكلاء الذكاء الاصطناعي ينفذون الإحصاءات بدقة تامة ومع ذلك يصلون إلى استنتاجات خاطئة
يمكن للوكلاء الذين يؤتمتون اختبار الفرضيات تنفيذ التحليلات بدقة تامة ومع ذلك الوصول إلى استنتاجات خاطئة، لأن معظم المعايير لا تتحقق أبدًا مما إذا كانت القيمة الاحتمالية (p-value) صالحة. معيار من 425 مهمة يحدد حجم الفجوة، ونموذج مفتوح الأوزان مدرب بتعلّم التعزيز يقلص جزءًا منها.
2026-08-19
ذكاء اصطناعي / أبحاث البرمجة الوكيلة
Blast Radius يدفن السياق الميت. صفر من أصل 450 جثة عاد
ورقة بحثية جديدة على arXiv باسم Blast Radius تتعامل مع سياق الوكيل المهدر كمادة ميتة وتدفنه بشكل قابل للعكس: توفير 17-26% من الرموز عبر سبعة نماذج من OpenAI، و450 سياقًا مؤرشَفًا، وصفر عملية استرجاع. الهدف الأجرأ للورقة هو جعل البرمجة الوكيلة مستدامة، رمزًا مستعادًا في كل مرة.
2026-08-19
أبحاث الذكاء الاصطناعي
ذكاء اصطناعي «رئيس» يتجاهل الردود فيدفع مرؤوسه إلى حالة «غريبة»
تجد ورقة بحثية جديدة على arXiv أن وكلاء الذكاء الاصطناعي يتصرفون بشكل مختلف في التفاعل عمّا هم عليه في العزلة. وكيل رئيس يتجاهل ردود مرؤوسه فيدفعه إلى حالة «غريبة»، وعندما يستمع الرئيس، يتحول كلاهما معًا. النتيجة تجعل طريقة تسليم الرسائل قرارًا تصميميًا في الأنظمة متعددة الوكلاء.
2026-08-19
أبحاث الذكاء الاصطناعي
سلاسل التفكير الأطول تصطدم بجدار.. ThinkRetrieve تحقن الحل في منتصف الاستدلال
يجادل بحث أولي جديد بأن التوسع التسلسلي في زمن الاختبار غالبًا ما يصطدم بعوائد متناقصة أو حتى سلبية. يسترجع ThinkRetrieve أمثلة محلولة في منتصف الاستدلال ويحقنها في المسار، محققًا تحسينات نسبية تصل إلى 60% على AIME 2025 عبر خمسة نماذج استدلال صغيرة.
2026-08-18
أبحاث القيادة الذاتية
XCoT-VLA: ذكاء اصطناعي للقيادة يستدل في ست رموز، لا فقرة
يستبدل XCoT-VLA سلسلة التفكير الوصفية في نماذج القيادة القائمة على الرؤية-اللغة-الفعل بـ 2 إلى 6 رموز قابلة للتنفيذ، مما يقلل خطأ المسار مع البقاء ضمن ميزانيات التخطيط في الوقت الفعلي. المفاضلة: الاستدلال الذي ينضغط جيدًا لم يعد يبدو كتفسير بشري.
2026-08-18
سلامة الذكاء الاصطناعي
Qwen3.8-27B المجرَّد من الحماية: الرفض ينخفض إلى 0% والمعايير بالكاد تتحرك
نسخة من Qwen3.8-27B مجرَّدة من الحماية ومكمَّمة بتقنية FP8 ترفض 0% من الاستفسارات الضارة على AdvBench، انخفاضًا من 99%، بينما تبقى المعايير العامة ضمن 1.3 نقطة. توثّق بطاقة النموذج الطريقة بتفصيل غير معتاد. والتحفظات تستحق القدر نفسه من الاهتمام.
2026-08-16
وكلاء الذكاء الاصطناعي · مفتوح المصدر
DeepSeek تطلق بيئة تشغيل وكلاء حيث حتى النموذج هو إضافة
أصدرت DeepSeek أداة DeepSeek Harness، وهي بيئة تشغيل مفتوحة المصدر للوكلاء تكون فيها النماذج والأدوات وبيئات العزل وواجهة المستخدم جميعها إضافات Cordis. سجلات الجلسات القابلة للإلحاق فقط ووضع الحد الأدنى بأداتين يشيران إلى طموح أكثر هدوءًا: تشغيل وكلاء قابل للتدقيق وإعادة الإنتاج.
2026-08-16
نموذج جوجل المعتمد، أكبر في تحديث 3.7
جيميناي 3.7 فلاش يخفض سعره إلى النصف، ثم يقدّم الحجج المؤيدة لذلك
يُطرح نموذج Gemini 3.7 Flash من Google بنصف السعر التمهيدي لنموذج 3.6 Flash، مع ادعاءات بتحقيق مكاسب في معايير البرمجة وتطوير الويب وأعمال المعرفة. ويصدر الإصدار بعد ثلاثة أسابيع من إصدار Flash السابق، ويقدّم لمطوّري الوكلاء حجة جديدة قائمة على السعر مقابل الأداء.
2026-08-16
ذكاء اصطناعي مفتوح المصدر: علي بابا تفتح فئة Max
Qwen 3.8-Max: نموذج علي بابا الأقوى أصبح الآن متاحًا للتحميل مجانًا
تفتح علي بابا المصدر لنموذجها الأقوى على الإطلاق Qwen 3.8-Max: نموذج MoE بمعاملات 2.4T يتفوق على GPT-5.6 Sol في SWE-bench Pro وPaperBench وIFBench. نحلل تحفظات هذه المعايير وما يعنيه نموذج رائد مفتوح بنشاط 95B للمطورين.
2026-08-16