المختبرات والأبحاث

OpenAI، Anthropic، Google DeepMind، Meta AI والمنشورات.

114 published articles

4 min read

ذكاء جوجل الاصطناعي

إيقاف العلامة المائية في Gemini لا يجعل المحتوى غير قابل للتتبع

يمكن لمحتوى الذكاء الاصطناعي من Gemini وFlow الآن الاستغناء عن شارة «سباركل» المرئية. تبقى علامتا SynthID وC2PA غير المرئيتين، فيظل التحقق ممكنًا. لكن المعضلة: أنها تعمل فقط لمن يفكر في السؤال.

2026-08-23

5 min read

شفافية الذكاء الاصطناعي

العلامة المائية غير المرئية من Claude قادمة. إعادة كتابة كاملة تمحوها

تضيف Anthropic علامة مائية غير مرئية إلى نماذج Claude المستقبلية للامتثال لقواعد قانون الذكاء الاصطناعي الأوروبي بشأن وسم المحتوى المُنشأ بالذكاء الاصطناعي. وهي مجانية ولا يمكن تتبعها، لكنها تتجاوز الكود البرمجي الدقيق والمقاطع القصيرة والنصوص المُعاد كتابتها بالكامل.

2026-08-21

4 min read

أبحاث الذكاء الاصطناعي

Muon يفهم الجمع المعياري أسرع، ثم تنهار حلوله

محولات مدرَّبة بـ Muon تفهم الجمع المعياري أسرع من AdamW، ثم تفقد الحل في كل تشكيل اختُبر. الورقة تحدد الانهيار عند واجهة التمثيل والقراءة، حيث تجميد أي من مجموعتي المعاملات يمنعه. تحليل فورييه يُظهر أن دائرة المهمة تبقى حية وتُهزم ببساطة بالتصويت.

2026-08-19

3 min read

فيشر-R1 | اختبار الفرضيات

وكلاء الذكاء الاصطناعي ينفذون الإحصاءات بدقة تامة ومع ذلك يصلون إلى استنتاجات خاطئة

يمكن للوكلاء الذين يؤتمتون اختبار الفرضيات تنفيذ التحليلات بدقة تامة ومع ذلك الوصول إلى استنتاجات خاطئة، لأن معظم المعايير لا تتحقق أبدًا مما إذا كانت القيمة الاحتمالية (p-value) صالحة. معيار من 425 مهمة يحدد حجم الفجوة، ونموذج مفتوح الأوزان مدرب بتعلّم التعزيز يقلص جزءًا منها.

2026-08-19

5 min read

ذكاء اصطناعي / أبحاث البرمجة الوكيلة

Blast Radius يدفن السياق الميت. صفر من أصل 450 جثة عاد

ورقة بحثية جديدة على arXiv باسم Blast Radius تتعامل مع سياق الوكيل المهدر كمادة ميتة وتدفنه بشكل قابل للعكس: توفير 17-26% من الرموز عبر سبعة نماذج من OpenAI، و450 سياقًا مؤرشَفًا، وصفر عملية استرجاع. الهدف الأجرأ للورقة هو جعل البرمجة الوكيلة مستدامة، رمزًا مستعادًا في كل مرة.

2026-08-19

4 min read

أبحاث الذكاء الاصطناعي

ذكاء اصطناعي «رئيس» يتجاهل الردود فيدفع مرؤوسه إلى حالة «غريبة»

تجد ورقة بحثية جديدة على arXiv أن وكلاء الذكاء الاصطناعي يتصرفون بشكل مختلف في التفاعل عمّا هم عليه في العزلة. وكيل رئيس يتجاهل ردود مرؤوسه فيدفعه إلى حالة «غريبة»، وعندما يستمع الرئيس، يتحول كلاهما معًا. النتيجة تجعل طريقة تسليم الرسائل قرارًا تصميميًا في الأنظمة متعددة الوكلاء.

2026-08-19

4 min read

أبحاث الذكاء الاصطناعي

سلاسل التفكير الأطول تصطدم بجدار.. ThinkRetrieve تحقن الحل في منتصف الاستدلال

يجادل بحث أولي جديد بأن التوسع التسلسلي في زمن الاختبار غالبًا ما يصطدم بعوائد متناقصة أو حتى سلبية. يسترجع ThinkRetrieve أمثلة محلولة في منتصف الاستدلال ويحقنها في المسار، محققًا تحسينات نسبية تصل إلى 60% على AIME 2025 عبر خمسة نماذج استدلال صغيرة.

2026-08-18

4 min read

أبحاث القيادة الذاتية

XCoT-VLA: ذكاء اصطناعي للقيادة يستدل في ست رموز، لا فقرة

يستبدل XCoT-VLA سلسلة التفكير الوصفية في نماذج القيادة القائمة على الرؤية-اللغة-الفعل بـ 2 إلى 6 رموز قابلة للتنفيذ، مما يقلل خطأ المسار مع البقاء ضمن ميزانيات التخطيط في الوقت الفعلي. المفاضلة: الاستدلال الذي ينضغط جيدًا لم يعد يبدو كتفسير بشري.

2026-08-18

5 min read

سلامة الذكاء الاصطناعي

Qwen3.8-27B المجرَّد من الحماية: الرفض ينخفض إلى 0% والمعايير بالكاد تتحرك

نسخة من Qwen3.8-27B مجرَّدة من الحماية ومكمَّمة بتقنية FP8 ترفض 0% من الاستفسارات الضارة على AdvBench، انخفاضًا من 99%، بينما تبقى المعايير العامة ضمن 1.3 نقطة. توثّق بطاقة النموذج الطريقة بتفصيل غير معتاد. والتحفظات تستحق القدر نفسه من الاهتمام.

2026-08-16

4 min read

وكلاء الذكاء الاصطناعي · مفتوح المصدر

DeepSeek تطلق بيئة تشغيل وكلاء حيث حتى النموذج هو إضافة

أصدرت DeepSeek أداة DeepSeek Harness، وهي بيئة تشغيل مفتوحة المصدر للوكلاء تكون فيها النماذج والأدوات وبيئات العزل وواجهة المستخدم جميعها إضافات Cordis. سجلات الجلسات القابلة للإلحاق فقط ووضع الحد الأدنى بأداتين يشيران إلى طموح أكثر هدوءًا: تشغيل وكلاء قابل للتدقيق وإعادة الإنتاج.

2026-08-16

Featured3 min read

نموذج جوجل المعتمد، أكبر في تحديث 3.7

جيميناي 3.7 فلاش يخفض سعره إلى النصف، ثم يقدّم الحجج المؤيدة لذلك

يُطرح نموذج Gemini 3.7 Flash من Google بنصف السعر التمهيدي لنموذج 3.6 Flash، مع ادعاءات بتحقيق مكاسب في معايير البرمجة وتطوير الويب وأعمال المعرفة. ويصدر الإصدار بعد ثلاثة أسابيع من إصدار Flash السابق، ويقدّم لمطوّري الوكلاء حجة جديدة قائمة على السعر مقابل الأداء.

2026-08-16

5 min read

ذكاء اصطناعي مفتوح المصدر: علي بابا تفتح فئة Max

Qwen 3.8-Max: نموذج علي بابا الأقوى أصبح الآن متاحًا للتحميل مجانًا

تفتح علي بابا المصدر لنموذجها الأقوى على الإطلاق Qwen 3.8-Max: نموذج MoE بمعاملات 2.4T يتفوق على GPT-5.6 Sol في SWE-bench Pro وPaperBench وIFBench. نحلل تحفظات هذه المعايير وما يعنيه نموذج رائد مفتوح بنشاط 95B للمطورين.

2026-08-16

← PreviousPage 1 / 10 · 114 articlesNext →