الذكاء الاصطناعي

الذكاء الاصطناعي: نماذج اللغة الكبيرة، الوكلاء، الانتشار، الرؤية الحاسوبية، معالجة اللغة الطبيعية وآخر أخبار المعامل الرائدة.

347 published articles

4 min read

معايير الذكاء الاصطناعي

GPT-5.4 يتصدر معايير الرياضيات لعام 2026 مع تشبع النتائج المتطورة

يتفوق GPT-5.4 على المنافسين باكتساح صفوف الرياضيات التنافسية العليا، لكن GPT-5.2 Pro يعادل كل خلية ويقدم GPT-5.3 Codex نتائج متطابقة تقريبًا بتكلفة أقل. العامل المميز الحقيقي: كيفية أداء النماذج على معايير الجيل التالي مثل FrontierMath وHMMT فبراير 2026.

2026-07-01

2 min read

تحديث API

أنثروبيك ترفع حدود معدل استجابة واجهة Claude API وتُبسّط المستويات إلى ثلاث

أنثروبيك تزيد حدود معدل استجابة Claude API لنماذج Sonnet وHaiku، وتُبسّط مستويات الاستخدام إلى ثلاث (Starter وDevelopment وScale)، وتضمن ألا تشهد أي مؤسسة حدودًا أقل. التغييرات تلقائية.

2026-07-01

3 min read

أبحاث الذكاء الاصطناعي

تحليل على مستوى الرموز يكشف أن النماذج اللغوية الهجينة تتفوق على الكلمات الحاملة للمعنى وتتخلف عن التكرارات

قام باحثون في معهد ألين للذكاء الاصطناعي بمقارنة نموذج أولمو 3 وأولمو الهجين رمزًا برمز، ووجدوا أن النماذج الهجينة تتفوق على الكلمات الحاملة للمعنى ولكن ليس على الرموز المكررة. يشير العمل إلى خسائر الرموز المصفاة كطريقة تقييم أكثر ثراءً للبنيات المعمارية لنماذج اللغة.

2026-07-01

2 min read

مايكروسوفت بيلد 2025

مايكروسوفت ديسكفري متاح الآن بشكل عام لسير عمل الذكاء الاصطناعي الوكيل في العلوم والهندسة

مايكروسوفت ديسكفري متاح الآن بشكل عام، مما يوفر للمؤسسات منصة لبناء وإدارة سير عمل الذكاء الاصطناعي الوكيل للبحث العلمي والهندسي. وتهدف المعاينة المصاحبة لتطبيق مايكروسوفت ديسكفري إلى إضفاء الطابع الديمقراطي على الاكتشافات التي يقودها الذكاء الاصطناعي لخبراء المجال.

2026-07-01

4 min read

المعيار

أداة GauntletBench من أكسفورد تختبر وكلاء الذكاء الاصطناعي في 100 مهمة حقيقية. لقد فشلوا في 81% منها.

تضع أداة GauntletBench من أكسفورد وكلاء الذكاء الاصطناعي أمام 100 مهمة صعبة من العالم الحقيقي. لا تتجاوز قدرة الأنظمة الحدودية 19.1% من النجاح، وهو أقل بكثير من الأداء البشري. يستهدف المعيار القدرات المهملة في الإدراك الزمني والفهم الرسومي والتفكير ثلاثي الأبعاد عبر خمسة تطبيقات مهنية.

2026-07-01

Featured4 min read

الذكاء الاصطناعي

GPT-Live من OpenAI يتوقف أخيرًا عن انتظار انتهاء حديثك

يقدم GPT-Live من OpenAI صوتًا مزدوج الاتجاه (full-duplex audio) ليتمكن الذكاء الاصطناعي من الاستماع والتحدث في الوقت نفسه. يمكنه قول "همم"، والانتظار أثناء فترات التوقف، وتسليم التفكير المعقد إلى GPT-5.5 في الخلفية، مما يحافظ على استمرار تدفق المحادثة.

2026-07-01

3 min read

الذكاء الاصطناعي

نموذج DeepSeek الجديد يجعل الكفاءة طليعة سباق التسلح في الذكاء الاصطناعي

أصدرت DeepSeek نموذجًا لغويًا كبيرًا جديدًا يزيد حدة المنافسة مع مختبرات الذكاء الاصطناعي الكبرى من خلال المراهنة على الكفاءة بدلاً من القوة الغاشمة. يهدف النموذج إلى تقديم أداء قوي مع استخدام أمثل للموارد، مما يعكس تحولًا صناعيًا أوسع نحو الذكاء الاصطناعي الفعال من حيث التكلفة.

2026-06-30

Featured3 min read

إطلاق منتج

كلود سونيت 5 هنا الآن، وأنثروبيك تراهن على العلوم والمؤسسات

أطلقت أنثروبيك كلود سونيت 5، وهو نموذج أسرع وأكثر قدرة في البرمجة والعوامل، بالإضافة إلى كلود ساينس للباحثين وكلود تاغ للفرق. كما نشرت الشركة إطارًا سياساتيًا حول النمو الأسي للذكاء الاصطناعي.

2026-06-30

Featured5 min read

تحليل إطلاق أنثروبيك

كلود سونيت 5 يجعل فجوة سعر أوبوس أصعب في التبرير

يعد كلود سونيت 5 بأداء استدلالي ووكيل قريب من مستوى أوبوس بتكلفة أقل. يبلغ المختبرون الأوائل عن تحسينات كبيرة في إنجاز المهام المستقلة والمتابعة في العمليات المعقدة متعددة الخطوات. مع الأسعار التمهيدية حتى أغسطس 2026، يجعل النموذج فجوة سعر أوبوس أصعب في التبرير.

2026-06-30

3 min read

سياق فعال، سقف المخرجات، والضريبة الخفية للنوافذ الطويلة

نموذج الذكاء الاصطناعي الخاص بك يدعي أنه يقرأ مليون رمز. إنه يخدعك. إليك الحسابات الحقيقية.

تعلن جميع النماذج الحدودية الأربعة عن نوافذ سياقية تتجاوز مليون رمز، لكن الاستدعاء الفعال، حدود المخرجات، والتكلفة الواقعية تختلف بشكل حاد. يتصدر DeepSeek V4 Pro في سقف المخرجات والتكلفة، بينما يتفوق Gemini تحت 200 ألف رمز، ويفوز Claude Opus في التخزين المؤقت لمراجعة الكود التفاعلية. يحلل هذا التحليل الأرقام من أبريل 2026.

2026-06-30

Featured5 min read

تحليل معايير الوكلاء

ProgramBench: كل نموذج ذكاء اصطناعي عام يسجل 0% في أصعب اختبار برمجة حتى الآن

ProgramBench يتحدى وكلاء الذكاء الاصطناعي لإعادة بناء البرامج من الملفات الثنائية فقط، دون كود مصدري أو أوصاف مشكلات. جميع النماذج العامة تفشل في حل أي مهمة بالكامل، مما يكشف نقاط ضعف في الاستقصاء، والهندسة المعمارية، والحكم على التوقف. المعيار هو اختبار ضغط لوكلاء البرمجة الذين يتجاوزون سير العمل القائم على التصحيحات.

2026-06-29

4 min read

بيانات اصطناعية

لا رئيس، لا عنق زجاجة: لماذا يعيد إطار نظير إلى نظير التفكير في توليد البيانات الاصطناعية

Matrix هو إطار لامركزي يستخدم رسائل متسلسلة تمر عبر قوائم انتظار موزعة لتوليد البيانات الاصطناعية بواسطة وكلاء متعددين. بإلغاء المنسق المركزي، يحقق إنتاجية أعلى بمقدار 2-15 ضعفاً على نفس الأجهزة.

2026-06-06

← PreviousPage 28 / 29 · 347 articlesNext →