مختبر
أبحاث، تجارب ومصادر مفتوحة: الأجهزة، إنترنت الأشياء، الروبوتات، التكنولوجيا الحيوية والذكاء الاصطناعي الحدي
47 published articles
معيار
الفجوة بين نماذج اللغات الكبيرة والمنهج العلمي: معيار جديد يكتشف أن النماذج يمكنها وصف البيانات ولكنها لا تستطيع التفكير من خلالها
SDABench، وهو معيار جديد يركز على القدرات ويغطي ست مهارات أساسية في التفكير العلمي وخمسة مجالات، يختبر 15 نموذج لغوي كبير ويجد أن النماذج قوية في التحليل الوصفي ولكنها تنهار في المهام الاستدلالية والسببية. توفر الورقة إطارًا لتحليل الأخطاء من خمس مراحل لتحديد أماكن الفشل.
2026-07-25
معايير واختبارات
نماذج تعلم الرسوم البيانية لا تُختبر على بيانات بهذا القبح. معيار جديد يغير ذلك
OpenRTAG، معيار من فريق أكاديمي، ينظم مشكلات جودة الرسوم البيانية المنسوبة إلى النص في تصنيف 3×3 يغطي تدهور النص والبنية والتسميات. يختبر شبكات GNN التقليدية، وشبكات GNN المحسنة بنماذج اللغة الكبيرة، ونماذج الرسوم البيانية الأساسية عبر تسع مجموعات بيانات، ويكشف أنماط حساسية مختلفة فاتتها الدراسات السابقة المجزأة.
2026-07-24
تقييم الوكلاء
وكيل الذكاء الاصطناعي الخاص بك يفشل باستمرار؟ قد يكون العائق في الإطار، لا في الدماغ
PawBench، معيار مفتوح المصدر من فريق AgentScope، يقيم بشكل منهجي النماذج وإطارات الوكلاء معًا. تُظهر النتائج أن تصميم الإطار يمكن أن يُحدث فرقًا في الدرجات بأكثر من 11 نقطة للنماذج الصغيرة، مما يكشف عن نقطة عمياء في طريقة تقييم وكلاء الذكاء الاصطناعي حاليًا.
2026-07-22
الذكاء الجماعي لـ Sakana AI يصبح فيزيائياً
مئات الطوب البسيط علمت نفسها التعرف على شكلها الخاص
مجموعة من مئات الطوب النمطي المتطابق، يدير كل منها شبكة عصبية صغيرة بالاتصال المحلي فقط، يمكنها التعرف على شكلها الجماعي، واكتشاف الضرر وتوجيه إعادة النمو. نُشر في Nature Communications، وحقق النظام دقة 100% في العتاد عبر أربعة أشكال.
2026-07-21
البرمجة الوكيلة
كيف تقدّم Grok 4.5 في سباق SWE Marathon، وماذا يعني ذلك لوكلاء البرمجة
يقود Grok 4.5 الآن لوحة SWE Marathon متفوقاً على Claude 4 Opus وGPT-5. يختبر المعيار مهارات هندسة البرمجيات الحقيقية: إصلاح الأخطاء وإضافة الميزات وفهم الكود عبر المستودعات الحقيقية. تعيد النتيجة تشكيل المشهد التنافسي لوكلاء البرمجة بالذكاء الاصطناعي.
2026-07-20
أبحاث الذكاء الاصطناعي
كيف ضغطت بي إم دبليو 16 ألف رمز في بطاقة ذاكرة 16 جيجابايت عبر إعادة التفكير في الانتباه
يُظهر باحثو بي إم دبليو أن الانتباه العالمي الهرمي، المقترن بالانتشار العكسي المبتور والتخزين الخارجي للذاكرة المؤقتة (KV)، يسمح لبطاقة ذاكرة 16 جيجابايت بالتدريب على 16 ألف رمز، أي أربعة أضعاف حد الانتباه الكثيف، دون خسارة قابلة للقياس في جودة المحول.
2026-07-20
NVIDIA
Nvidia وHugging Face تتعاونان لجعل تدريب الانتشار الموزع أمرًا اعتياديًا
يتكامل NeMo Automodel من Nvidia الآن مباشرة مع Hugging Face Diffusers، مما يتيح التدريب الموزع بجودة إنتاجية لنماذج مثل FLUX وWan 2.1 وHunyuanVideo. تتعامل مكتبة Apache 2.0 مع التوازي كمفتاح تكوين وتسمح بتحميل نقاط التفتيش المضبوطة بدقة مباشرة إلى خطوط أنابيب الاستدلال.
2026-07-19
الذكاء الاصطناعي والروبوتات
RoboTTT من NVIDIA يظهر أن طول السياق هو المحور القادم لتحجيم نماذج الروبوتات
يعمل RoboTTT من أبحاث NVIDIA على تحجيم سياق نموذج الروبوت إلى 8,000 خطوة زمنية، بفارق ثلاث مرات تقريبًا عن السياسات الحالية، مما يتيح التقليد الفوري من الفيديو البشري وتحسين الأداء بنسبة 87%، مما يشير إلى أن طول السياق هو محور تحجيم جديد لنماذج الروبوتات الأساسية.
2026-07-17
الأجهزة والإلكترونيات
رقاقة ميمريستور من جامعة بكين بحجم 40 نانومتر تتفوق على Nvidia A100 بما يصل إلى 478 مرة
فريق مشترك من جامعة بكين والأكاديمية الصينية للعلوم بنى شريحة عصبية شكلية تعالج الديناميات العصبية أسرع من معالج NVIDIA A100 GPU بمعدل يتراوح بين 50 و478 مرة مع استهلاك جزء صغير من الطاقة. تحقق شريحة الميمريستور بتقنية تغير الطور وبدقة 40 نانومتر ديناميات عصبية فورية على مستوى الميلي ثانية، مما يفتح الباب أمام الملاحة الجراحية والتوأم الرقمي للدماغ.
2026-07-16
زخم السوق
ارتفاع القيمة السوقية لـ Nvidia يشير إلى أن الطلب على الذكاء الاصطناعي لم يبرد بعد
تجاوزت القيمة السوقية لـ Nvidia 3 تريليونات دولار مع استمرار نمو الطلب على البنية التحتية للذكاء الاصطناعي. يؤكد هذا الإنجاز أن مشتريات GPU المؤسسية لا تزال قوية على الرغم من المنافسة المتزايدة من AMD والشركات الناشئة التي تقدم شرائح استدلال أرخص.
2026-07-16
نظرية التعلم الآلي
لماذا تقوم نماذج الانتشار بالاستيفاء بدلاً من الحفظ فقط: نظرية رياضية للإبداع
يكشف باحثو جوجل أن إبداع نماذج الانتشار ينبع من تأثير 'تنعيم الدرجات' الناتج عن تنظيم الشبكات العصبية. يشرح هذا الإطار النظري لماذا تقوم النماذج بالاستيفاء بين نقاط بيانات التدريب بدلاً من مجرد حفظها، مما يفتح الطريق أمام الجدة المتحكم فيها في الذكاء الاصطناعي التوليدي.
2026-07-16
الروبوتات البشرية
روبوت شيومي البشري قام بما لم يستطع أوبتيموس فعله: عمل حقيقي داخل المصنع
حققت الروبوتات البشرية من شيومي نسبة نجاح تتجاوز 90% في مهام قطع العمل المرنة المعقدة بعد ستة أشهر فقط من النشر في المصنع، متحديةً بذلك مزاعم إيلون ماسك في يناير بأن أوبتيموس ليس جاهزًا لعمل مصنع مفيد. القفزة من تركيب المسمار في محطة واحدة إلى فرز الألواح ثنائي الذراعين وطي الصناديق تحدد وتيرة جديدة للتصنيع البشري.
2026-07-15