الذكاء الاصطناعي
الذكاء الاصطناعي: نماذج اللغة الكبيرة، الوكلاء، الانتشار، الرؤية الحاسوبية، معالجة اللغة الطبيعية وآخر أخبار المعامل الرائدة.
565 published articles
استراتيجية الذكاء الاصطناعي
مناورة الصين ذات الأوزان المفتوحة تشق وادي السيليكون
بينما تضاهي النماذج الصينية مفتوحة الوزن مثل Kimi K3 الأنظمة الرائدة الأمريكية في المعايير مع تقديمها مجانًا، ينقسم وادي السيليكون: تحالف يضم 41 شركة يدافع عن الانفتاح بينما تتراجع Anthropic وغيرها، وحادث أمان نموذج مار يزيد الانقسام فقط.
2026-07-31
ملخص بحثي
عنق الزجاجة الهيكلي في الاستدلال يتفوق على سحر المطالبات في مهام الاستقراء لنماذج اللغة الكبيرة
منهجية جديدة تُسمى الاستدلال الساعي تُطبق عزلًا صارمًا للسياق بين مراحل الاستقراء والاستنباط والتنفيذ، مع تمرير قاعدة رمزية مضغوطة فقط بينها. على ARC-AGI-2، ترفع دقة أفضل 5 محاولات بما يصل إلى 14 نقطة عن التحسين التكراري؛ على توليف Verilog لـ ChipBench، تضاعف الدقة تقريبًا مع GPT-5.5. تؤكد عمليات الإزالة أن الهيكلية نفسها هي التي تدفع التحسين.
2026-07-31
بحوث الذكاء الاصطناعي
رغوة في سلسلة الأفكار: معيار جديد يكشف كيف تهدر LLMs الرموز في استدلال صحيح لكنه عديم الفائدة
غالبًا ما تولد LLMs سلاسل استدلال صحيحة ولكنها محشوة بخطوات غير ضرورية. يظهر معيار تشخيصي جديد وطريقة ضغط أن المقيمين الحاليين يغفلون تمامًا عن هذا عدم الكفاءة وأن نصف خطوات الاستدلال التي كتبها البشر قد تكون قابلة للضغط.
2026-07-31
الرؤية الحاسوبية، النماذج العالمية وأبحاث الذكاء الاصطناعي
PhiZero: تعليم الذكاء الاصطناعي للفيديو التفكير في الفيزياء قبل العرض
PhiZero، نموذج عالمي من CASIA، يتعلم «لغة فيزيائية» منفصلة ومضغوطة من الفيديو الخام ويستخدمها للتفكير في كيفية تطور المشهد قبل عرض الإطارات. يجادل المؤلفون بأن تصميم التفكير-ثم-العرض هذا ينتج فيديو أكثر تماسكاً فيزيائياً من التنبؤ المباشر بالبكسل.
2026-07-31
أبحاث الذكاء الاصطناعي
Memory Decoder: ذاكرة إضافية بحجم 6.9 مليار معلمة تجعل نموذجًا بحجم 410 ملايين يتفوق على Pythia-12B
يفصل Memory Decoder at Scale الذاكرة طويلة المدى عن الاستدلال في نماذج اللغة الكبيرة. ذاكرة مُدرَّبة مسبقًا بحجم 6.9 مليار معلمة رفعت Pythia-410M فوق Pythia-12B على 17 معيارًا مع معلمات أقل بنسبة 39%؛ وأضافت ذاكرات مجالية بحجم 1.7 مليار معلمة أكثر من 9 نقاط إلى Qwen3 Base على كل مقياس تم اختباره.
2026-07-31
تقطير نماذج اللغات الكبيرة
تقطير نماذج اللغات الكبيرة يتعثر عندما يبقى السياق ثابتًا. هذه الورقة تجعله يتطور
يمكن للسياقات حمل تفضيلات المهمة إلى تدريب نماذج اللغات الكبيرة، لكنها بعد تقطيرها في الطالب لا تضيف إشرافًا يذكر. تُبقي Flux-OPD من جامعة بكين السياق متحركًا مع الطالب وتستخدم حد تعارض لترجيح تصحيحات المعلّم. يذكر الملخص تحقيق مكاسب على نماذج التقطير ضمن السياسة الحالية دون ذكر أرقام.
2026-07-31
Frontis-MA1 / OpenMLE
الذكاء الاصطناعي الذي يحسّن الذكاء الاصطناعي يعمل الآن على بطاقة RTX 4090 واحدة
منصة OpenMLE من FrontisAI ووكيل Frontis-MA1 بحجم 35 مليار معامل يحوّلان التحسين الذاتي التكراري إلى تجربة قابلة للتكرار. على بطاقة RTX 4090 واحدة، يسجّل النموذج 71.21% في معيار MLE-Bench Lite، متقدمًا على GPT-5.5 + Codex وقريبًا من نماذج حدودية أكبر بكثير.
2026-07-31
وكلاء الواجهات الرسومية
وكيل Qwen-UI-Agent من علي بابا يسجّل نتائج أعلى على الهواتف الحقيقية مقارنة ببيئات الاختبار المعزولة
يدّعي Qwen-UI-Agent من مختبر علي بابا تونغي تحقيق نتائج رائدة في الهواتف المحمولة (97.5% على AndroidDaily) ونتائج تنافسية في استخدام الكمبيوتر مقابل Opus 4.8 وGemini 3.1 Pro وGPT-5.6 Sol. وتسجّل نتائجه على معيار الأجهزة الحقيقية أعلى من نتائجه في بيئة الاختبار المعزولة، في حين يمثّل التقدّم الجزئي البالغ 40% على OSWorld-v2 الحدّ الصادق.
2026-07-31
البحث في الأدبيات العلمية
الكيميائيون يبحثون في الأوراق العلمية؛ AskChem يجيب بـ 2.4 مليون ادعاء
يفهرس AskChem 2.4 مليون ادعاء كيميائي من 147,000 ورقة علمية، كل ادعاء مدعوم بمصدر DOI واقتباس حرفي، ويُقدَّم للعلماء ووكلاء الذكاء الاصطناعي عبر تطبيق ويب وREST وSDK وMCP. وفي AskChem-Bench، ارتفعت قابلية حل روابط DOI لقارئ GPT-5.5 من 88.3% إلى 100%.
2026-07-31
التقييم المحدد مقابل غير المحدد
لماذا يفشل التقييم الذاتي لنموذج الذكاء الاصطناعي في الجودة البصرية
يقدم بحث جديد مفهوم 'التمييز' كمتغير رئيسي يحكم محورًا ثالثًا لحساب زمن الاختبار: التوسع التفاعلي. وتظهر النتائج أن أداة محددة تقيس التخطيط الفعلي تتفوق على تقييم VLM عبر لقطة الشاشة، حيث تصلح 73-74% من العيوب في الوضعيات البصرية بينما لا يرى المقياس القياسي شيئًا.
2026-07-31
أبحاث الذكاء الاصطناعي
توليد الفيديو أسرع 120 مرة على GPU واحد: اختراق Nvidia في الانتباه الهجين
يجمع نموذج SANA-Video 2.0 من Nvidia Research بين الانتباه الخطي والانتباه Softmax الدوري بنسبة 3:1 ليعمل أسرع 120 مرة من Wan 2.2 على H100 واحد. يستعيد التصميم الهجين التعبير الكامل للرتبة مع الحفاظ على زمن الاستدلال عند 13 ثانية لمقطع بدقة 720p. التحذيرات: المعايير تتوقف عند 720p وتدمج تغيير الانتباه مع تحسينات مملوكة.
2026-07-31
سياسة الذكاء الاصطناعي
موقف أنثروبيك الوسطي الدقيق بشأن نماذج الذكاء الاصطناعي مفتوحة الأوزان
يحدد أمودي سيناريوهين كابوسيين، التفوق العسكري للأنظمة الاستبدادية ومخاطر سوء الاستخدام، ويجادل بأن الحظر الشامل لنماذج الأوزان المفتوحة يفوت المشكلة الحقيقية.
2026-07-31