الذكاء الاصطناعي
الذكاء الاصطناعي: نماذج اللغة الكبيرة، الوكلاء، الانتشار، الرؤية الحاسوبية، معالجة اللغة الطبيعية وآخر أخبار المعامل الرائدة.
565 published articles
البنية التحتية للذكاء الاصطناعي والسياسات
Groq تراهن بمستقبلها على المكدس الأمريكي للذكاء الاصطناعي
أيدت Groq خطة عمل البيت الأبيض للذكاء الاصطناعي في يوم إطلاقها، مسميةً نفسها طبقة الحوسبة في المكدس الأمريكي للذكاء الاصطناعي. ويكشف البيان عن شركة تراهن على أن السياسة الوطنية والاستدلال المحلي الرخيص سينقلانها إلى السوق العالمية.
2026-08-08
البنية التحتية للاستدلال
استدلال الذكاء الاصطناعي يتحول إلى مشكلة موقع: Groq تفتح مركز بيانات في المملكة المتحدة
افتتحت Groq مركز بيانات في المملكة المتحدة مع Equinix، بينما يتجاوز عدد مطوّري GroqCloud 3.5 مليون مطوّر وتواصل حركة مرور الذكاء الاصطناعي في الإنتاج الصعود. هذه الخطوة رهان على أن الاستدلال أصبح الآن مشكلة جغرافية، حيث يحدد زمن الاستجابة والموقع المكان الذي يمكن أن يعمل فيه الذكاء الاصطناعي في الوقت الفعلي.
2026-08-08
توليد الفيديو
MiniMax تخلّت عن معماريتها المُثبتة لكي يقوم H3 بكل شيء
تقول MiniMax إن H3 يوحّد توليد النصوص والصور والفيديو والصوت في نموذج واحد، ويسعّر مخرجات 2K بأقل من ثلث أسعار النماذج السائدة، ويخطط لفتح الأوزان خلال أيام. لكن التفاصيل الصغيرة هي القصة الحقيقية: تخلت الشركة عن المعمارية التي منحتها ميزة للوصول إلى ذلك.
2026-08-07
الرؤية الحاسوبية
CABiNet يبقى ضمن نقطتين من YOLO26x مع ثُمن القدرة الحاسوبية
مجموعة نماذج VDD للتجزئة الدلالية تقدم نماذج YOLO26 وCABiNet المدربة على لقطات طائرات متنوعة إلى Hugging Face. يتصدر YOLO26x-sem بنتيجة 78.83% mIoU، لكن نتيجة CABiNet-Large البالغة 77.76% عند 54.8 GFLOPs تطرح قضية الكفاءة.
2026-08-07
سلامة الذكاء الاصطناعي
لماذا تفتح مايكروسوفت اختبارات سلامة الذكاء الاصطناعي للعالم
مايكروسوفت مولت 18 مختبرًا جامعيًا عبر ست قارات لإجراء اختبارات هجومية مستقلة لأنظمة الذكاء الاصطناعي، معترفة بأن الفرق الداخلية لا تستطيع اكتشاف كل المخاطر.
2026-08-07
أبحاث RAG
BM25 يتفوق على RAG الوكيلية عندما تتجاوز المجموعات النصية 10 ملايين توكن
يفوز البحث الوكيل على المجموعات الصغيرة، لكن دراسة من muset-ai عبر 28 طبقة متداخلة تُظهر تفوّق BM25 عليه قرب 10 ملايين توكن. يحرق الوكيل 39 ضعفًا من توكنات الاستعلام، ويتعثر RAG القائم على الرسوم البيانية في مرحلة البناء.
2026-08-07
الذكاء الاصطناعي التوليدي
بيبا تدفع للفنانين 0.005 دولار لكل صورة. لكن نماذجها ما تزال تُدرَّب على فن مُلتقط من الويب
تعد بيبا الفنانين بحصة من كل عملية توليد تتم بأسلوبهم: 0.005 دولار لكل صورة، و0.003 دولار لكل ثانية فيديو، بالإضافة إلى حصة من صندوق إتاوات نسبته 5 بالمئة. ومع نحو 800 مشترك وأربعة فنانين موقَّع معهم، ونماذج أساسية ما تزال مدربة على محتوى مُلتقط من الويب، يواجه الخطاب الأخلاقي مشكلة حسابية.
2026-08-07
واجهات وكيلية
Qoder Canvas: نظام تصميم صُنع للوكلاء، لا للبشر
يرى فريق Qoder في Alibaba أن نافذة الدردشة ليست الحاوية المناسبة لمخرجات الوكلاء المعقدة. يطبّق Qoder Canvas تفكير أنظمة التصميم على واجهات الوكلاء، ليعلم الوكلاء بناء مصنوعات تفاعلية واعية بقاعدة التعليمات البرمجية بدلًا من جدران Markdown.
2026-08-07
Qwen / Alibaba Cloud
Qwen2.5-Omni يتفوق على Gemini-1.5-Pro في OmniBench ويعمل بأقل من 12GB
تفوّق نموذج Qwen2.5-Omni مفتوح المصدر من Alibaba على Gemini-1.5-Pro في OmniBench وتصدّر لوحة صدارة MMAU للاستدلال الصوتي. وتخفض النسخ المكمّمة ذاكرة VRAM إلى أقل من 12GB، بينما يوفّر دعم MNN دردشة صوتية فورية على الهواتف.
2026-08-07
البرمجة بالذكاء الاصطناعي
OpenCode يراهن على كفاءة التوكنات بإضافة Ling 3.0 Flash مجانًا
يعرض OpenCode الآن نموذج Ling 3.0 Flash من inclusionAI مجانًا، بعد أيام من إطلاقه. وتُوسّع هذه الخطوة استراتيجية مراعية للتكلفة تراهن على أن كفاءة التوكنات هي التي تكسب سباق البرمجة بالذكاء الاصطناعي.
2026-08-07
توليد الفيديو بالذكاء الاصطناعي
Wan3.0-Video يُفوتر بالثانية: مقطع من 30 ثانية يصل إلى 6 دولارات
يُفوتر Wan3.0-Video من Alibaba بالثانية على DashScope، حيث يكلف مقطع بدقة 1080P لمدة 30 ثانية 6 دولارات لكل عملية توليد. نستعرض طبقات التسعير، وسير عمل الإدخال المتعدد، والأسئلة التي يتركها الإدراج دون إجابة.
2026-08-07
أبحاث الذكاء الاصطناعي
«ذاكرة الصوت» (Voice Memory): ملف بحجم 776 بايت يخبر التعرف على الكلام متى لا يفعل شيئًا
طريقة جديدة تعتمد على الاستنتاج فقط في التعرف على الكلام تتعلم ضبط النفس: مُصحِّح مجمَّد يقرأ ملف ذاكرة خاصًا بكل مجال ويقرر متى يمتنع عن التصحيح. التصحيح غير المقيد يكسر الرموز الصحيحة في ما يصل إلى 64% من التعديلات؛ وتخفض «ذاكرة الصوت» (Voice Memory) هذه النسبة إلى 35%، مع خفض معدل خطأ الكلمات الموزون من 8.36% إلى 7.52%.
2026-08-06