الذكاء الاصطناعي العامل
15 published articles
التوجيه بالذكاء الاصطناعي
بالنسبة للذكاء الاصطناعي الوكيلي، التوجيه لكل مكالمة هو النقطة العمياء. TRACE-Router لديه حل.
إطار توجيه جديد، TRACE-Router، يعالج التباين بين موجهات LLM لكل مكالمة ومقاييس النجاح على مستوى المهمة في الذكاء الاصطناعي الوكيلي، محققًا ما يصل إلى 8 نقاط دقة وانخفاض في زمن الاستجابة بنسبة 36%.
2026-08-01
مايكروسوفت للذكاء الاصطناعي
مايكروسوفت تضاهي GPT-5.6 في إكسل بنموذج أرخص يعمل على وحدات معالجة رسومية أقدم
نموذج MAI من مايكروسوفت في إكسل يعادل GPT-5.6 في المهام الشائعة بتكلفة أقل، ويستخدم توكنات أقل من المنافسين في Copilot، ويعمل على معالجات H100 وA100، مما يخفض حاجز النشر الواسع.
2026-07-29
تحول صناعي
لم تعد ميسترال مجرد شركة نماذج. رهانها الصناعي أصبح حقيقياً للغاية.
ميسترال ليست مجرد بائع آخر لنماذج اللغات الكبيرة. حزمة الهندسة الصناعية الجديدة، والشراكة مع كبار المصنعين الأوروبيين، ومركز بيانات داخلي يشير إلى تحول متعمد من المنافسة الأفقية في النماذج إلى الذكاء الاصطناعي الآمن والرأسي لسير العمل الحرجة.
2026-07-19
استراتيجية منصة
Groq توقف بيع السرعة ويبدأ ببيع نظام تشغيل للوكلاء
إطلاق Groq لدعم MCP عن بُعد في 23 سبتمبر، إلى جانب إضافات النماذج السريعة مثل Kimi K2-0905 وسلسلة GPT-OSS من OpenAI، يحول واجهة برمجة التطبيقات الخاصة بها من مجرد أنبوب استدلال سريع إلى طبقة تنظيم كاملة للوكلاء. لم تعد المنصة تنافس فقط على عدد الرموز في الثانية.
2026-07-19
بحث وكيل محكوم
عالم ذكاء اصطناعي جديد من إنفيديا يعمل دون لمس بيانات المرضى
مركز إنفيديا لتقنية الذكاء الاصطناعي يكشف عن NAIS، نظام بحث وكيل محكوم يدير سير العمل البيولوجي الطبي من البداية إلى النهاية على بيانات المستشفى المحمية. في نشر حقيقي لدراسة ارتباط جينومي لارتفاع ضغط الدم شمل 286,422 فردًا، أنتج النظام نتائج مماثلة للتحليلات التي يقودها الخبراء مع الحفاظ على الخصوصية وتمكين الإشراف البشري.
2026-07-19
تحليل
أين تتفوق Kimi K3 على النماذج الرائدة: نظرة معيارية على النموذج المفتوح ذي 2.8 تريليون معامل
نموذج Kimi K3 المفتوح ذو 2.8 تريليون معامل من Moonshot AI يتخلف عن النماذج الملكية الرائدة في معظم المعايير الواسعة، لكنه يتصدر في SWE Marathon وTerminal-Bench 2.1 وBrowseComp وغيرها. يكشف الجدول التفصيلي أين تؤتي ثمار رهاناته المعمارية على KDA وStable LatentMoE.
2026-07-17
البنية التحتية للذكاء الاصطناعي
نموذج Nemotron 3 Embed من Nvidia يكشف الضريبة الخفية التي يدفعها كل وكيل ذكاء اصطناعي
أصدرت Nvidia عائلة نماذج Nemotron 3 Embed مفتوحة الأوزان التي تحقق جودة استرجاع متطورة مع تقليل تكاليف الرموز الوكيلة النهائية. يحتل النموذج بحجم 8 مليارات معلم المرتبة الأولى على RTEB؛ بينما تقدم النماذج الأصغر بحجم 1 مليار معلم كفاءة جاهزة للإنتاج.
2026-07-16
الذكاء الاصطناعي
سونيت 4.6 جعلت أوبس تبدو باهظة الثمن. هذا يغير كل شيء.
نموذج كلود سونيت 4.6 من أنثروبيك يضاهي أو يتفوق على أداء فئة أوبس في المعايير الرئيسية مع الحفاظ على نفس تسعير سونيت 4.5. تشير بيانات تفضيل المطورين المبكرة وشهادات العملاء إلى أن النموذج يحل بالفعل محل البدائل الأكثر تكلفة لمهام الوكيل والبرمجة في العالم الحقيقي.
2026-07-14
إصدار نموذج
أنثروبيك تطلق كلود سونيت 5: حدود جديدة في الذكاء الاصطناعي الوكيلي بتكلفة أقل
تطلق أنثروبيك كلود سونيت 5، وهو نموذج استدلال هجين بنافذة سياقية تبلغ مليون رمز، ويعد بأداء وكيلي من الطراز الأول بتكلفة أقل. يتفوق النموذج في البرمجة والوكلاء طويلي الأمد وسير العمل المؤسسي، مدعومًا باختبارات موسعة وشهادات من العملاء.
2026-07-10
العوامل الذكية
رهان مايكروسوفت على النماذج الصغيرة للذكاء الاصطناعي العامل: تنسيق العمل وليس المعرفة
يظهر مشروع MagenticLite من مايكروسوفت للأبحاث أن النماذج الصغيرة يمكنها التعامل مع المهام العاملية المعقدة عندما يتم تصميم التنسيق والنموذج وبيئة التنفيذ معًا. يشمل الإصدار MagenticBrain، وهو منسق بحجم 14 مليار معلمة، وعائلة نماذج Fara1.5 لاستخدام الكمبيوتر التي تضاعف تقريبًا الأداء السابق على معايير التصفح عبر الويب.
2026-07-09
مايكروسوفت بيلد 2025
منصة مايكروسوفت الجديدة تمنح العلماء مصنعًا خاضعًا للحوكمة لوكلاء الذكاء الاصطناعي
أصبحت Microsoft Discovery متاحة بشكل عام الآن، مما يوفر للمؤسسات منصة خاضعة للحوكمة لوكلاء الذكاء الاصطناعي في العلوم والهندسة. تشير هذه الخطوة إلى توجه مايكروسوفت للاستحواذ على سير عمل البحث والتطوير المؤسسي مع الامتثال والتنسيق المدمجين.
2026-07-08
الذكاء الاصطناعي
نموذج MiniMax M3 يحطم سقف الأوزان المفتوحة بتسريع 9.4 أضعاف في CUDA وبدون مساعدة بشرية
نموذج MiniMax M3 يحقق تسريعًا بمقدار 9.4 أضعاف في نواة CUDA، ويتفوق على Opus 4.7 في BrowseComp، ويعيد إنتاج ورقة ICLR بشكل مستقل. كل ذلك في حزمة مفتوحة الوزن.
2026-07-06