Qwen2.5-Omni
4 published articles
Qwen / Alibaba Cloud
Qwen2.5-Omni يتفوق على Gemini-1.5-Pro في OmniBench ويعمل بأقل من 12GB
تفوّق نموذج Qwen2.5-Omni مفتوح المصدر من Alibaba على Gemini-1.5-Pro في OmniBench وتصدّر لوحة صدارة MMAU للاستدلال الصوتي. وتخفض النسخ المكمّمة ذاكرة VRAM إلى أقل من 12GB، بينما يوفّر دعم MNN دردشة صوتية فورية على الهواتف.
2026-08-07
مراجعة نموذج
Qwen2.5-Omni: النموذج مفتوح المصدر الذي يفعل أخيرًا ما يعد به المنافسون فقط
غوص عميق في النموذج مفتوح المصدر الذي يعالج النصوص والصور والصوت والفيديو في وقت واحد مع توليد كلام متدفق، متفوقًا على GPT-4o-mini وGemini في اختبارات معيارية متعددة، مع إمكانية تشغيله على بطاقة رسومية استهلاكية واحدة مع التكميم.
2026-08-03
الذكاء الاصطناعي
نموذج 7B يتفوق على النماذج الأكبر ويعمل على الهاتف ويغير معادلة تكلفة الذكاء الاصطناعي
نموذج Qwen2.5-Omni من Alibaba Cloud هو نموذج 7B يتعامل مع النصوص والصور والصوت والفيديو، ويولد الكلام والنص في الوقت الفعلي. تعمل هندسة Thinker-Talker وعناصر التموضع TMRoPE على تمكين التفاعل المتدفق، ويعمل المتغير 3B على شرائح SoC المحمولة مثل Snapdragon 8 Gen 1 بسرعات قابلة للاستخدام.
2026-07-23
الذكاء الاصطناعي متعدد الوسائط
Qwen2.5-Omni من علي بابا: نموذج يريد أن يسمع ويرى ويتحدث دفعة واحدة
يعالج Qwen2.5-Omni من سحابة علي بابا النصوص والصور والصوت والفيديو من طرف إلى طرف، ويولد نصًا وكلامًا طبيعيًا في الوقت الفعلي. تظهر المعايير أنه غالبًا ما يتطابق أو يتفوق على النماذج المتخصصة أحادية الوسائط، مما يشير إلى تحول نحو البنى الموحدة.
2026-07-20