توليد الكلام
4 published articles
Speech synthesis
Alibaba's new TTS model speaks 16 languages, laughs on command, and might actually ship
Alibaba's Qwen-Audio-3.0-TTS is a production-oriented speech synthesis system that combines a low-frame-rate tokenizer with progressive training. It supports 16 languages, 20 Chinese dialect regions, and natural-language instructions for emotion, pace, and speaking style.
2026-07-26
الذكاء الاصطناعي
أصوات 'أم' و 'آه' المفقودة التي تجعل أخيرًا الكلام الاصطناعي يبدو بشريًا
يجلب نموذج Speech 2.8 من MiniMax كلمات الحشو الأصلية والتنفس والتردد إلى التوليف الصوتي بالذكاء الاصطناعي، مما يحل مشكلة 'الكمال المفرط' التي جعلت الكلام الاصطناعي يبدو آليًا لفترة طويلة. كما يقدم النموذج استنساخ الصوت في 10 ثوانٍ وتحسينات في الدقة عبر اللغات.
2026-07-11
الكلام الاصطناعي
MiniMax Speech 2.8 يضفي دفئًا بشريًا على الأصوات الاصطناعية عبر كلمات الحشو الأصلية والاستنساخ عالي الدقة
يضيف MiniMax Speech 2.8 كلمات حشو طبيعية، واستنساخ الصوت في 10 ثوانٍ، وصوت بجودة الاستوديو لسد الفجوة بين الكلام الاصطناعي والبشري. يصلح النموذج مشكلة 'الكمال المفرط' التي تجعل الأصوات الاصطناعية تبدو آلية.
2026-07-08
الذكاء الاصطناعي
هجوم منتجات MiniMax: نماذج جديدة للبرمجة والموسيقى والفيديو في تحديث شامل واحد
تطلق شركة MiniMax الناشئة في مجال الذكاء الاصطناعي نماذج MiniMax M3 وHailuo 2.3 وMiniMax Code ونماذج جديدة للكلام/الموسيقى، مما يوسع خط إنتاجها في بيئة تنافسية.
2026-07-06