استنساخ الصوت
5 published articles
الذكاء الاصطناعي الطرفي
وقت تشغيل Audio8 على المعالج فقط يختصر استنساخ الصوت إلى حوالي 1 جيبيبايت من الذاكرة
يشغّل إصدار ONNX Runtime من Audio8 النسخة التجريبية من TTS بحجم 0.6B بالكامل على المعالج: أوزان انحدار ذاتي بصيغة INT4، وترميز صوتي مدمج بتردد 44.1 كيلوهرتز، وبث PCM، ونقطة نهاية متوافقة مع OpenAI. تستهلك الخدمة حوالي 1 جيبيبايت من الذاكرة على حاسوب محمول، ولا حاجة إلى PyTorch أو Transformers أثناء التشغيل.
2026-08-05
TTS مفتوح المصدر
نموذج TTS الجديد من Audio8 ينسخ الأصوات في 11 لغة مجانًا
تصدر Audio8 الإصدار التجريبي Audio8-TTS بموجب ترخيص Apache 2.0، وهو نموذج بحجم 0.6 مليار معلمة يدعم 11 لغة واستنساخ الأصوات بدون تدريب مسبق، مع برنامج ترميز صوتي مضمن بتردد 44.1 كيلوهرتز. يستهدف الإصدار تطبيقات الكلام الطرفية التي تحتاج إلى سرعة وخصوصية.
2026-07-30
الذكاء الاصطناعي والبحث
نسبة فوز 68% تجعل ElevenLabs تبدو ضعيفة
Voxtral TTS يضع معيارًا جديدًا لاستنساخ الصوت متعدد اللغات، حيث يفوز بنسبة 68.4% من مقارنات التفضيل ضد ElevenLabs Flash v2.5. يمكن للبنية الهجينة للنموذج وإصدار الأوزان المفتوحة إعادة تشكيل مشهد تحويل النص إلى كلام.
2026-07-24
الذكاء الاصطناعي
أصوات 'أم' و 'آه' المفقودة التي تجعل أخيرًا الكلام الاصطناعي يبدو بشريًا
يجلب نموذج Speech 2.8 من MiniMax كلمات الحشو الأصلية والتنفس والتردد إلى التوليف الصوتي بالذكاء الاصطناعي، مما يحل مشكلة 'الكمال المفرط' التي جعلت الكلام الاصطناعي يبدو آليًا لفترة طويلة. كما يقدم النموذج استنساخ الصوت في 10 ثوانٍ وتحسينات في الدقة عبر اللغات.
2026-07-11
الكلام الاصطناعي
MiniMax Speech 2.8 يضفي دفئًا بشريًا على الأصوات الاصطناعية عبر كلمات الحشو الأصلية والاستنساخ عالي الدقة
يضيف MiniMax Speech 2.8 كلمات حشو طبيعية، واستنساخ الصوت في 10 ثوانٍ، وصوت بجودة الاستوديو لسد الفجوة بين الكلام الاصطناعي والبشري. يصلح النموذج مشكلة 'الكمال المفرط' التي تجعل الأصوات الاصطناعية تبدو آلية.
2026-07-08