استنساخ الصوت

5 published articles

الذكاء الاصطناعي4 min read

الذكاء الاصطناعي الطرفي

وقت تشغيل Audio8 على المعالج فقط يختصر استنساخ الصوت إلى حوالي 1 جيبيبايت من الذاكرة

يشغّل إصدار ONNX Runtime من Audio8 النسخة التجريبية من TTS بحجم 0.6B بالكامل على المعالج: أوزان انحدار ذاتي بصيغة INT4، وترميز صوتي مدمج بتردد 44.1 كيلوهرتز، وبث PCM، ونقطة نهاية متوافقة مع OpenAI. تستهلك الخدمة حوالي 1 جيبيبايت من الذاكرة على حاسوب محمول، ولا حاجة إلى PyTorch أو Transformers أثناء التشغيل.

2026-08-05

الذكاء الاصطناعيFeatured1 min read

TTS مفتوح المصدر

نموذج TTS الجديد من Audio8 ينسخ الأصوات في 11 لغة مجانًا

تصدر Audio8 الإصدار التجريبي Audio8-TTS بموجب ترخيص Apache 2.0، وهو نموذج بحجم 0.6 مليار معلمة يدعم 11 لغة واستنساخ الأصوات بدون تدريب مسبق، مع برنامج ترميز صوتي مضمن بتردد 44.1 كيلوهرتز. يستهدف الإصدار تطبيقات الكلام الطرفية التي تحتاج إلى سرعة وخصوصية.

2026-07-30

الذكاء الاصطناعيFeatured1 min read

الذكاء الاصطناعي والبحث

نسبة فوز 68% تجعل ElevenLabs تبدو ضعيفة

Voxtral TTS يضع معيارًا جديدًا لاستنساخ الصوت متعدد اللغات، حيث يفوز بنسبة 68.4% من مقارنات التفضيل ضد ElevenLabs Flash v2.5. يمكن للبنية الهجينة للنموذج وإصدار الأوزان المفتوحة إعادة تشكيل مشهد تحويل النص إلى كلام.

2026-07-24

الذكاء الاصطناعيFeatured3 min read

الذكاء الاصطناعي

أصوات 'أم' و 'آه' المفقودة التي تجعل أخيرًا الكلام الاصطناعي يبدو بشريًا

يجلب نموذج Speech 2.8 من MiniMax كلمات الحشو الأصلية والتنفس والتردد إلى التوليف الصوتي بالذكاء الاصطناعي، مما يحل مشكلة 'الكمال المفرط' التي جعلت الكلام الاصطناعي يبدو آليًا لفترة طويلة. كما يقدم النموذج استنساخ الصوت في 10 ثوانٍ وتحسينات في الدقة عبر اللغات.

2026-07-11

الذكاء الاصطناعي2 min read

الكلام الاصطناعي

MiniMax Speech 2.8 يضفي دفئًا بشريًا على الأصوات الاصطناعية عبر كلمات الحشو الأصلية والاستنساخ عالي الدقة

يضيف MiniMax Speech 2.8 كلمات حشو طبيعية، واستنساخ الصوت في 10 ثوانٍ، وصوت بجودة الاستوديو لسد الفجوة بين الكلام الاصطناعي والبشري. يصلح النموذج مشكلة 'الكمال المفرط' التي تجعل الأصوات الاصطناعية تبدو آلية.

2026-07-08