تحويل النص إلى كلام

3 published articles

الذكاء الاصطناعي4 min read

الذكاء الاصطناعي الطرفي

وقت تشغيل Audio8 على المعالج فقط يختصر استنساخ الصوت إلى حوالي 1 جيبيبايت من الذاكرة

يشغّل إصدار ONNX Runtime من Audio8 النسخة التجريبية من TTS بحجم 0.6B بالكامل على المعالج: أوزان انحدار ذاتي بصيغة INT4، وترميز صوتي مدمج بتردد 44.1 كيلوهرتز، وبث PCM، ونقطة نهاية متوافقة مع OpenAI. تستهلك الخدمة حوالي 1 جيبيبايت من الذاكرة على حاسوب محمول، ولا حاجة إلى PyTorch أو Transformers أثناء التشغيل.

2026-08-05

الذكاء الاصطناعيFeatured1 min read

TTS مفتوح المصدر

نموذج TTS الجديد من Audio8 ينسخ الأصوات في 11 لغة مجانًا

تصدر Audio8 الإصدار التجريبي Audio8-TTS بموجب ترخيص Apache 2.0، وهو نموذج بحجم 0.6 مليار معلمة يدعم 11 لغة واستنساخ الأصوات بدون تدريب مسبق، مع برنامج ترميز صوتي مضمن بتردد 44.1 كيلوهرتز. يستهدف الإصدار تطبيقات الكلام الطرفية التي تحتاج إلى سرعة وخصوصية.

2026-07-30

الذكاء الاصطناعيFeatured4 min read

ذكاء صوتي

ذكاء صوتي يتحسن في الكلمات، لكنه لا يزال عاجزًا عن سماع كيف تقولها

معيار Real World VoiceEQ من هوم، المستند إلى أكثر من مليون تقييم بشري، يختبر أكثر من 40 نموذجًا صوتيًا عبر أبعاد تتجاهلها المعايير القياسية: العاطفة، هوية المتحدث، والسياق الصوتي. تُظهر النتائج أن نماذج الكلام إلى الكلام تختلف بشكل كبير، وحتى الأنظمة الرائدة غالبًا ما تتجاهل الإشارات الصوتية التي يستخدمها البشر بشكل غريزي.

2026-07-20