تحويل النص إلى كلام
3 published articles
الذكاء الاصطناعي الطرفي
وقت تشغيل Audio8 على المعالج فقط يختصر استنساخ الصوت إلى حوالي 1 جيبيبايت من الذاكرة
يشغّل إصدار ONNX Runtime من Audio8 النسخة التجريبية من TTS بحجم 0.6B بالكامل على المعالج: أوزان انحدار ذاتي بصيغة INT4، وترميز صوتي مدمج بتردد 44.1 كيلوهرتز، وبث PCM، ونقطة نهاية متوافقة مع OpenAI. تستهلك الخدمة حوالي 1 جيبيبايت من الذاكرة على حاسوب محمول، ولا حاجة إلى PyTorch أو Transformers أثناء التشغيل.
2026-08-05
TTS مفتوح المصدر
نموذج TTS الجديد من Audio8 ينسخ الأصوات في 11 لغة مجانًا
تصدر Audio8 الإصدار التجريبي Audio8-TTS بموجب ترخيص Apache 2.0، وهو نموذج بحجم 0.6 مليار معلمة يدعم 11 لغة واستنساخ الأصوات بدون تدريب مسبق، مع برنامج ترميز صوتي مضمن بتردد 44.1 كيلوهرتز. يستهدف الإصدار تطبيقات الكلام الطرفية التي تحتاج إلى سرعة وخصوصية.
2026-07-30
ذكاء صوتي
ذكاء صوتي يتحسن في الكلمات، لكنه لا يزال عاجزًا عن سماع كيف تقولها
معيار Real World VoiceEQ من هوم، المستند إلى أكثر من مليون تقييم بشري، يختبر أكثر من 40 نموذجًا صوتيًا عبر أبعاد تتجاهلها المعايير القياسية: العاطفة، هوية المتحدث، والسياق الصوتي. تُظهر النتائج أن نماذج الكلام إلى الكلام تختلف بشكل كبير، وحتى الأنظمة الرائدة غالبًا ما تتجاهل الإشارات الصوتية التي يستخدمها البشر بشكل غريزي.
2026-07-20