الصوت الذكي
12 published articles
TTS مفتوح الأوزان
Magpie TTS يستهلك 32 مللي ثانية من ميزانية زمن استجابة وكيل الصوت الخاص بك
يُفيد Magpie TTS بتحقيق زمن وصول إلى أول صوت يبلغ 32 مللي ثانية على معالج NVIDIA B200، ويضيف العربية والكورية والبرتغالية البرازيلية، ليرفع قائمته إلى 12 لغة. طرح الأوزان المفتوحة: توليف الكلام المستضاف ذاتيًا لم يعد يخسر حجة زمن الاستجابة.
2026-08-16
نزاهة الانتخابات
الذكاء الصوتي يلتقي الديمقراطية: ElevenLabs توقع أول اتفاق مع هيئة انتخابية
تتعاون ElevenLabs مع هيئة الانتخابات البرازيلية لإضافة الذكاء الصوتي إلى خدمات المعلومات الانتخابية، مع توسيع الضمانات ضد سوء الاستخدام. تعمل الشركة أيضًا مع صانعي السياسات وشركات الكشف لحماية انتخابات 2026.
2026-08-09
وكلاء الصوت
لماذا يتفوق Grok 4.1 Fast على النماذج الأذكى في المكالمات الهاتفية
الترتيبات العامة تختار نماذج LLM الخاطئة للمكالمات الصوتية. ترتيب BenchLM لعام 2026 يضع زمن الاستجابة أولاً: Grok 4.1 Fast يجيب في 0.54 ثانية بينما يحتاج Claude Opus 4.6، الأعلى تسجيلاً، إلى 1.78 ثانية. النماذج السريعة تتولى المحادثة؛ بينما تبقى نماذج التفكير لاستدعاءات الأدوات الخلفية.
2026-08-05
استراتيجية الذكاء الاصطناعي
نماذج الذكاء الاصطناعي الداخلية من مايكروسوفت تخفض التكاليف بنسبة 89% في الإنتاج
نماذج MAI الداخلية من مايكروسوفت تعمل في الإنتاج، محققة توفيرًا كبيرًا في التكاليف عبر منتجات متعددة. الأرقام تشير إلى تحول استراتيجي: الشركة الآن تتنافس على كفاءة الاستدلال، وليس فقط جودة النموذج.
2026-07-29
شراكة
إحدى عشرة مختبرًا توقع اتفاقية مع الحكومة البريطانية لجلب الذكاء الاصطناعي الصوتي إلى الخدمات العامة
وقعت إحدى عشرة مختبرًا مذكرة تفاهم مع وزارة العلوم والابتكار والتكنولوجيا البريطانية لاختبار الذكاء الاصطناعي الصوتي في الخدمات العامة، مع التركيز على إمكانية الوصول للمجتمعات ضعيفة البصر وكبار السن والمتنوعة لغويًا. وتوسع الشركة مقرها الرئيسي في لندن وتضاعف عدد موظفيها في المملكة المتحدة إلى 200.
2026-07-28
الحكومة الرقمية
اليونان توقع اتفاقًا مع ElevenLabs لتوظيف الذكاء الاصطناعي الصوتي في الخدمات العامة وإنقاذ لهجة مهددة بالانقراض
تتعاون اليونان مع ElevenLabs لجلب الذكاء الاصطناعي الصوتي إلى بوابة gov.gr وبوابات السياحة والحفاظ على اللهجات الإقليمية مثل الكريتية. تم توقيع الصفقة من قبل وزير الحوكمة الرقمية والذكاء الاصطناعي، ديميتريس باباستيرجيو، وتُعد أول اتفاق ذكاء اصطناعي صوتي على مستوى الدولة في جنوب أوروبا.
2026-07-27
فعاليات الذكاء الاصطناعي
إيفن لابس تنقل قمة الذكاء الاصطناعي إلى وارسو وتسلط الضوء على التكنولوجيا البولندية
إيفن لابس تستضيف قمتها الثالثة في وارسو، دار الأوبرا الوطنية في بولندا، بحضور 2500 مشارك وقادة بولنديين ومؤسسين أوروبيين. يمثل الحدث عودة إلى الوطن لمؤسسي الشركة الناشئة في مجال الذكاء الاصطناعي الصوتي ويشير إلى الدور المتنامي لبولندا في ابتكار الذكاء الاصطناعي.
2026-07-25
تحليل التكاليف
نماذج الذكاء الاصطناعي الداخلية لشركة مايكروسوفت تخفض تكاليف وحدة معالجة الرسوميات بنسبة تصل إلى 89% في الإنتاج
تعلن مايكروسوفت عن تخفيض 84% في تكلفة وحدة معالجة الرسوميات لتوليد الصور و89% للصوت باستخدام نموذجي MAI-2.5 وMAI-Voice-2-Flash اللذين أصبحا الآن قيد الإنتاج عبر بينج وباوربوينت وDynamics 365. تحقق استراتيجية النموذج الداخلي مزايا تكلفة قابلة للقياس مقارنة بالبدائل من جهات خارجية.
2026-07-24
ذكاء صوتي
ذكاء صوتي يتحسن في الكلمات، لكنه لا يزال عاجزًا عن سماع كيف تقولها
معيار Real World VoiceEQ من هوم، المستند إلى أكثر من مليون تقييم بشري، يختبر أكثر من 40 نموذجًا صوتيًا عبر أبعاد تتجاهلها المعايير القياسية: العاطفة، هوية المتحدث، والسياق الصوتي. تُظهر النتائج أن نماذج الكلام إلى الكلام تختلف بشكل كبير، وحتى الأنظمة الرائدة غالبًا ما تتجاهل الإشارات الصوتية التي يستخدمها البشر بشكل غريزي.
2026-07-20
الذكاء الاصطناعي
Sarvam Samvaad: جعل الذكاء الصوتي يعمل بـ 11 لغة هندية. هذا هو الجزء السهل.
Sarvam Samvaad هي منصة محادثة ذكاء اصطناعي من فئة المؤسسات تدعم 11 لغة هندية بزمن استجابة أقل من 500 مللي ثانية. قابلة للنشر عبر الصوت وواتساب والويب، وتدعي عائد استثمار 10 أضعاف ومعالجة أكثر من 100 مليون محادثة. الاختبار الحقيقي: الوفاء بهذه الادعاءات على نطاق واسع.
2026-07-14
الذكاء الاصطناعي
أصوات 'أم' و 'آه' المفقودة التي تجعل أخيرًا الكلام الاصطناعي يبدو بشريًا
يجلب نموذج Speech 2.8 من MiniMax كلمات الحشو الأصلية والتنفس والتردد إلى التوليف الصوتي بالذكاء الاصطناعي، مما يحل مشكلة 'الكمال المفرط' التي جعلت الكلام الاصطناعي يبدو آليًا لفترة طويلة. كما يقدم النموذج استنساخ الصوت في 10 ثوانٍ وتحسينات في الدقة عبر اللغات.
2026-07-11
الذكاء الاصطناعي
GPT-Live من OpenAI يتوقف أخيرًا عن انتظار انتهاء حديثك
يقدم GPT-Live من OpenAI صوتًا مزدوج الاتجاه (full-duplex audio) ليتمكن الذكاء الاصطناعي من الاستماع والتحدث في الوقت نفسه. يمكنه قول "همم"، والانتظار أثناء فترات التوقف، وتسليم التفكير المعقد إلى GPT-5.5 في الخلفية، مما يحافظ على استمرار تدفق المحادثة.
2026-07-01