"علي بابا" تطلق أدوات ذكاء اصطناعي متقدمة لتوليد الأصوات
تحدثت شركة علي بابا كلاود عن إطلاق نموذجين جديدين من سلسلة Qwen3 للذكاء الاصطناعي، في خطوة تعكس تصاعد المنافسة العالمية في مجال تقنيات الصوت المدعومة بالذكاء الاصطناعي، وتفتح آفاقًا واسعة أمام صناع المحتوى والشركات الباحثة عن حلول صوتية احترافية وأكثر كفاءة.
علي بابا تطلق نموذجين لتوليد الأصوات
ويعتمد النموذجان الجديدان من علي بابا على توليد الأصوات واستنساخها عبر الأوامر النصية، بما يتيح للمستخدمين إنشاء أصوات دقيقة وواقعية دون الحاجة إلى تسجيلات طويلة أو معدات متخصصة، وهو ما يمثل تحولًا كبيرًا في صناعة المحتوى الصوتي.

يحمل النموذج الأول اسم Qwen3-TTS-VD-Flash، ويختص بتوليد الأصوات اعتمادًا على أوصاف تفصيلية يحددها المستخدم مسبقًا.
ويمكن من خلاله التحكم في مشاعر الصوت، ونبرة الإلقاء، وسرعته، إلى جانب خصائص إضافية مثل العمر، ونوع الصوت، والأسلوب المستخدم، سواء كان رسميًا أو ودودًا أو دراميًا.
وتؤكد علي بابا أن هذا المستوى من التحكم يمنح المستخدمين مرونة عالية لإنتاج أصوات مخصصة تلائم مختلف الاستخدامات الإعلامية والإعلانية.
وبحسب تقرير نشره موقع South China Morning Post (SCMP) واطلعت عليه “العربية Business”، فإن أداء هذا النموذج يتفوق على واجهة OpenAI الخاصة بنموذج GPT-4o mini-tts، سواء من حيث جودة الصوت أو سرعة المعالجة.
يسمى النموذج الثاني، Qwen3-TTS-VC-Flash، ويركز على استنساخ الأصوات، حيث يستطيع نسخ صوت أي شخص بالاعتماد على مقطع صوتي قصير لا يتجاوز ثلاث ثوانٍ فقط.
ولا يقتصر الأمر على تقليد الصوت الأصلي، بل يمكن إعادة إنتاجه بما يصل إلى عشر لغات مختلفة، مع الحفاظ على السمات الصوتية الأساسية. وتشير علي بابا إلى أن هذا النموذج يحقق معدل أخطاء أقل مقارنة بمنافسين بارزين في السوق مثل ElevenLabs وMiniMax.

وتتسم النماذج الجديدة بقدرتها على التعامل مع نصوص معقدة، وتقليد أصوات الحيوانات، واستخراج الأصوات من التسجيلات، ما يجعلها مناسبة لمجالات إبداعية متعددة.
وتتوفر هذه الأدوات عبر واجهة برمجة التطبيقات الخاصة بعلي بابا كلاود، إلى جانب نسخ تجريبية متاحة على منصة Hugging Face للمطورين والباحثين.
ويأتي هذا الإطلاق في وقت تشهد فيه سوق تقنيات الصوت بالذكاء الاصطناعي منافسة متسارعة، مدفوعة بالطلب المتزايد من قطاعات مثل الإعلانات، والألعاب الإلكترونية، وصناعة الفيديو.
كما تفتح هذه النماذج المجال أمام استخدامات واسعة تشمل الدبلجة متعددة اللغات، والإعلانات الصوتية، وبناء الشخصيات الصوتية في الألعاب، ودعم التعليم الإلكتروني، وخدمات مراكز الاتصال، مع تقليل كبير في الوقت والتكلفة مقارنة بالأساليب التقليدية، ما يعزز من مكانة علي بابا كلاعب رئيسي في سباق الذكاء الاصطناعي العالمي.

