توليد واستنساخ الصوت في ثواني.. ماذا تقدم نماذج Qwen 3

[ad_1]
كتب : محمود الهواري
07:08 م
24/12/2025
أعلنت شركة علي بابا كلاود عن طرح نموذجين جديدين من سلسلة Qwen3 للذكاء الاصطناعي، يركزان على تقنيات توليد الأصوات واستنساخها عبر الأوامر النصية، في خطوة تهدف إلى دعم تطبيقات الصوت الاحترافية وصناعة المحتوى الرقمي، بالتزامن مع تصاعد المنافسة في هذا القطاع.
توليد الأصوات بأوصاف تفصيلية
ويحمل النموذج الأول اسم Qwen3-TTS-VD-Flash، ويتيح إنشاء أصوات اعتمادا على أوصاف دقيقة تشمل المشاعر، ونبرة الصوت، وسرعة الإلقاء، مع إمكانية تحديد خصائص إضافية مثل العمر ونوع الصوت والأسلوب، ما يمنح المستخدم مستوى واسعًا من التحكم في المخرجات الصوتية.
مقارنة مباشرة مع نماذج منافسة
وبحسب ما أعلنت الشركة، يتفوق النموذج الجديد في الأداء على واجهة OpenAI الخاصة بنموذج GPT-4o mini-tts، وفق تقرير نشره موقع scmp، في إشارة إلى سعي علي بابا لتعزيز موقعها داخل سوق تقنيات الصوت المعتمدة على الذكاء الاصطناعي.
استنساخ الصوت في ثوانٍ
أما النموذج الثاني، Qwen 3-TTS-VC-Flash، فيختص باستنساخ الأصوات، إذ يستطيع نسخ صوت شخص من مقطع لا تتجاوز مدته ثلاث ثوان، مع إعادة إنتاجه بعشر لغات مختلفة، وهو ما تراه الشركة تقدما لافتا في سرعة ودقة…
[ad_2]
تابعنا على صفحة الفيس بوك وتويتر ليصلك كل جديد














