Voice Clone
في Voice Clone، أدخل النص وارفع أو سجّل مقطعًا مرجعيًا واضحًا مدته 3–10 ثوانٍ. أضف تفريغه النصي إن توفر، ثم أنشئ الصوت ونزّله بتردد 24 kHz.
OmniVoice · k2-fsa
حوّل النص إلى كلام باستخدام OmniVoice من فريق k2-fsa. جرّب العرض الرسمي لاستنساخ الصوت دون تدريب إضافي وتصميم الأصوات عبر 646 لغة.
جارٍ تحميل التجربة…
تخضع تجربة ZeroGPU العامة لحصص استخدام المعالج الرسومي المشترك وطوابير الانتظار. قد يطلب Hugging Face تسجيل الدخول أو المحاولة لاحقًا. لا تتقاضى Wan2.Video رسومًا للوصول إلى هذه الصفحة.
في Voice Clone، أدخل النص وارفع أو سجّل مقطعًا مرجعيًا واضحًا مدته 3–10 ثوانٍ. أضف تفريغه النصي إن توفر، ثم أنشئ الصوت ونزّله بتردد 24 kHz.
في Voice Design، صمّم صوتًا دون تسجيل مرجعي. اجمع بين الجنس والعمر وطبقة الصوت واللكنة أو اللهجة والهمس. النتائج أكثر استقرارًا بالصينية والإنجليزية.
أضف [laughter] أو [sigh] لإنتاج أصوات غير لفظية. صحّح النطق الصيني باستخدام بينيين مع أرقام النغمات، والإنجليزي برموز CMU الصوتية بين أقواس مربعة.
يضم النموذج نحو 0.6B معلمة. يعلن الفريق عن RTF يصل إلى 0.025، أي نحو 40 ضعف سرعة الزمن الحقيقي؛ وتعتمد سرعة العرض أيضًا على الانتظار والعتاد.
تخضع تجربة ZeroGPU العامة لحصص استخدام المعالج الرسومي المشترك وطوابير الانتظار. قد يطلب Hugging Face تسجيل الدخول أو المحاولة لاحقًا. لا تتقاضى Wan2.Video رسومًا للوصول إلى هذه الصفحة.
تستقبل المساحة المحددة مدخلاتك، ويتولى مشغّلها المعالجة والاحتفاظ بالملفات. هذا الدليل مترجم، أما لغات واجهة التجربة فيحددها مشغّلها.
أعد تحميل مساحة العمل أو اختر خادمًا بديلًا متاحًا. إذا نفدت حصة المعالج الرسومي، انتظر تجددها أو جرّب أداة ذات صلة.