OmniVoice · k2-fsa

OmniVoice المجاني لتحويل النص إلى كلام واستنساخ الصوت

حوّل النص إلى كلام باستخدام OmniVoice من فريق k2-fsa. جرّب العرض الرسمي لاستنساخ الصوت دون تدريب إضافي وتصميم الأصوات عبر 646 لغة.

استخدام الأداة

OmniVoice
k2-fsa/OmniVoice

جارٍ تحميل التجربة…

تخضع تجربة ZeroGPU العامة لحصص استخدام المعالج الرسومي المشترك وطوابير الانتظار. قد يطلب Hugging Face تسجيل الدخول أو المحاولة لاحقًا. لا تتقاضى Wan2.Video رسومًا للوصول إلى هذه الصفحة.

طريقة الاستخدام

Voice Clone

في Voice Clone، أدخل النص وارفع أو سجّل مقطعًا مرجعيًا واضحًا مدته 3–10 ثوانٍ. أضف تفريغه النصي إن توفر، ثم أنشئ الصوت ونزّله بتردد 24 kHz.

Voice Design

في Voice Design، صمّم صوتًا دون تسجيل مرجعي. اجمع بين الجنس والعمر وطبقة الصوت واللكنة أو اللهجة والهمس. النتائج أكثر استقرارًا بالصينية والإنجليزية.

ضبط النتيجة

أضف [laughter] أو [sigh] لإنتاج أصوات غير لفظية. صحّح النطق الصيني باستخدام بينيين مع أرقام النغمات، والإنجليزي برموز CMU الصوتية بين أقواس مربعة.

يضم النموذج نحو 0.6B معلمة. يعلن الفريق عن RTF يصل إلى 0.025، أي نحو 40 ضعف سرعة الزمن الحقيقي؛ وتعتمد سرعة العرض أيضًا على الانتظار والعتاد.

أسئلة شائعة

هل التجربة مجانية؟

تخضع تجربة ZeroGPU العامة لحصص استخدام المعالج الرسومي المشترك وطوابير الانتظار. قد يطلب Hugging Face تسجيل الدخول أو المحاولة لاحقًا. لا تتقاضى Wan2.Video رسومًا للوصول إلى هذه الصفحة.

أين تُعالج ملفاتي؟

تستقبل المساحة المحددة مدخلاتك، ويتولى مشغّلها المعالجة والاحتفاظ بالملفات. هذا الدليل مترجم، أما لغات واجهة التجربة فيحددها مشغّلها.

ماذا أفعل إذا لم تُحمّل التجربة؟

أعد تحميل مساحة العمل أو اختر خادمًا بديلًا متاحًا. إذا نفدت حصة المعالج الرسومي، انتظر تجددها أو جرّب أداة ذات صلة.

المصادر الرسمية