OmniVoice · k2-fsa

OmniVoice gratuit : synthèse et clonage vocal

Transformez du texte en parole avec OmniVoice de k2-fsa. Essayez la démo officielle de clonage vocal zero-shot et de création de voix dans 646 langues.

Utiliser cet outil 646 langues24 kHz

Utiliser cet outil

OmniVoice
k2-fsa/OmniVoice

Chargement de la démo…

La démo publique ZeroGPU a des quotas de GPU partagé et des files d’attente. Hugging Face peut demander une connexion ou de réessayer plus tard. Wan2.Video ne facture pas l’accès à cette page.

Comment l’utiliser

Voice Clone

Dans Voice Clone, saisissez le texte et importez ou enregistrez un extrait clair de 3 à 10 secondes. Ajoutez sa transcription si disponible, puis générez et téléchargez un audio à 24 kHz.

Voice Design

Dans Voice Design, créez une voix sans enregistrement de référence. Combinez genre, âge, hauteur, accent ou dialecte et chuchotement. Les résultats sont plus stables en chinois et en anglais.

Configurer le résultat

Ajoutez [laughter] ou [sigh] pour des sons non verbaux. Corrigez la prononciation chinoise avec du pinyin et des numéros de ton, et l’anglaise avec des phonèmes CMU entre crochets.

Le modèle compte environ 0.6B paramètres. L’équipe annonce un RTF minimal de 0.025 (environ 40× le temps réel) ; la vitesse de la démo dépend aussi de la file et du matériel.

Questions fréquentes

La démo est-elle gratuite ?

La démo publique ZeroGPU a des quotas de GPU partagé et des files d’attente. Hugging Face peut demander une connexion ou de réessayer plus tard. Wan2.Video ne facture pas l’accès à cette page.

Où sont traités mes fichiers ?

Le Space choisi reçoit vos fichiers ; son responsable gère le traitement et la conservation. Ce guide est traduit, mais les langues de la démo dépendent de son responsable.

Que faire si la démo ne charge pas ?

Rechargez ou choisissez un serveur de secours disponible. Si votre quota GPU est épuisé, attendez son renouvellement ou essayez un outil associé.

Ressources officielles