OmniVoice · k2-fsa

OmniVoice grátis: síntese e clonagem de voz

Transforme texto em fala com o OmniVoice da k2-fsa. Experimente a demonstração oficial de clonagem de voz zero-shot e criação de vozes em 646 idiomas.

Usar a ferramenta 646 idiomas24 kHz

Usar a ferramenta

OmniVoice
k2-fsa/OmniVoice

A carregar a demonstração…

A demonstração pública ZeroGPU tem quotas de GPU partilhada e filas. O Hugging Face pode pedir início de sessão ou uma nova tentativa mais tarde. O acesso a esta página não é cobrado pela Wan2.Video.

Como usar

Voice Clone

Em Voice Clone, introduza o texto e carregue ou grave uma referência clara de 3–10 segundos. Adicione a transcrição, se disponível, e gere áudio de 24 kHz para descarregar.

Voice Design

Em Voice Design, crie uma voz sem gravação de referência. Combine género, idade, altura da voz, sotaque ou dialeto e sussurro. Os resultados são mais estáveis em chinês e inglês.

Configure o resultado

Adicione [laughter] ou [sigh] para sons não verbais. Corrija a pronúncia chinesa com pinyin e números de tom, e a inglesa com fonemas CMU entre colchetes.

O modelo tem cerca de 0.6B parâmetros. A equipa reporta RTF mínimo de 0.025 (cerca de 40× em tempo real); a velocidade da demonstração depende também da fila e do hardware.

Perguntas frequentes

A demonstração é gratuita?

A demonstração pública ZeroGPU tem quotas de GPU partilhada e filas. O Hugging Face pode pedir início de sessão ou uma nova tentativa mais tarde. O acesso a esta página não é cobrado pela Wan2.Video.

Onde são processados os ficheiros?

O Space selecionado recebe os ficheiros; o responsável gere o processamento e a retenção. Este guia está traduzido, mas os idiomas da demonstração dependem do responsável.

E se não carregar?

Recarregue ou escolha um servidor alternativo disponível. Se esgotou a quota de GPU, aguarde a reposição ou experimente uma ferramenta relacionada.

Recursos oficiais