Voice Clone
En Voice Clone, introduce el texto y sube o graba una referencia clara de 3–10 segundos. Añade su transcripción si la tienes y genera audio de 24 kHz para descargar.
OmniVoice · k2-fsa
Convierte texto en voz con OmniVoice de k2-fsa. Prueba la demo oficial de clonación de voz zero-shot y diseño de voces en 646 idiomas.
Cargando la demo…
La demo pública de ZeroGPU tiene cuotas de GPU compartida y colas. Hugging Face puede pedir que inicies sesión o vuelvas más tarde. Wan2.Video no cobra por acceder a esta página.
En Voice Clone, introduce el texto y sube o graba una referencia clara de 3–10 segundos. Añade su transcripción si la tienes y genera audio de 24 kHz para descargar.
En Voice Design, crea una voz sin grabación de referencia. Combina género, edad, tono, acento o dialecto y susurro. El diseño de voces es más estable en chino e inglés.
Añade [laughter] o [sigh] para sonidos no verbales. Corrige la pronunciación china con pinyin y números de tono, y la inglesa con fonemas CMU entre corchetes.
El modelo tiene unos 0.6B parámetros. El equipo informa de un RTF mínimo de 0.025 (unas 40× en tiempo real); la velocidad de la demo también depende de la cola y del hardware.
La demo pública de ZeroGPU tiene cuotas de GPU compartida y colas. Hugging Face puede pedir que inicies sesión o vuelvas más tarde. Wan2.Video no cobra por acceder a esta página.
El Space seleccionado recibe tus archivos; su responsable gestiona el procesamiento y la conservación. Esta guía está traducida, pero los idiomas de la demo dependen de su responsable.
Recarga o selecciona un servidor alternativo disponible. Si agotaste tu cuota de GPU, espera a que se restablezca o prueba una herramienta relacionada.