OmniVoice · k2-fsa

OmniVoice gratis: síntesis y clonación de voz

Convierte texto en voz con OmniVoice de k2-fsa. Prueba la demo oficial de clonación de voz zero-shot y diseño de voces en 646 idiomas.

Usar la herramienta 646 idiomas24 kHz

Usar la herramienta

OmniVoice
k2-fsa/OmniVoice

Cargando la demo…

La demo pública de ZeroGPU tiene cuotas de GPU compartida y colas. Hugging Face puede pedir que inicies sesión o vuelvas más tarde. Wan2.Video no cobra por acceder a esta página.

Cómo usarla

Voice Clone

En Voice Clone, introduce el texto y sube o graba una referencia clara de 3–10 segundos. Añade su transcripción si la tienes y genera audio de 24 kHz para descargar.

Voice Design

En Voice Design, crea una voz sin grabación de referencia. Combina género, edad, tono, acento o dialecto y susurro. El diseño de voces es más estable en chino e inglés.

Configura el resultado

Añade [laughter] o [sigh] para sonidos no verbales. Corrige la pronunciación china con pinyin y números de tono, y la inglesa con fonemas CMU entre corchetes.

El modelo tiene unos 0.6B parámetros. El equipo informa de un RTF mínimo de 0.025 (unas 40× en tiempo real); la velocidad de la demo también depende de la cola y del hardware.

Preguntas frecuentes

¿La demo es gratuita?

La demo pública de ZeroGPU tiene cuotas de GPU compartida y colas. Hugging Face puede pedir que inicies sesión o vuelvas más tarde. Wan2.Video no cobra por acceder a esta página.

¿Dónde se procesan mis archivos?

El Space seleccionado recibe tus archivos; su responsable gestiona el procesamiento y la conservación. Esta guía está traducida, pero los idiomas de la demo dependen de su responsable.

¿Qué hago si no carga?

Recarga o selecciona un servidor alternativo disponible. Si agotaste tu cuota de GPU, espera a que se restablezca o prueba una herramienta relacionada.

Recursos oficiales