Voice Clone
Geben Sie unter Voice Clone Text ein und laden Sie eine klare Referenz von 3–10 Sekunden hoch oder nehmen Sie sie auf. Ergänzen Sie optional das Transkript und erzeugen Sie 24-kHz-Audio zum Herunterladen.
OmniVoice · k2-fsa
Wandeln Sie Text mit OmniVoice von k2-fsa in Sprache um. Testen Sie die offizielle Demo für Zero-Shot-Stimmklonen und Stimmdesign in 646 Sprachen.
Demo wird geladen…
Die öffentliche ZeroGPU-Demo hat gemeinsame GPU-Kontingente und Warteschlangen. Hugging Face kann eine Anmeldung oder einen späteren Versuch verlangen. Wan2.Video berechnet nichts für den Zugriff auf diese Seite.
Geben Sie unter Voice Clone Text ein und laden Sie eine klare Referenz von 3–10 Sekunden hoch oder nehmen Sie sie auf. Ergänzen Sie optional das Transkript und erzeugen Sie 24-kHz-Audio zum Herunterladen.
Unter Voice Design erstellen Sie Stimmen ohne Referenzaufnahme. Kombinieren Sie Geschlecht, Alter, Tonhöhe, Akzent oder Dialekt und Flüstern. Chinesisch und Englisch liefern die stabilsten Ergebnisse.
Fügen Sie [laughter] oder [sigh] für nichtsprachliche Laute ein. Korrigieren Sie chinesische Aussprache mit Pinyin und Tonnummern, englische mit CMU-Phonemen in eckigen Klammern.
Das Modell hat etwa 0.6B Parameter. Das Team berichtet einen minimalen RTF von 0.025 (etwa 40× Echtzeit); die Demo-Geschwindigkeit hängt auch von Warteschlange und Hardware ab.
Die öffentliche ZeroGPU-Demo hat gemeinsame GPU-Kontingente und Warteschlangen. Hugging Face kann eine Anmeldung oder einen späteren Versuch verlangen. Wan2.Video berechnet nichts für den Zugriff auf diese Seite.
Der gewählte Space erhält die Eingaben; sein Betreiber bestimmt Verarbeitung und Aufbewahrung. Diese Anleitung ist übersetzt, die Sprachen der Demo hängen vom Betreiber ab.
Lade den Bereich neu oder wähle einen verfügbaren Ersatzserver. Ist das GPU-Kontingent verbraucht, warte auf die Erneuerung oder probiere ein ähnliches Werkzeug.