Voice Clone
在 Voice Clone 中輸入待合成文字,上傳或錄製一段清晰的 3–10 秒參考音訊,可選填對應文字,然後生成並下載 24 kHz 音訊。
OmniVoice · k2-fsa
OmniVoice 是 k2-fsa 團隊的多語言語音模型,支援 646 種語言。在官方 Demo 中體驗零樣本聲音複製和聲音設計。
正在載入工具…
公共 ZeroGPU 示範有共享 GPU 額度與排隊限制。Hugging Face 可能要求登入,額度用完後需要稍後再試。Wan2.Video 不收取此頁面的存取費用。
在 Voice Clone 中輸入待合成文字,上傳或錄製一段清晰的 3–10 秒參考音訊,可選填對應文字,然後生成並下載 24 kHz 音訊。
在 Voice Design 中無需參考錄音即可設計聲音,自由組合性別、年齡、音高、口音或方言、耳語等屬性。聲音設計在中文和英文中表現更穩定。
在文字中加入 [laughter]、[sigh] 等標籤生成非語言聲音。中文可用帶聲調數字的拼音修正發音,英文可用方括號中的 CMU 音素修正發音。
模型約 0.6B 參數。官方報告最低 RTF 為 0.025,約為即時速度的 40 倍;免費 Demo 的實際速度還取決於排隊和硬體。
公共 ZeroGPU 示範有共享 GPU 額度與排隊限制。Hugging Face 可能要求登入,額度用完後需要稍後再試。Wan2.Video 不收取此頁面的存取費用。
輸入直接交給所選的 Hugging Face Space,處理與保留方式由維護者決定。本站說明已翻譯,示範內部介面的語言由維護者提供。
重新載入工作區,或切換可用的備用線路。如果 GPU 額度已用完,請等待恢復,或嘗試相關工具。