Voice Clone
Voice Clone でテキストを入力し、明瞭な 3〜10 秒の参照音声をアップロードまたは録音します。任意で書き起こしを追加し、24 kHz の音声を生成・ダウンロードできます。
OmniVoice · k2-fsa
k2-fsa の OmniVoice でテキストを音声に変換。646 言語に対応する公式デモで、ゼロショット音声クローンと音声デザインを試せます。
デモを読み込み中…
公開 ZeroGPU デモには共有 GPU の利用枠と待機列があります。ログインや時間をおいての再試行が必要な場合があります。このページの利用に Wan2.Video は課金しません。
Voice Clone でテキストを入力し、明瞭な 3〜10 秒の参照音声をアップロードまたは録音します。任意で書き起こしを追加し、24 kHz の音声を生成・ダウンロードできます。
Voice Design では参照録音なしで声を作れます。性別、年齢、音高、アクセントや方言、ささやき声を組み合わせます。中国語と英語で特に安定しています。
[laughter] や [sigh] で笑い声やため息を追加。中国語は声調番号付きピンイン、英語は角括弧で囲んだ CMU 音素で発音を補正できます。
モデルは約 0.6B パラメータ。開発元は最小 RTF 0.025(実時間の約 40 倍速)を報告しています。公開デモの速度は待ち行列とハードウェアにも依存します。
公開 ZeroGPU デモには共有 GPU の利用枠と待機列があります。ログインや時間をおいての再試行が必要な場合があります。このページの利用に Wan2.Video は課金しません。
選択した Hugging Face Space が素材を受け取り、管理者が処理と保存を管理します。このガイドは翻訳済みですが、デモ内の言語は管理者が提供するものです。
再読み込みするか、利用可能な予備サーバーを選択してください。GPU の利用枠を使い切った場合は回復を待つか、関連ツールをお試しください。