OmniVoice · k2-fsa

無料 OmniVoice 音声合成・音声クローン

k2-fsa の OmniVoice でテキストを音声に変換。646 言語に対応する公式デモで、ゼロショット音声クローンと音声デザインを試せます。

ツールを使う 646 言語24 kHz

ツールを使う

OmniVoice
k2-fsa/OmniVoice

デモを読み込み中…

公開 ZeroGPU デモには共有 GPU の利用枠と待機列があります。ログインや時間をおいての再試行が必要な場合があります。このページの利用に Wan2.Video は課金しません。

使い方

Voice Clone

Voice Clone でテキストを入力し、明瞭な 3〜10 秒の参照音声をアップロードまたは録音します。任意で書き起こしを追加し、24 kHz の音声を生成・ダウンロードできます。

Voice Design

Voice Design では参照録音なしで声を作れます。性別、年齢、音高、アクセントや方言、ささやき声を組み合わせます。中国語と英語で特に安定しています。

結果を設定

[laughter] や [sigh] で笑い声やため息を追加。中国語は声調番号付きピンイン、英語は角括弧で囲んだ CMU 音素で発音を補正できます。

モデルは約 0.6B パラメータ。開発元は最小 RTF 0.025(実時間の約 40 倍速)を報告しています。公開デモの速度は待ち行列とハードウェアにも依存します。

よくある質問

無料で使えますか?

公開 ZeroGPU デモには共有 GPU の利用枠と待機列があります。ログインや時間をおいての再試行が必要な場合があります。このページの利用に Wan2.Video は課金しません。

素材はどこで処理されますか?

選択した Hugging Face Space が素材を受け取り、管理者が処理と保存を管理します。このガイドは翻訳済みですが、デモ内の言語は管理者が提供するものです。

デモが開かない場合は?

再読み込みするか、利用可能な予備サーバーを選択してください。GPU の利用枠を使い切った場合は回復を待つか、関連ツールをお試しください。

公式リソース