01
ポートレートをアップロード
はっきりした正面の顔が最適です。小さな顔、隠れ、集合写真は避けてください。
無料トーキングフォトデモ
静止ポートレートと音声をアップロード。SadTalker が音声に合わせて顔を動かします。公開デモを埋め込むので GPU も API キーも不要です。
インタラクティブ生成
まず推奨デモを使ってください。混雑やスリープなら予備に切替。読み込むのは選択中のデモだけです。
推奨デモ
公開デモはスリープ、待機、突然の停止があり得ます。
SadTalker デモを読み込み中
3ステップのトーキングフォト。クリップは短くすると公開キューが終わりやすいです。
01
はっきりした正面の顔が最適です。小さな顔、隠れ、集合写真は避けてください。
02
きれいな話し声が有利です。短い音声の方が無料 GPU 枠に優しいです。
03
送信後はタブを開いたまま、MP4 を確認してデモから保存します。
SadTalker(CVPR 2023)は音声で静止画の顔を動かします。全身動画生成ではありません。
1枚の顔写真と音声で、短いリップシンク動画になります。
口と表情はテキストではなく駆動音声に従います。
多くのデモに still mode、preprocess、pose style、expression scale があります。
埋め込みデモが公開サービスに接続します。Wan2.Video は自前サーバで推論しません。
どちらも音声で静止画を動かしますが、仕事が違います。
| 項目 | SadTalker | Wan 2.2 S2V |
|---|---|---|
| 仕事 | 1つの顔のトーキングヘッド | より広い音声駆動パフォーマンス |
| 入力 | ポートレート + 駆動音声 | 画像 + 会話または歌声 |
| 向いている用途 | 定番トーキングフォト、解説、アバター | 身体の動きが多い会話・歌唱ショット |
このサイトではアカウントなしで試せます。計算は公開 ZeroGPU デモなので、待ち・日次制限・停止は普通です。
匿名 ZeroGPU は1日およそ2分で、このデモは1件あたり最低でも約90秒を予約しがちです。2回目は拒否されることがあります。
このページでは不要です。商用 API は有料です。公式 HF デモは現在壊れており、動いているのはコミュニティ版です。
できません。公開デモは変更・停止します。本番は有料 API か自前ホスティング。ライセンスは Apache 2.0 です。
非公開写真、同意のない声、機微な内容です。第三者の公開デモが処理します。