Wan-Animate-2

画像とドライビング動画によるエンドツーエンドのキャラクターアニメーション

Wan-Animate-2は、参照キャラクター、動作動画、テキストを再設計された14B Diffusion Transformerへ直接入力します。このページでは正確なモデル解説と公開ZeroGPUデモをまとめています。

14BモデルBaseと蒸留版デモは24fpsApache-2.0
参照キャラクター
ドライビング動画
外見と背景の説明
Wan-Animate-2
アニメーション動画

Wan-Animate-2の短い動画をオンライン生成

キャラクター画像と短いドライビング動画をアップロードします。埋め込みSpaceはHugging Face ZeroGPU上で蒸留Diffusersチェックポイントを動かします。

実モデルを動かすZeroGPUデモ

SpaceはWan-AI/Wan2.2-Animate-2-14B-Distilled-Diffusersを読み込みます。DashScopeへの転送ではなく、Gradioの/animateも公開されています。

公開Spacehugging-apps · ZeroGPU
Wan-Animate-2 Spaceを読み込み中…
アップロードはwan2.video外へ送信されます

画像、動画、プロンプトは第三者のHugging Face Spaceへ直接送信されます。機密、私的、無許諾の素材は送らないでください。

明瞭な画像を使う

顔と体が見え、遮蔽が少なく、周囲に余白がある画像が適しています。

動作動画は短く

公開デモは1~5秒を24fpsに変換して処理します。

外見を記述する

服装、識別要素、背景を記述し、動作はドライビング動画に任せます。

低い設定から開始

まず320×480、4~6ステップで試してください。

Wan-Animate-2で変わったこと

2026年8月7日公開の新しいキャラクターアニメーション基盤です。旧Wan2.2 Animateの改名ではなく、中間の動作抽出を省き、ドライビング動画をDiTへ直接条件付けします。

14Bモデル規模
Apache-2.0オープンライセンス
2026-08-07コードと重みの公開日
Base + Distilled公開バリアント
公式アーキテクチャ図

参照外見、動作動画、テキスト条件が再設計された動画DiTへ直接入ります。

動画を直接条件付け

別の姿勢抽出器を介さず、DiT内で動作ソースを使います。

アイデンティティ保持

動作転送中も参照キャラクターの外見を維持する設計です。

テキストによる視点制御

出力カメラをドライビング動画の視点から切り離せます。

蒸留版

サンプリング負荷を減らした蒸留Diffusers版を埋め込みデモが使用します。

このページで使う正確なモデル

iframeはWan-AI/Wan2.2-Animate-2-14B-Distilled-Diffusersです。旧Wan2.2 Animate APIとは別物です。

参照画像からアニメーションへ

無料デモは3つの条件入力を保った最短ワークフローです。

1キャラクターを選ぶ

顔、服装、体格、見た目を定義する画像を1枚用意します。

2動作を与える

1~5秒の動画から体、頭、カメラの動きを取得します。

3外見と背景を説明

主観を避けて外見と背景を記述し、動作の重複説明は避けます。

4生成して確認

低設定から始め、顔、手足、遮蔽、カメラを確認します。

無料デモの設定

現在のhugging-apps Spaceの範囲であり、ダウンロードモデルの上限ではありません。

設定範囲役割
長さ1–5 s

ドライビング動画の先頭から処理する秒数。

縦横サイズ320–640 px

各辺は16の倍数に丸められます。

推論ステップ4–20

増やすほどGPU時間が増え、初期値は6です。

ガイダンス1.0–6.0

1.0ではCFGが無効で高速です。

サンプルシフト1.0–12.0

Flow Matchingのスケジュールを調整します。

フレームレート24 fps

入力と出力は24fpsです。

シード0+

結果の再現や変化に使います。

公式リポジトリは8×A800で720Pを案内しています。デモのスライダーをモデル上限と解釈しないでください。

無料でも無制限ではありません

ZeroGPUにはアカウント別の日次クォータがあります。xlarge GPUを使うため、高解像度と多いステップは消費が大きくなります。

2 min未ログイン
5 minHF無料アカウント
40 minHF PRO

匿名リクエストはより厳しい共有プールも使います。

Space内の推定値

320 × 480 · 4 steps≈ 23s
640 × 480 · 8 steps≈ 237s

現在のコードにある2つの測定値で、標準ベンチマークや保証時間ではありません。

公開Gradio APIとしても利用可能

生成ボタンはapi_name="animate"です。呼び出す前にview_api()で現在のスキーマを確認してください。

/animate
from gradio_client import Client, handle_file

client = Client(
    "hugging-apps/wan2-2-animate-2-14b"
)

client.view_api()
# Then call api_name="/animate"
スキーマを確認

引数順を固定せずview_api()かOpenAPIを使います。

2ファイルを処理

画像と動画をGradioのファイル処理でアップロードします。

キューを前提にする

非同期で高負荷、ZeroGPUの状態とクォータに依存します。

無制限の本番APIとして再配布しないでください。SLAがなく、モデルやUIが変わる可能性があります。

旧Wan2.2 Animateとの違い

どちらもキャラクターを動かしますが、新版は条件付け構造が異なります。

項目Wan2.2 AnimateWan-Animate-2
世代

初代Wan2.2 Animate

新しいエンドツーエンド基盤

動作入力

中間表現を使用

動画をDiTへ直接入力

カメラ

元動画に近い

テキスト視点制御を追加

このデモ

未使用

14B蒸留Diffusers版

生成前の注意点

初期段階の高負荷な公開デモです。

短い長さ

先頭1~5秒のみ処理します。

外見のドリフト

遮蔽、急な回転、手や特殊な体形で破綻する場合があります。

稼働保証なし

Spaceは停止、待機、更新、終了する可能性があります。

権利とプライバシー

同意、肖像権、著作権、適法利用は利用者の責任です。

ローカル実行には大型構成が必要

公式構成は一般的なPCではなく高性能な複数GPU向けです。

  • 公式標準:8×A800で720P
  • 公式テスト:2×A800で480P
  • Base、蒸留版、Diffusers、ComfyUI連携を公開

よくある質問

モデル、公開Space、本番APIの違い。

本当に無料ですか?+

現在はZeroGPUで無料ですが、日次クォータ、キュー、Spaceの状態に制限されます。

HFアカウントは必要ですか?+

匿名でも利用できますが日次2分で共有プールの制限があります。

新モデルを使っていますか?+

はい。ソースは新しい14B蒸留Diffusersチェックポイントを指定しています。

APIで呼べますか?+

公開中は/animateを呼べますが、実験用で本番SLAはありません。

長尺や720Pは可能ですか?+

iframeは1~5秒、各辺320~640pxです。ローカルモデルには別の高性能構成が必要です。

参照資料

2026年8月29日に公式資料で確認しました。

© 2026 wan2.video