Wan2.1-VACE
VACE(Video All-in-one Creation and Editing,ICCV 2025,arXiv:2503.07598)把编辑、参考图、mask 收成 Video Condition Unit,再经 Context Adapter 注入 Wan DiT。权重:Wan2.1-VACE-1.3B(约 81×480×832)与 Wan2.1-VACE-14B(约 81×720×1280),Apache 2.0。
- R2V — 没有输入视频;概念来自文本 + 参考图。
- V2V — 对整段视频做像素级重绘 / 结构 / 运动保持。
- MV2V — 带 mask 的局部编辑(inpaint、替换、扩展)。
- 组合:Reference / Move / Animate / Swap / Expand Anything。
Wan2.2-Animate-14B
Animate 是 2.2 时期的专项模型。动画模式:角色图复制驱动视频的动作与表情。替换模式:把角色嵌进驱动视频(mask + 背景 + 可选 relight LoRA)。预处理抽出 pose/face(替换还要背景/mask),再 generate.py --task animate-14B。
python generate.py --task animate-14B --ckpt_dir ./Wan2.2-Animate-14B/ --src_root_path ./examples/wan_animate/animate/process_results/ --refert_num 1S2V 也是一条参考路径
Wan2.2-S2V-14B 可以加 --pose_video,让音频和姿态序列共同驱动同一张身份图。这是带语音的参考生视频,不是 VACE。
常见问题
- VACE 还是 Animate?
- 要改已有视频(inpaint/outpaint/深度/姿态)→ VACE。要静帧角色表演一段驱动视频 → Animate。要按音频说话 → S2V。
- Wan2.2 T2V 有参考图槽位吗?
- T2V-A14B 没有额外参考图接口。用 VACE R2V 或 Animate。
一手来源
对照 Wan-Video/Wan2.2 README 核对 · 2026-08-28