Wan-Animate-2

用角色图片和驱动视频完成端到端角色动画

Wan-Animate-2 在重新设计的 14B 扩散 Transformer 中直接接收参考角色、动作视频和文字描述。本页把准确的模型介绍与 Hugging Face 公共 ZeroGPU 演示整合在一起。

14B 模型Base 与蒸馏版演示输出 24fpsApache-2.0
参考角色图片
驱动视频
外观与背景描述
Wan-Animate-2
角色动画视频

在线生成一段 Wan-Animate-2 短视频

上传一张角色图片和一段短驱动视频。内嵌 Space 在 Hugging Face ZeroGPU 上运行 Wan-Animate-2 蒸馏版 Diffusers 权重,不需要本地安装。

真正运行模型的 ZeroGPU 演示

Space 加载 Wan-AI/Wan2.2-Animate-2-14B-Distilled-Diffusers,不是转发到 DashScope;同时通过 Gradio 暴露 /animate 接口。

公共 Spacehugging-apps · ZeroGPU
正在加载 Wan-Animate-2 Space…
上传内容会离开 wan2.video

角色图片、驱动视频和提示词会直接提交给第三方 Hugging Face Space。不要上传隐私、机密或未获授权的资料;排队、保存和审核由 Hugging Face 与 Space 所有者控制。

使用清晰的角色图片

优先选择脸部和身体清晰、遮挡少、人物周围留有空间的图片。

驱动视频尽量短

公共演示只处理 1–5 秒,并统一转换为 24fps。

描述外观而非动作

提示词用于服装、身份特征和背景;动作主要来自驱动视频。

从低参数开始

先用 320×480、4–6 步测试,再把额度用于更大画面。

Wan-Animate-2 改变了什么

Wan-Animate-2 于 2026 年 8 月 7 日发布,是新的角色动画框架,不是旧版 Wan2.2 Animate 的改名版本。它取消中间动作提取阶段,将驱动视频条件直接放进视频 DiT。

14B模型规模
Apache-2.0开源许可证
2026-08-07权重与代码发布日期
Base + Distilled公开版本
Wan-Animate-2 官方架构图

官方架构:参考外观、驱动动作和文字条件直接进入重新设计的视频扩散 Transformer。

直接使用驱动视频

模型在 DiT 内接收动作来源,不再依赖独立的姿态或动作提取器。

角色身份保持

参考图特征用于在迁移动作时尽量稳定角色外观。

文字控制视角

文字可以影响输出机位,让镜头不必完全绑定驱动视频的视角。

蒸馏快速路径

蒸馏权重减少采样开销;本页内嵌 Space 使用的正是这个 Diffusers 版本。

本页使用的准确模型

iframe 运行 Wan-AI/Wan2.2-Animate-2-14B-Distilled-Diffusers。fal.ai、Replicate 和部分社区里的 Wan2.2 Animate 接口仍可能是上一代模型。

从参考图到角色动画

免费演示保留了三个核心条件输入,同时把流程压缩为最短的可用路径。

1选择角色

上传一张定义脸部、服装、比例和初始身份的图片。

2提供动作

上传 1–5 秒驱动片段,其身体、头部和镜头运动会指导动画。

3描述外观和场景

客观描述角色和背景,不必重复驱动视频已经提供的动作。

4生成并检查

先从较低分辨率和步数开始,再检查身份、肢体、遮挡和镜头。

免费演示参数

以下是 hugging-apps Space 当前提供的控件,不是可下载模型的完整能力上限。

参数当前范围作用
时长1–5 s

从驱动视频开头截取并制作动画的长度。

宽度与高度320–640 px

Space 会把每个尺寸调整为 16 的倍数。

推理步数4–20

步数越多消耗的 GPU 时间越多,默认 6 步。

引导强度1.0–6.0

1.0 时关闭 CFG,更适合快速蒸馏推理。

采样偏移1.0–12.0

调整 Flow Matching 采样计划,默认 5.0。

输出帧率24 fps

输入会被标准化,输出 MP4 固定为 24fps。

随机种子0+

用于复现结果或改变随机生成路径。

官方仓库支持更高生产参数,文档中的 8× A800 配置可生成 720P。不要把公共演示滑块当作模型上限。

免费不等于无限

Hugging Face ZeroGPU 根据账户类型分配每日 GPU 额度。这个 Space 申请 xlarge GPU,分辨率和步数提高后会很快消耗额度。

2 min未登录用户
5 minHF 免费账户
40 minHF PRO 账户

匿名请求还会进入限制更严的共享池。队列和额度规则可能随时变化。

Space 内置性能估算

320 × 480 · 4 steps≈ 23s
640 × 480 · 8 steps≈ 237s

这是当前 Space 代码中的两次测量,不是标准化模型基准,也不保证实际等待时间。

同一个 Space 也是公开 Gradio API

生成按钮注册了 api_name="animate"。Space 作者可能调整参数,因此上传文件前应通过 view_api() 读取实时结构。

/animate
from gradio_client import Client, handle_file

client = Client(
    "hugging-apps/wan2-2-animate-2-14b"
)

client.view_api()
# Then call api_name="/animate"
先读取实时结构

用 client.view_api() 或 Space OpenAPI 文档,不要永久写死旧参数顺序。

正确处理两个文件

参考图和驱动视频都要先通过 Gradio 文件处理上传。

按排队任务处理

视频生成是高耗时异步任务,受 ZeroGPU 状态和用户额度限制。

不要把公共 Space 包装成无限生产 API。它没有可用性 SLA,模型和界面都可能变化;集中代理还可能让所有访客共用同一个额度来源。

Wan-Animate-2 不是旧版 Wan2.2 Animate

两者都能驱动角色,但新版本更换了条件架构,并形成独立模型系列。

维度Wan2.2 AnimateWan-Animate-2
代际

第一代 Wan2.2 Animate 工作流

新的端到端 Wan-Animate-2 框架

动作输入

使用中间动作表示

驱动视频直接进入重新设计的 DiT

镜头

更贴近来源视频设置

新增文字驱动的视角控制

本页免费演示

不使用

运行 14B 蒸馏 Diffusers 权重

生成前需要知道的限制

这是早期且计算量很大的公共演示,能否成功仍取决于输入质量、队列和 GPU 额度。

演示时长很短

内嵌 Space 只处理驱动视频开头 1–5 秒。

仍可能出现角色漂移

遮挡、快速转身、手部和特殊肢体结构可能导致身份或结构错误。

公共服务不保证在线

Space 可能休眠、排队、失败、更新或下线,与 wan2.video 无关。

版权与隐私责任

上传者需自行确认同意、肖像权、版权和所有素材的合法用途。

本地部署是另一种硬件规模

官方参考配置面向高端多 GPU 系统,并不适合普通浏览器或消费级笔记本。

  • 官方默认配置:8× A800 生成 720P
  • 官方已测试:2× A800 生成 480P
  • 已提供 Base、蒸馏权重、Diffusers 和 ComfyUI 集成

Wan-Animate-2 常见问题

区分模型本身、这个公共 Space 和生产 API。

Wan-Animate-2 演示真的免费吗?+

当前内嵌公共 Space 使用 Hugging Face ZeroGPU,不直接向 wan2.video 用户收费,但受每日额度、队列容量和 Space 在线状态限制。

需要 Hugging Face 账号吗?+

目前可以匿名访问,但每天只有 2 分钟额度,而且使用更严格的共享池。登录 Hugging Face 后可以获得上表对应的账户额度。

演示使用的真是新模型吗?+

是。源码明确指定 Wan-AI/Wan2.2-Animate-2-14B-Distilled-Diffusers,属于新的 Wan-Animate-2 发布。

可以作为 API 调用吗?+

可以在 Space 可用时调用公开 Gradio /animate 接口,但应把它视为实验性演示接口,不是生产服务。

iframe 能生成长视频或 720P 吗?+

不能。当前公共控件限制为 1–5 秒,宽高各为 320–640 像素。可下载模型可用更多设置,但硬件需求显著更高。

模型与演示资料

技术信息于 2026 年 8 月 29 日根据官方模型卡、论文、Space 源码和 Hugging Face API 文档核验。

© 2026 wan2.video