优先选择脸部和身体清晰、遮挡少、人物周围留有空间的图片。
在线生成一段 Wan-Animate-2 短视频
上传一张角色图片和一段短驱动视频。内嵌 Space 在 Hugging Face ZeroGPU 上运行 Wan-Animate-2 蒸馏版 Diffusers 权重,不需要本地安装。
Space 加载 Wan-AI/Wan2.2-Animate-2-14B-Distilled-Diffusers,不是转发到 DashScope;同时通过 Gradio 暴露 /animate 接口。
角色图片、驱动视频和提示词会直接提交给第三方 Hugging Face Space。不要上传隐私、机密或未获授权的资料;排队、保存和审核由 Hugging Face 与 Space 所有者控制。
公共演示只处理 1–5 秒,并统一转换为 24fps。
提示词用于服装、身份特征和背景;动作主要来自驱动视频。
先用 320×480、4–6 步测试,再把额度用于更大画面。
Wan-Animate-2 改变了什么
Wan-Animate-2 于 2026 年 8 月 7 日发布,是新的角色动画框架,不是旧版 Wan2.2 Animate 的改名版本。它取消中间动作提取阶段,将驱动视频条件直接放进视频 DiT。
官方架构:参考外观、驱动动作和文字条件直接进入重新设计的视频扩散 Transformer。
模型在 DiT 内接收动作来源,不再依赖独立的姿态或动作提取器。
参考图特征用于在迁移动作时尽量稳定角色外观。
文字可以影响输出机位,让镜头不必完全绑定驱动视频的视角。
蒸馏权重减少采样开销;本页内嵌 Space 使用的正是这个 Diffusers 版本。
iframe 运行 Wan-AI/Wan2.2-Animate-2-14B-Distilled-Diffusers。fal.ai、Replicate 和部分社区里的 Wan2.2 Animate 接口仍可能是上一代模型。
从参考图到角色动画
免费演示保留了三个核心条件输入,同时把流程压缩为最短的可用路径。
上传一张定义脸部、服装、比例和初始身份的图片。
上传 1–5 秒驱动片段,其身体、头部和镜头运动会指导动画。
客观描述角色和背景,不必重复驱动视频已经提供的动作。
先从较低分辨率和步数开始,再检查身份、肢体、遮挡和镜头。
免费演示参数
以下是 hugging-apps Space 当前提供的控件,不是可下载模型的完整能力上限。
从驱动视频开头截取并制作动画的长度。
Space 会把每个尺寸调整为 16 的倍数。
步数越多消耗的 GPU 时间越多,默认 6 步。
1.0 时关闭 CFG,更适合快速蒸馏推理。
调整 Flow Matching 采样计划,默认 5.0。
输入会被标准化,输出 MP4 固定为 24fps。
用于复现结果或改变随机生成路径。
官方仓库支持更高生产参数,文档中的 8× A800 配置可生成 720P。不要把公共演示滑块当作模型上限。
免费不等于无限
Hugging Face ZeroGPU 根据账户类型分配每日 GPU 额度。这个 Space 申请 xlarge GPU,分辨率和步数提高后会很快消耗额度。
匿名请求还会进入限制更严的共享池。队列和额度规则可能随时变化。
Space 内置性能估算
这是当前 Space 代码中的两次测量,不是标准化模型基准,也不保证实际等待时间。
同一个 Space 也是公开 Gradio API
生成按钮注册了 api_name="animate"。Space 作者可能调整参数,因此上传文件前应通过 view_api() 读取实时结构。
from gradio_client import Client, handle_file
client = Client(
"hugging-apps/wan2-2-animate-2-14b"
)
client.view_api()
# Then call api_name="/animate"用 client.view_api() 或 Space OpenAPI 文档,不要永久写死旧参数顺序。
参考图和驱动视频都要先通过 Gradio 文件处理上传。
视频生成是高耗时异步任务,受 ZeroGPU 状态和用户额度限制。
Wan-Animate-2 不是旧版 Wan2.2 Animate
两者都能驱动角色,但新版本更换了条件架构,并形成独立模型系列。
第一代 Wan2.2 Animate 工作流
新的端到端 Wan-Animate-2 框架
使用中间动作表示
驱动视频直接进入重新设计的 DiT
更贴近来源视频设置
新增文字驱动的视角控制
不使用
运行 14B 蒸馏 Diffusers 权重
生成前需要知道的限制
这是早期且计算量很大的公共演示,能否成功仍取决于输入质量、队列和 GPU 额度。
内嵌 Space 只处理驱动视频开头 1–5 秒。
遮挡、快速转身、手部和特殊肢体结构可能导致身份或结构错误。
Space 可能休眠、排队、失败、更新或下线,与 wan2.video 无关。
上传者需自行确认同意、肖像权、版权和所有素材的合法用途。
本地部署是另一种硬件规模
官方参考配置面向高端多 GPU 系统,并不适合普通浏览器或消费级笔记本。
- 官方默认配置:8× A800 生成 720P
- 官方已测试:2× A800 生成 480P
- 已提供 Base、蒸馏权重、Diffusers 和 ComfyUI 集成
Wan-Animate-2 常见问题
区分模型本身、这个公共 Space 和生产 API。
Wan-Animate-2 演示真的免费吗?+
当前内嵌公共 Space 使用 Hugging Face ZeroGPU,不直接向 wan2.video 用户收费,但受每日额度、队列容量和 Space 在线状态限制。
需要 Hugging Face 账号吗?+
目前可以匿名访问,但每天只有 2 分钟额度,而且使用更严格的共享池。登录 Hugging Face 后可以获得上表对应的账户额度。
演示使用的真是新模型吗?+
是。源码明确指定 Wan-AI/Wan2.2-Animate-2-14B-Distilled-Diffusers,属于新的 Wan-Animate-2 发布。
可以作为 API 调用吗?+
可以在 Space 可用时调用公开 Gradio /animate 接口,但应把它视为实验性演示接口,不是生产服务。
iframe 能生成长视频或 720P 吗?+
不能。当前公共控件限制为 1–5 秒,宽高各为 320–640 像素。可下载模型可用更多设置,但硬件需求显著更高。
模型与演示资料
技术信息于 2026 年 8 月 29 日根据官方模型卡、论文、Space 源码和 Hugging Face API 文档核验。