01
上传人像
清晰、尽量正面的脸最好。避开很小的脸、严重遮挡和合影。
免费说话照片 Demo
上传一张静帧人像和一段语音。SadTalker 会按音频驱动面部。本页嵌入公开 Demo,无需自备 GPU 或 API Key。
在线生成器
建议先用推荐 Demo。若排队或休眠,再切备用源。页面只加载当前选中的 Demo。
推荐 Demo
公开 Demo 可能休眠、排队或突然下线。
正在加载 SadTalker Demo
三步说话照片流程。音频尽量短,公开队列才更容易跑完。
01
清晰、尽量正面的脸最好。避开很小的脸、严重遮挡和合影。
02
干净人声比嘈杂音乐更容易。短音频对免费 GPU 窗口更友好。
03
提交后保持标签页打开,预览 MP4,再从 Demo 里保存。
SadTalker(CVPR 2023)用音频驱动静帧人脸。它是说话头像工具,不是全身视频生成器。
一张人像加一段声音,变成短的对口型说话视频。
口型和表情跟随驱动音频,而不是文本提示词。
多数 Demo 提供 still mode、preprocess、pose style 和 expression scale。
嵌入的 Demo 连接公开服务。Wan2.Video 不在自有服务器上跑这个模型。
两者都能用音频驱动静帧,但任务和观感不同。
| 对比项 | SadTalker | Wan 2.2 S2V |
|---|---|---|
| 任务 | 单张脸的说话头像动画 | 更完整的语音驱动表演 |
| 输入 | 人像 + 驱动音频 | 图片 + 说话或唱歌音频 |
| 更适合 | 经典说话照片、讲解、数字人 | 带更多身体动作的说话或唱歌镜头 |
本站无需注册即可试用。算力来自公开 ZeroGPU Demo,排队、每日额度和宕机都是常态。
匿名 ZeroGPU 大约每天两分钟,而这个 SadTalker Demo 每次任务常常预留至少 90 秒。第二次可能被拒,直到额度刷新,或你改用备用 Demo。
这个页面不需要。商业 API 是收费的。官方 Hugging Face Demo 目前是坏的,真正能跑的是社区修复版。
不能。公开 Demo 会改、会睡、会消失。有真实流量请用付费 API 或自建。项目本身是 Apache 2.0。
隐私照片、未经同意的声音,以及任何敏感内容。文件会交给第三方公开 Demo 处理。