免费说话照片 Demo

SadTalker Online

上传一张静帧人像和一段语音。SadTalker 会按音频驱动面部。本页嵌入公开 Demo,无需自备 GPU 或 API Key。

免费试玩 不用 API Key 照片 + 音频 → 视频
免费试玩 SadTalker

在线生成器

生成说话视频

建议先用推荐 Demo。若排队或休眠,再切备用源。页面只加载当前选中的 Demo。

推荐 Demo

公开 Demo 可能休眠、排队或突然下线。

共享公开 GPU

正在加载 SadTalker Demo

怎么用 SadTalker

三步说话照片流程。音频尽量短,公开队列才更容易跑完。

01

上传人像

清晰、尽量正面的脸最好。避开很小的脸、严重遮挡和合影。

02

上传语音

干净人声比嘈杂音乐更容易。短音频对免费 GPU 窗口更友好。

03

生成并下载

提交后保持标签页打开,预览 MP4,再从 Demo 里保存。

SadTalker 适合做什么

SadTalker(CVPR 2023)用音频驱动静帧人脸。它是说话头像工具,不是全身视频生成器。

说话照片

一张人像加一段声音,变成短的对口型说话视频。

音频驱动动作

口型和表情跟随驱动音频,而不是文本提示词。

Still 与姿态选项

多数 Demo 提供 still mode、preprocess、pose style 和 expression scale。

不用本地 GPU

嵌入的 Demo 连接公开服务。Wan2.Video 不在自有服务器上跑这个模型。

SadTalker vs Wan 2.2 S2V

两者都能用音频驱动静帧,但任务和观感不同。

对比项SadTalkerWan 2.2 S2V
任务单张脸的说话头像动画更完整的语音驱动表演
输入人像 + 驱动音频图片 + 说话或唱歌音频
更适合经典说话照片、讲解、数字人带更多身体动作的说话或唱歌镜头

SadTalker 常见问题

这里的 SadTalker 免费吗?

本站无需注册即可试用。算力来自公开 ZeroGPU Demo,排队、每日额度和宕机都是常态。

为什么大概只能生成一次?

匿名 ZeroGPU 大约每天两分钟,而这个 SadTalker Demo 每次任务常常预留至少 90 秒。第二次可能被拒,直到额度刷新,或你改用备用 Demo。

需要自己的 API Key 或 GPU 吗?

这个页面不需要。商业 API 是收费的。官方 Hugging Face Demo 目前是坏的,真正能跑的是社区修复版。

能当生产后端吗?

不能。公开 Demo 会改、会睡、会消失。有真实流量请用付费 API 或自建。项目本身是 Apache 2.0。

哪些内容不要上传?

隐私照片、未经同意的声音,以及任何敏感内容。文件会交给第三方公开 Demo 处理。

© 2026 wan2.video