01
上傳人像
清晰、盡量正面的臉最好。避開很小的臉、嚴重遮擋和合照。
免費說話照片 Demo
上傳一張靜態人像和一段語音。SadTalker 會依音訊驅動臉部。本頁嵌入公開 Demo,不必自備 GPU 或 API Key。
線上生成器
建議先用推薦 Demo。若排隊或休眠,再切備用源。頁面只載入目前選中的 Demo。
推薦 Demo
公開 Demo 可能休眠、排隊或突然下線。
正在載入 SadTalker Demo
三步說話照片流程。音訊盡量短,公開佇列才更容易跑完。
01
清晰、盡量正面的臉最好。避開很小的臉、嚴重遮擋和合照。
02
乾淨人聲比嘈雜音樂更容易。短音訊對免費 GPU 視窗更友善。
03
提交後保持分頁開啟,預覽 MP4,再從 Demo 儲存。
SadTalker(CVPR 2023)用音訊驅動靜態人臉。它是說話頭像工具,不是全身影片生成器。
一張人像加一段聲音,變成短的對口型說話影片。
口型與表情跟隨驅動音訊,而不是文字提示。
多數 Demo 提供 still mode、preprocess、pose style 與 expression scale。
嵌入的 Demo 連到公開服務。Wan2.Video 不在自有伺服器跑這個模型。
兩者都能用音訊驅動靜態圖,但任務與觀感不同。
| 項目 | SadTalker | Wan 2.2 S2V |
|---|---|---|
| 任務 | 單張臉的說話頭像動畫 | 更完整的語音驅動表演 |
| 輸入 | 人像 + 驅動音訊 | 圖片 + 說話或唱歌音訊 |
| 更適合 | 經典說話照片、解說、虛擬人 | 帶更多身體動作的說話或唱歌鏡頭 |
本站無需註冊即可試用。算力來自公開 ZeroGPU Demo,排隊、每日額度與中斷都是常態。
匿名 ZeroGPU 大約每天兩分鐘,而這個 SadTalker Demo 每次任務常常預留至少 90 秒。第二次可能被拒,直到額度刷新,或改用備用 Demo。
這個頁面不需要。商業 API 是收費的。官方 Demo 目前損壞,真正能跑的是社群修復版。
不能。公開 Demo 會改、會睡、會消失。有真實流量請用付費 API 或自建。專案本身是 Apache 2.0。
隱私照片、未經同意的聲音,以及任何敏感內容。檔案會交給第三方公開 Demo。