Turbo 適配器
bf16 LoRA 權重
下方嵌入由 MiniMaxAI 託管的公開 Space,目前可設定提示詞、首幀與尾幀、畫布、時長、步數、Seed、提示詞擴寫與 LoRA。
生成在 Hugging Face ZeroGPU 執行。排隊、每日額度、冷啟動與暫時離線都屬正常;Space 也可能要求登入以取得更多額度。
它是 MiniMax H3 的低秩適配器,不是另一套基礎模型。它調整去噪流程,讓 H3 用更少採樣步得到可用結果,同時保留畫面與聲音聯合生成。
本機執行時,約 744 MB 的 LoRA 仍依賴更大的 MiniMax H3 基礎模型、VAE 與文字編碼器。免費 Space 只是在遠端 GPU 封裝整套環境;單獨下載 LoRA 無法生成影片。
bf16 LoRA 權重
本機仍需載入
目前實作
依幀網格對齊
4 步是快速設計點;6–8 步通常以更多運算換取更乾淨的細節與動態。
H3 同時對視覺與音訊流去噪,輸出同步立體聲,而不是事後配音。
公開工作流程支援純文字、首幀圖片,以及首幀加尾幀的引導式生成。
適配器採 Apache-2.0 並有 ComfyUI 節點,但硬體需求仍由大型基礎模型主導。
以下建議來自目前模型卡,較適合本機 ComfyUI;公開 Space 的控制項可能調整。
| 參數 | 建議 | 原因 |
|---|---|---|
| Checkpoint | v4 step-600 EMA | 綜合表現較強,適合靜態、小幅運動與細節。 |
| 採樣步數 | 6–8 | 通常比 4 步乾淨;超過 8 步收益很小,還可能過度銳化。 |
| LoRA 強度 | 1.0 | 模型以 1.0 調整,只在修復特定瑕疵時改變。 |
| Scheduler | simple | 公開工作流程與採樣器以 simple 為基礎。 |
| 快速草稿 | 4 步 | 適合快速迭代,但高速或大幅動作可能拖影。 |
嵌入的 Gradio Space 可以作為 API 呼叫,但仍是沒有可用性承諾的公開展示;生產流量更適合付費服務。
提交前先用 view_api() 讀取即時 schema。Space 更新介面後,端點與參數名可能改變。
import { Client } from "@gradio/client";
const client = await Client.connect(
"MiniMaxAI/MiniMax-H3-Turbo-Lora"
);
// Read the live schema before calling the public Space.
console.log(await client.view_api());WaveSpeed 目前提供 MiniMax H3 文字生成影片 LoRA REST 端點,支援 3–15 秒、自訂 LoRA 與原生立體聲。
價格核驗於 2026 年 9 月 4 日;付費前請重新確認。
Turbo 減少的是採樣運算,不會消除大型音影片模型的營運限制。
匿名額度很少,排隊可能很長,無法保證每次成功。
LoRA 檔案小不代表本機 H3 輕量;主要儲存與記憶體仍來自基礎模型、編碼器和 VAE。
4 步可能讓快速主體拖影;先增加步數並簡化場景,再調整其他參數。
端點、輸入、可用性與驗證可能改變,不要讓關鍵後端依賴公共免費額度。
不是。它是套用到 MiniMax H3 基礎模型的 LoRA 適配器,用來降低有效採樣步數。
下方公開 Space 使用 Hugging Face ZeroGPU,無需 MiniMax API Key;但有額度、排隊與登入提示。
支援。目前工作流程除了提示詞,也可加入首幀與尾幀圖片。
會。MiniMax H3 同時生成畫面與同步立體聲;模型卡也說明音訊仍在改進。
目前 v4 建議從 6 步、強度 1.0 與 simple 調度器開始,重視品質時使用 8 步。
技術上可呼叫,但它有公共額度且沒有服務保證。正式業務請使用付費服務或自行部署。