Turboアダプター
bf16 LoRA
少ないステップで音声付き動画を無料生成
MiniMax H3 Turbo LoRAは、MiniMax H3の映像とステレオ音声の同時生成を保ちながらサンプリング回数を減らすアダプターです。33Bのベースモデルをローカルに入れず、テキスト、開始画像、開始・終了画像を試せます。
サンプリング回数は最大約5分の1。実時間はキュー、解像度、ハードウェアで変わります。
MiniMaxAIが運営する公開Spaceを埋め込んでいます。プロンプト、開始・終了画像、キャンバス、長さ、ステップ、Seed、プロンプト拡張、LoRAを設定できます。
生成はHugging Face ZeroGPUで実行されます。キュー、日次枠、コールドスタート、停止があり、追加枠にログインを求められる場合があります。
MiniMax H3用の低ランクアダプターであり、別の基盤モデルではありません。少ないステップで有用な結果を得つつ、映像と音声の同時生成を維持します。
約744 MBのLoRAだけでは動きません。ローカルでは大きなH3本体、VAE、テキストエンコーダーが必要です。無料SpaceはそれらをリモートGPUにまとめたものです。
bf16 LoRA
ローカルでも必要
現行実装
フレーム格子に整合
4ステップが高速点、6〜8ステップは細部と動きを改善します。
映像後の吹替ではなく、同期ステレオ音声を一緒に生成します。
テキストのみ、開始画像、開始・終了画像を利用できます。
Apache-2.0のアダプターとComfyUIノードがありますが、本体の負荷は大きいままです。
現行モデルカードに基づくローカルComfyUI向けの目安です。公開Spaceの項目は変更されます。
| 設定 | 推奨 | 理由 |
|---|---|---|
| Checkpoint | v4 step-600 EMA | 静止・小動作・細部に強い一般推奨。 |
| Sampling steps | 6〜8 | 4より安定し、8超は過剰なシャープ化の可能性。 |
| LoRA strength | 1.0 | 1.0を中心に調整済み。 |
| Scheduler | simple | 公開ワークフローの前提。 |
| 高速ドラフト | 4 steps | 高速動作では残像が出る場合があります。 |
Gradio SpaceはAPIとして呼べますが、可用性保証のない公開デモです。本番には有料プロバイダーが適します。
送信前にview_api()で現在のschemaを確認してください。UI更新でendpointや引数が変わります。
import { Client } from "@gradio/client";
const client = await Client.connect(
"MiniMaxAI/MiniMax-H3-Turbo-Lora"
);
// Read the live schema before calling the public Space.
console.log(await client.view_api());WaveSpeedは3〜15秒、カスタムLoRA、ステレオ音声対応のH3 text-to-video LoRA REST APIを提供しています。
2026年9月4日時点。課金前に再確認してください。
Turboはサンプリングを減らしますが、大規模音声動画モデルの制約は残ります。
匿名枠は小さく、長い待機や失敗があります。
LoRAが小さくても、本体・VAE・エンコーダーが容量とメモリを使います。
4ステップの残像には、まずステップ増加と場面の単純化を試します。
endpoint、入力、可用性、認証は変化します。重要なバックエンドには使わないでください。
いいえ。H3本体に適用して必要ステップを減らすLoRAです。
公開ZeroGPU SpaceはMiniMax APIキーなしで試せますが、枠・キュー・ログイン要求があります。
はい。開始画像と任意の終了画像を利用できます。
はい。映像と同期ステレオ音声を同時生成します。音質は改善中です。
v4で6ステップ、strength 1.0、simple schedulerから始め、品質優先なら8にします。
呼び出せますが保証はありません。本番は有料APIかセルフホストを使ってください。