Turbo-Adapter
bf16 LoRA
Kostenlose Audio-Video-Erzeugung mit wenigen Schritten
MiniMax H3 Turbo LoRA reduziert die Sampling-Schritte und behält H3s gemeinsame Video- und Stereo-Audio-Erzeugung. Teste Text, Startbild oder Start-/Endbild, ohne das 33B-Basismodell lokal zu installieren.
Bis zu etwa 5× weniger Schritte; Laufzeit hängt von Warteschlange, Canvas und Hardware ab.
Das von MiniMaxAI betriebene öffentliche Space ist eingebettet und bietet Prompt, Start-/Endbild, Canvas, Dauer, Schritte, Seed, Prompt-Erweiterung und LoRA.
Hugging Face ZeroGPU bringt Warteschlangen, Tageslimits, Kaltstarts und Ausfälle mit sich; für mehr Kontingent kann eine Anmeldung nötig sein.
Ein Low-Rank-Adapter für MiniMax H3, kein eigenes Basismodell. Er ermöglicht brauchbare Ergebnisse mit weniger Schritten und erhält die gemeinsame Audio-Video-Erzeugung.
Der etwa 744-MB-LoRA benötigt lokal weiterhin das große H3-Modell, VAEs und den Textencoder. Das kostenlose Space stellt den gesamten Stack auf Remote-GPUs bereit.
bf16 LoRA
weiter erforderlich
aktuelle Implementierung
am Frame-Raster
4 Schritte für Tempo, 6–8 für sauberere Details und Bewegung.
Synchrones Stereo-Audio entsteht zusammen mit dem Bild statt in einem separaten Dub.
Text allein, Startbild oder Start- und Endbild werden unterstützt.
Apache-2.0-Adapter und ComfyUI-Nodes, aber das Basismodell bleibt schwer.
Empfehlungen aus der aktuellen Modellkarte für lokales ComfyUI; Space-Regler können sich ändern.
| Regler | Empfehlung | Grund |
|---|---|---|
| Checkpoint | v4 step-600 EMA | Allgemein beste Wahl für statische Szenen, kleine Bewegung und Details. |
| Sampling-Schritte | 6–8 | Sauberer als 4; über 8 wenig Gewinn und mögliche Überschärfung. |
| LoRA-Stärke | 1.0 | Auf 1.0 abgestimmt. |
| Scheduler | simple | Basis des veröffentlichten Workflows. |
| Schneller Entwurf | 4 Schritte | Bei schneller Bewegung sind Schlieren möglich. |
Das Gradio-Space ist per API aufrufbar, bietet aber keine Verfügbarkeitsgarantie. Produktion gehört zu einem bezahlten Anbieter.
Vor jedem Aufruf mit view_api() das aktuelle Schema lesen. Endpoint und Parameter können sich ändern.
import { Client } from "@gradio/client";
const client = await Client.connect(
"MiniMaxAI/MiniMax-H3-Turbo-Lora"
);
// Read the live schema before calling the public Space.
console.log(await client.view_api());WaveSpeed bietet eine H3 Text-to-Video-LoRA-REST-API für 3–15 Sekunden, eigene LoRAs und Stereo-Audio.
Preisstand 4. September 2026; vor Zahlung erneut prüfen.
Turbo reduziert Sampling, nicht die Betriebsgrenzen eines großen Audio-Video-Modells.
Kleines anonymes Kontingent, lange Warteschlangen und Fehler sind möglich.
Trotz kleinem LoRA dominieren Basismodell, Encoder und VAEs Speicher und RAM.
Bei Schlieren mit 4 Schritten zuerst Schritte erhöhen und die Szene vereinfachen.
Endpoints, Eingaben, Verfügbarkeit und Authentifizierung können wechseln.
Nein. Es ist ein LoRA für H3, das die nötigen Sampling-Schritte reduziert.
Das ZeroGPU-Space benötigt keinen MiniMax-Key, unterliegt aber Limits, Warteschlangen und möglicher Anmeldung.
Ja, mit optionalem Start- und Endbild.
Ja, synchrones Stereo-Audio entsteht mit dem Video; die Audioqualität wird weiter verbessert.
v4, 6 Schritte, Stärke 1.0 und simple Scheduler; für Qualität auf 8 erhöhen.
Aufrufbar, aber ohne Garantie. Bezahlte API oder Self-Hosting sind besser.