Adaptateur Turbo
LoRA bf16
Génération audio-vidéo en peu d’étapes, gratuite dans le navigateur
MiniMax H3 Turbo LoRA réduit les étapes d’échantillonnage tout en conservant la génération conjointe de vidéo et d’audio stéréo de H3. Testez texte, première image ou première/dernière image sans installer le modèle 33B.
Jusqu’à environ 5× moins d’étapes ; le temps réel dépend de la file, du canevas et du matériel.
Le Space public hébergé par MiniMaxAI est intégré ci-dessous : prompt, première et dernière images, canevas, durée, étapes, seed, amélioration du prompt et LoRA.
La génération utilise Hugging Face ZeroGPU : files, quota quotidien, démarrage à froid et indisponibilité sont normaux. Une connexion HF peut être demandée.
C’est un adaptateur low-rank pour MiniMax H3, pas un nouveau modèle de fondation. Il permet d’obtenir des résultats en moins d’étapes tout en gardant l’audio-vidéo conjoint.
Le LoRA d’environ 744 Mo exige toujours le grand modèle H3, ses VAE et son encodeur texte en local. Le Space gratuit regroupe cette pile sur GPU distant.
LoRA bf16
toujours requis
implémentation actuelle
alignée à la grille
4 étapes pour la vitesse ; 6–8 pour de meilleurs détails et mouvements.
La piste stéréo synchronisée est générée avec l’image, sans doublage séparé.
Texte seul, première image ou première et dernière images.
Adaptateur Apache-2.0 et nœuds ComfyUI, mais le modèle de base reste lourd.
Recommandations de la fiche actuelle, surtout pour ComfyUI local. Les contrôles du Space peuvent changer.
| Réglage | Conseil | Pourquoi |
|---|---|---|
| Checkpoint | v4 step-600 EMA | Meilleur choix général pour plans fixes, petits mouvements et détails. |
| Étapes | 6–8 | Plus propre que 4 ; au-delà de 8, peu de gain et risque de sur-accentuation. |
| Force LoRA | 1.0 | Réglé autour de 1.0. |
| Scheduler | simple | Prévu par le workflow publié. |
| Brouillon rapide | 4 étapes | Risque de traînées avec mouvements rapides. |
Le Space Gradio est appelable, mais sans garantie de disponibilité. Un fournisseur payant convient mieux à la production.
Utilisez view_api() avant l’appel : endpoint et paramètres peuvent changer avec l’interface.
import { Client } from "@gradio/client";
const client = await Client.connect(
"MiniMaxAI/MiniMax-H3-Turbo-Lora"
);
// Read the live schema before calling the public Space.
console.log(await client.view_api());WaveSpeed propose une API REST LoRA H3 texte-vers-vidéo de 3–15 s avec LoRA personnalisés et audio stéréo.
Tarifs vérifiés le 4 septembre 2026 ; revérifiez avant paiement.
Turbo réduit l’échantillonnage, pas les contraintes d’un grand modèle audio-vidéo.
Petit quota anonyme, files longues et échecs possibles.
Le LoRA est petit, mais modèle, encodeurs et VAE dominent stockage et mémoire.
À 4 étapes, augmentez d’abord les étapes et simplifiez la scène en cas de traînée.
Endpoints, entrées, disponibilité et authentification peuvent changer.
Non, c’est un LoRA appliqué à MiniMax H3 pour réduire le nombre d’étapes utiles.
Le Space ZeroGPU fonctionne sans clé MiniMax, mais quotas, files et connexion peuvent s’appliquer.
Oui, avec première image et dernière image facultative.
Oui, H3 génère une piste stéréo synchronisée avec la vidéo ; la qualité audio continue d’évoluer.
v4, 6 étapes, force 1.0 et scheduler simple ; passez à 8 pour privilégier la qualité.
Techniquement oui, mais sans garantie. Préférez une API payante ou l’auto-hébergement.