Adaptador Turbo
LoRA bf16
Generación de vídeo y audio en pocos pasos desde el navegador
MiniMax H3 Turbo LoRA reduce los pasos de muestreo y conserva la generación conjunta de vídeo y audio estéreo de H3. Prueba texto, primer fotograma o fotogramas inicial y final sin instalar el modelo base de 33B.
Hasta unas 5× menos etapas; el tiempo real depende de la cola, el lienzo y el hardware.
El Space público alojado por MiniMaxAI aparece abajo con prompt, fotogramas inicial y final, lienzo, duración, pasos, seed, mejora de prompt y LoRA.
La generación usa Hugging Face ZeroGPU. Son normales las colas, límites diarios, arranques en frío y caídas; puede pedir inicio de sesión.
Es un adaptador de bajo rango para MiniMax H3, no otro modelo base. Permite resultados con menos pasos y conserva la generación conjunta de imagen y sonido.
El LoRA de unos 744 MB todavía necesita el gran H3, los VAE y el codificador de texto en local. El Space gratuito reúne esa pila en GPU remotas.
LoRA bf16
sigue siendo necesario
implementación actual
alineada a la cuadrícula
4 para rapidez; 6–8 para mejorar detalle y movimiento.
Genera audio estéreo sincronizado junto a la imagen, no como doblaje posterior.
Admite solo texto, primer fotograma o primero y último.
Adaptador Apache-2.0 y nodos ComfyUI, aunque el modelo base sigue siendo pesado.
Recomendaciones de la ficha actual, sobre todo para ComfyUI local. Los controles del Space pueden cambiar.
| Control | Recomendación | Motivo |
|---|---|---|
| Checkpoint | v4 step-600 EMA | Mejor opción general para escenas quietas, poco movimiento y detalle. |
| Pasos | 6–8 | Más limpio que 4; más de 8 aporta poco y puede sobreenfocar. |
| Fuerza LoRA | 1.0 | Ajustado en torno a 1.0. |
| Scheduler | simple | Base del flujo publicado. |
| Borrador rápido | 4 pasos | El movimiento rápido puede dejar estelas. |
El Space Gradio se puede llamar, pero es una demo sin garantía. Para producción conviene un proveedor de pago.
Consulta el schema con view_api() antes de enviar. Endpoint y parámetros pueden cambiar.
import { Client } from "@gradio/client";
const client = await Client.connect(
"MiniMaxAI/MiniMax-H3-Turbo-Lora"
);
// Read the live schema before calling the public Space.
console.log(await client.view_api());WaveSpeed ofrece una API REST H3 text-to-video LoRA de 3–15 s, LoRAs personalizados y audio estéreo.
Precio verificado el 4 de septiembre de 2026; compruébalo antes de pagar.
Turbo reduce el muestreo, no las limitaciones de un gran modelo de audio y vídeo.
La cuota anónima es pequeña; puede haber colas largas y fallos.
Aunque el LoRA es pequeño, modelo, codificadores y VAE dominan memoria y disco.
Ante estelas a 4 pasos, aumenta pasos y simplifica la escena.
Endpoints, entradas, disponibilidad y autenticación pueden cambiar.
No. Es un LoRA aplicado a H3 para reducir los pasos necesarios.
El Space ZeroGPU no necesita clave MiniMax, pero tiene cuotas, colas y posible inicio de sesión.
Sí, con primer fotograma y último opcional.
Sí, produce audio estéreo sincronizado con el vídeo; la calidad sigue mejorando.
v4, 6 pasos, fuerza 1.0 y scheduler simple; usa 8 si priorizas calidad.
Se puede llamar, pero no tiene garantía. Usa una API de pago o autoalojamiento.