Adaptador Turbo
LoRA bf16
Geração gratuita de áudio e vídeo em poucos passos
MiniMax H3 Turbo LoRA reduz os passos de amostragem e mantém a geração conjunta de vídeo e áudio estéreo do H3. Teste texto, quadro inicial ou quadros inicial e final sem instalar o modelo base de 33B.
Até cerca de 5× menos passos; o tempo real depende da fila, tela e hardware.
O Space público hospedado pela MiniMaxAI está incorporado abaixo com prompt, primeiro e último quadros, tela, duração, passos, seed, expansão de prompt e LoRA.
A geração usa Hugging Face ZeroGPU. Filas, cotas diárias, inicialização fria e indisponibilidade são normais; o login pode ser solicitado.
É um adaptador low-rank para MiniMax H3, não outro modelo base. Ele permite resultados com menos passos e preserva a geração conjunta de imagem e som.
O LoRA de cerca de 744 MB ainda precisa do grande H3, VAEs e codificador de texto localmente. O Space grátis reúne essa pilha em GPUs remotas.
LoRA bf16
ainda necessário
implementação atual
alinhada à grade
4 para velocidade; 6–8 para melhorar detalhes e movimento.
Gera áudio estéreo sincronizado com a imagem, sem dublagem separada.
Aceita texto, primeiro quadro ou primeiro e último quadros.
Adaptador Apache-2.0 e nós ComfyUI, mas a base continua pesada.
Recomendações do model card atual, principalmente para ComfyUI local. Os controles do Space podem mudar.
| Controle | Recomendação | Motivo |
|---|---|---|
| Checkpoint | v4 step-600 EMA | Melhor opção geral para cenas paradas, pequenos movimentos e detalhes. |
| Passos | 6–8 | Mais limpo que 4; acima de 8 há pouco ganho e risco de nitidez excessiva. |
| Força LoRA | 1.0 | Ajustado em torno de 1.0. |
| Scheduler | simple | Base do workflow publicado. |
| Rascunho rápido | 4 passos | Movimento rápido pode deixar rastros. |
O Space Gradio pode ser chamado, mas é uma demo sem garantia. Produção combina melhor com um provedor pago.
Consulte o schema com view_api() antes de enviar. Endpoint e parâmetros podem mudar.
import { Client } from "@gradio/client";
const client = await Client.connect(
"MiniMaxAI/MiniMax-H3-Turbo-Lora"
);
// Read the live schema before calling the public Space.
console.log(await client.view_api());WaveSpeed oferece API REST H3 texto-para-vídeo LoRA de 3–15 s, LoRAs personalizados e áudio estéreo.
Preço verificado em 4 de setembro de 2026; confira antes de pagar.
Turbo reduz a amostragem, não os limites de um grande modelo de áudio e vídeo.
A cota anônima é pequena; filas longas e falhas são possíveis.
Apesar do LoRA pequeno, modelo, codificadores e VAEs dominam memória e disco.
Em rastros com 4 passos, aumente passos e simplifique a cena primeiro.
Endpoints, entradas, disponibilidade e autenticação podem mudar.
Não. É um LoRA aplicado ao H3 para reduzir os passos necessários.
O Space ZeroGPU não exige chave MiniMax, mas tem cotas, filas e possível login.
Sim, com primeiro quadro e último opcional.
Sim, cria áudio estéreo sincronizado com o vídeo; a qualidade segue em evolução.
v4, 6 passos, força 1.0 e scheduler simple; use 8 ao priorizar qualidade.
Pode ser chamada, mas sem garantia. Use API paga ou auto-hospedagem.