README pisos
| Modelo | Unidad oficial GPU | Las banderas sonadas | - ¿Qué es eso?GPU |
|---|---|---|---|
| T2V-A14B / I2V-A14B / S2V-14B | ≥ 80 GB | --offload_model Es cierto --convert_model_dtype [--t5_cpu] | FSDP + Ulysses, FlashAttention3 en Hopper |
| TI2V-5B | ≥ 24 GB (4090) | Descarga + conversión + --t5_cpu | La misma ruta FSDP; baja descarga en 80 GB para ir más rápido |
Nota de la tabla de eficiencia: prontamente se extiende; 14B multi-GPU utiliza --ulysses_size 4/8 --dit_fsdp --t5_fsdp; promedios después de calentar. Lea la PNG para los números por SKU en lugar de citar un blog s se ejecuta en 8 GB.
Los nudos que realmente mueven la aguja
- --offload_model Verdaderas páginas DiT bloquean a CPU entre los pasos.
- --t5_cpu / --t5_fsdp UMT5-XXL es enorme; no lo dejes en una tarjeta 24 GB junto a la 5B DiT.
- --convert_model_dtype tipo de parámetro, no de 4 bits.
- Resolución y número de cuadros longitud de secuencia es el asesino de activación.
- CFG un segundo hacia adelante a menos que el gráfico lo fusione.
- FP8 / GGUF / destilación ver las páginas de cuantificación cuando 80 GB es fantasía.
Preguntas frecuentes
- ¿Correcerá 24 GB T2V-A14B?
- No con la receta oficial de generate.py. Utilice multi-GPU, o un paquete de FP8/GGUF/distill de comunidad, y espere compensaciones de calidad/velocidad.
- ¿Por qué 1280×704 no 1280×720 en 5B?
- La cuadrícula 5B 720P es 1280×704 / 704×1280 por lo que se alinea con los parches de alta compresión VAE.
Fuentes primarias
Verificado con el README de Wan-Video/Wan2.2 · 28 de agosto de 2026