README étages
| Modèle | Unité officielle GPU | Des drapeaux ont été lancés | - Je suis un...GPU |
|---|---|---|---|
| T2V-A14B / I2V-A14B / S2V-14B | ≥ 80 GB | --offload_model C'est vrai --convert_model_dtype [--t5_cpu] | FSDP + Ulysses, FlashAttention3 sur le Hopper |
| TI2V-5B | ≥ 24 GB (4090) | déchargement + conversion + --t5_cpu | La même voie FSDP; décharger sur 80 GB pour aller plus vite |
Notes de la table d'efficacité: expire immédiatement; 14B multi-GPU utilise --ulysses_size 4/8 --dit_fsdp --t5_fsdp; moyennes après le réchauffement. Lisez le PNG pour les numéros par SKU plutôt que de citer un blog s il fonctionne sur 8 GB.
Les boutons qui déplacent l'aiguille
- --offload_model vraie page DiT bloque à CPU entre les étapes.
- --t5_cpu / --t5_fsdp UMT5-XXL est énorme; ne la laissez pas sur une carte 24 GB à côté de la 5B DiT.
- Le type de coulée --convert_model_dtype param_d, pas de 4 bits.
- La résolution et le nombre de cadres la longueur de la séquence est le tueur d'activation.
- CFG une seconde en avant à moins que le graphique ne le fusionne.
- FP8 / GGUF / distill voir les pages de quantification lorsque 80 GB est de fantaisie.
Questions fréquentes
- Le 24 GB fonctionnera T2V-A14B?
- Pas avec le fonctionnaire generate.py - Il faut utiliser plusieurs...GPU, ou une communauté FP8/GGUF- Je vais déstabiliser et attendre des compromis qualité/vitesse.
- Pourquoi 1280×704 et non 1280×720 sur 5B?
- La grille 5B 720P est 1280×704 / 704×1280, elle s'aligne donc avec les correctifs VAE à haute compression.
Sources primaires
Vérifié avec le README Wan-Video/Wan2.2 · 28 août 2026