README Schritte
| Modell | Offizielle Einzelschrift GPU | Flaggen riefen | MehrfachGPU |
|---|---|---|---|
| T2V-A14B / I2V-A14B / S2V-14B | ≥ 80 GB | --offload_model Das ist wahr. --convert_model_dtype [--t5_cpu] | FSDP + Ulysses, FlashAttention3 auf Hopper |
| TI2V-5B | ≥ 24 GB (4090) | Abladen + Umwandeln + --t5_cpu | Gleicher FSDP Weg; Abladen auf 80 GB ablassen, um schneller zu gehen |
Effizienztabellenanzeigen: schnell abbreiten; 14B Multi-GPU verwendet --ulysses_size 4/8 --dit_fsdp --t5_fsdp; Durchschnitte nach dem Aufwärmen. Lesen Sie die PNG für die pro SKU-Zahlen, anstatt einen Blog zu zitieren s es läuft auf 8 GB.
Knoten, die die Nadel bewegen
- --offload_model Wahre Seite DiT Schrittweise CPU zwischen den Stufen.
- --t5_cpu / --t5_fsdp UMT5-XXL ist riesig; lassen Sie es nicht auf einer 24 GB Karte neben der 5B DiT.
- --convert_model_dtype Param_d-Typ-Guss, nicht 4-Bit.
- Auflösung und Rahmenzahl Sequenzlänge ist der Aktivierungskiller.
- CFG eine Sekunde nach vorne, es sei denn, die Grafik verschmilzt sie.
- FP8 / GGUF / distill sehen Sie die Quantifizierungsseiten, wenn 80 GB Fantasy ist.
Häufige Fragen
- Wird 24 GB T2V-A14B laufen?
- Nicht bei der Beamten generate.py Das ist ein Rezept.GPUoder eine Gemeinschaft FP8/GGUF/destillen Sie die Verpackung und erwarten Sie Qualitäts-/Geschwindigkeits-Kompromissen.
- Warum nicht 1280×704 und nicht 1280×720 auf 5B?
- Das Gitter 5B 720P ist 1280×704 / 704×1280, so dass es sich mit den hochkomprimierten VAE Patches ausrichtet.
Primärquellen
Mit dem Wan-Video/Wan2.2 README abgeglichen · 28. August 2026