Quels sont les émissions des modèles ouverts 2.2
- T2V-A14B / I2V-A14B / TI2V-5B Vidéo silencieuse.
- S2V-14B vous apportez l'audio; le modèle anime.
- Animate-14B transfert de mouvement; audio non généré.
Ce que les produits 2.5+ ajoutent
Les écrits publics 2.5 (fal, DashScope-style APIs, agrégateurs) décrivent la génération conjointe de dialogue, d'ambiance et de musique, 1080P, et des clips plus longs que les recettes de 2,2 ~ 5 s. Plus tard 2.6/2.7/3.0 conservent AV natifs et ajoutent des contrôles multi-shot ou de référence. Aucun de ceux-ci ne sont publiés comme Wan2.2-style GitHub points de contrôle.
Substituts à poids ouvert
Pour rester sur Apache-2.0 / poids public: générer une vidéo silencieuse Wan2.2, puis ThinkSound (ou une autre V2A) pour le foley; ou faire S2V avec CosyVoice pour les têtes de conversation.
Questions fréquentes
- Un 2.2 GGUF ajoutera-t-il magiquement de l'audio?
- La quantification change le type de poids, pas la modalité de sortie.
- Le S2V compte-t-il comme AV native?
- Non, le AV natif synthétise le son. S2V consomme du son.
Sources primaires
Vérifié avec le README Wan-Video/Wan2.2 · 28 août 2026