Retour au Wiki Inférence

Extension de prompt

Wan2.2s generate.py peut réécrire un court prompt ou sous-titrer une image avant le prélèvement. Les arrière-plans officiels sont DashScope Qwen ou un local Qwen2.5 / Qwen2.5-VL. Ce n'est pas LoRA et pas un deuxième DiT; c'est un LLM pré-pass.

QwenDashScope--use_prompt_extend
Sur cette page 5
Précédent court à travers l'extension Qwen dans Wan2.2 générer
Forc officielle de l'extension rapide: dashscope ou local_qwen, puis le DiT.

Pourquoi le README le recommande

Les étiquettes cinématographiques (lumière, composition, caméra) faisaient partie du travail de données 2.2s. UMT5 Le codeur voit une légende dense.

DashScope API

  • Définir DASH_API_KEY. Le site international a également besoin de DASH_API_URL=https://dashscope-intl.aliyuncs.com/api/v1.
  • Modèles par défaut: qwen-plus pour T2V, qwen-vl-max pour I2V.
  • Remplissez avec --prompt_extend_model. Langue cible: --prompt_extend_target_lang zh doen.
DashScope + 8 GPU T2V
DASH_API_KEY=your_key torchrun --nproc_per_node=8 generate.py --task t2v-A14B --size 1280*720 --ckpt_dir ./Wan2.2-T2V-A14B --dit_fsdp --t5_fsdp --ulysses_size 8 --prompt "Two anthropomorphic cats…" --use_prompt_extend --prompt_extend_method dashscope --prompt_extend_target_lang zh

Le lieu Qwen

  • T2V: Qwen/Qwen2.5-14B-Instruire, 7B, ou 3B selon le reste VRAM.
  • I2V: Qwen/Qwen2.5-VL-7B-Instruire ou 3B.
  • --prompt_extend_method local_qwen et --prompt_extend_model avec un HF id ou un chemin local.

Questions fréquentes

L'extension fonctionne à chaque étape de diffusion?
Non, une fois, avant l'échantillonnage, le coût est un appel de LLM, pas 50 DiT Les étapes.
Je peux le sauter?
Oui. Toutes les commandes de base README fonctionnent sans --use_prompt_extend. La qualité est ce que vous perdez sur les courtes instructions.

Sources primaires

Vérifié avec le README Wan-Video/Wan2.2 · 28 août 2026

© 2026 wan2.video