Voltar à Wiki Inferência

Expansão de prompt

Wan2.2s generate.py pode reescrever um breve prompt ou legenda uma imagem antes da amostragem. Backends oficiais são DashScope Qwen ou um local Qwen2.5 / Qwen2.5-VL. Isto não é LoRA e não é um segundo DiT; é um LLM pré-pass.

QwenDashScope--use_prompt_extend
Nesta página 5
Promete curto através do extensor Qwen em Wan2.2 gerar
Forca oficial de extensão de prompt: dashscope ou local_qwen, em seguida, o DiT.

Por que o README recomenda

Os rótulos cinematográficos (luz, composição, câmera) faziam parte do trabalho de dados 2.2s. Um prompt de três palavras subutiliza isso. UMT5 O codificador vê uma legenda densa.

DashScope API

  • Configure DASH_API_KEY. O site internacional também precisa de DASH_API_URL=https://dashscope-intl.aliyuncs.com/api/v1.
  • Modelos por defeito: qwen-mais para T2V, qwen-vl-max para I2V.
  • Oficinar com --prompt_extend_modelLíngua alvo: --prompt_extend_target_lang Não é o que se passa.
DashScope + 8 GPU T2V
DASH_API_KEY=your_key torchrun --nproc_per_node=8 generate.py --task t2v-A14B --size 1280*720 --ckpt_dir ./Wan2.2-T2V-A14B --dit_fsdp --t5_fsdp --ulysses_size 8 --prompt "Two anthropomorphic cats…" --use_prompt_extend --prompt_extend_method dashscope --prompt_extend_target_lang zh

Local Qwen

  • T2V: Qwen/Qwen2.5-14B-Instruir, 7B, ou 3B dependendo do restante VRAM.
  • I2V: Qwen/Qwen2.5-VL-7B-Instruir ou 3B.
  • --prompt_extend_method local_qwen e --prompt_extend_model com um ID HF ou caminho local.

Perguntas frequentes

A extensão executa todos os passos de difusão?
Uma vez, antes da amostragem, o custo é uma chamada de LLM, não 50 DiT Passo.
Posso saltá-lo?
Sim. Todos os comandos básicos README funcionam sem --use_prompt_extend. Qualidade é o que você perde em curtas instruções.

Fontes primárias

Verificado com o README do Wan-Video/Wan2.2 · 28 de agosto de 2026

© 2026 wan2.video