Voltar à Wiki Inferência

Tarefas assíncronas de API de vídeo

Uma amostra Wan2.2 é de minutos, não de centenas de milissegundos. Cada API sério, portanto, retorna uma identificação de emprego e pede-lhe para fazer uma pesquisa ou assinar. Mantendo uma única solicitação HTTP aberta até que a MP4 exista, o tempo será terminado.

DashScopeGradiojob_id
Nesta página 6
Trabalhos de pós-venda, PENDENÇAS, GPU Trabalhador em execução, bem sucedido ou falhado
Padrão compartilhado: enquete, pesquisa, trazer URL. DashScope, Gradio, Replicar e fal todos parecem assim.

DashScope / Estúdio Modelo

As tarefas do Alibaba Cloud Wan usam um cabeçalho async (X-DashScope-Async: enable) para criar, em seguida, GET /api/v1/tasks/{task_id} até SUCCEED, FAILED, ou CANCELED. O vídeo URL está na carga útil da tarefa. As chamadas de extensão rápida Qwen são conclusões comuns de bate-papo e podem permanecer sincronas; o trabalho DiT não pode.

Espaços de rádio (HF / ModelScope)

Demos públicas juntam-se a uma fila: upload → hash → /queue/join → eventos SSE (estimação, processo, completo). É assim que os espaços Wan-AI oficiais e este site s /wan2.2-s2v demo conversam com ZeroGPU. Timeouts, sleeps e caps diários são propriedades de fila, não propriedades modelo.

Replicação / fal / outros

  • Replicar: POST prediction, poll GET /v1/predictions/{id}, status de início do processo de execução de um processo de execução de um processo de execução de um processo de execução de um processo de execução de um processo de execução de um processo de execução de um processo de execução de um processo de execução de um processo de execução de um processo de execução de um processo de execução de um processo de execução de um processo de execução de um processo de execução de um processo de execução de um processo de execução de um processo de execução de um processo de execução de um processo de execução de um processo de execução de um processo de execução de um processo de execução de um processo de execução de um processo de execução de um processo de execução de um processo de execução de um processo de execução de um processo de execução de um processo de execução de um processo de execução de um processo de execução de um processo de um processo de execução
  • fal: fila.submit + fila.result, ou webhook.
  • Armazenar sempre o ID do fornecedor; nunca bloquear um Worker sem servidor para a amostra completa.

Regras do cliente que impedem fantasmas

  1. Crie o trabalho, insira o job_id + o ID do usuário.
  2. Pesquisa de 25 s com backkoff; espera total de limite (S2V Pode exceder 10 minutos num espaço ocupado).
  3. Tratar o 409/429 como fila, não como o modelo está quebrado.
  4. Em SUCCEEDED, copie o arquivo para o seu próprio armazenamento.
  5. Em FAILED, mostre a mensagem do provedor (OOM, NSFW, áudio vazio) em vez de tentar tempestades novamente.

Perguntas frequentes

Posso transmitir quadros?
Não de generate.py oficial. Você recebe um vídeo acabado. Alguns hosts preview o primeiro clip através --num_clip em S2V.
Webhook vs. pesquisa?
Os webhooks são melhores em sua própria API. Os navegadores devem pesquisar ou usar SSE a partir do seu backend para que o fornecedor GPU nunca veja o socket do usuário diretamente se você pode evitá-lo.

Fontes primárias

Verificado com o README do Wan-Video/Wan2.2 · 28 de agosto de 2026

© 2026 wan2.video