Préférez un visage et un corps visibles, peu d’occlusions et de l’espace autour du sujet.
Wan-Animate-2
Animation de personnage de bout en bout à partir d’une image et d’une vidéo guide
Wan-Animate-2 ingère directement personnage, vidéo de mouvement et texte dans un Diffusion Transformer 14B remanié. Cette page réunit guide précis et démo publique ZeroGPU.
Créer une courte vidéo Wan-Animate-2 en ligne
Chargez une image et une courte vidéo guide. Le Space intégré exécute le checkpoint Diffusers distillé sur ZeroGPU.
Le Space charge Wan-AI/Wan2.2-Animate-2-14B-Distilled-Diffusers sans relayer la requête vers DashScope. /animate est exposé par Gradio.
Image, vidéo et prompt sont envoyés directement à un Space Hugging Face tiers. N’envoyez pas de contenu privé, confidentiel ou sans licence.
La démo traite 1 à 5 secondes et normalise à 24 i/s.
Le prompt décrit vêtements, identité et décor ; le mouvement vient de la vidéo.
Testez d’abord 320×480 et 4 à 6 étapes.
Ce que Wan-Animate-2 change
Publié le 7 août 2026, Wan-Animate-2 est un nouveau cadre d’animation et non un renommage de l’ancien Wan2.2 Animate. La vidéo guide conditionne directement le DiT sans extracteur de mouvement intermédiaire.
Apparence, mouvement et texte entrent directement dans le Diffusion Transformer vidéo remanié.
Le DiT consomme la vidéo guide sans extracteur de pose ou de mouvement séparé.
Les caractéristiques de référence aident à stabiliser l’apparence pendant le transfert.
La caméra de sortie peut être découplée du point de vue de la vidéo guide.
Le checkpoint distillé réduit l’échantillonnage ; c’est celui de l’iframe.
L’iframe exécute Wan-AI/Wan2.2-Animate-2-14B-Distilled-Diffusers. Des API plus anciennes peuvent encore utiliser la génération précédente.
De l’image à l’animation
La démo conserve les trois entrées de conditionnement dans le parcours le plus court.
Une image définit visage, tenue, proportions et identité visuelle.
Une vidéo de 1 à 5 secondes guide corps, tête et caméra.
Décrivez objectivement le personnage et le fond sans répéter le mouvement.
Commencez petit puis contrôlez identité, membres, occlusions et caméra.
Paramètres de la démo gratuite
Contrôles actuels du Space, pas limites complètes du modèle téléchargeable.
Partie initiale de la vidéo guide à animer.
Chaque dimension est ramenée à un multiple de 16.
Plus d’étapes consomment plus de GPU ; 6 par défaut.
À 1.0, le CFG est désactivé pour accélérer.
Règle le calendrier Flow Matching ; 5.0 par défaut.
Entrée normalisée et MP4 exporté à 24 i/s.
Reproduit ou fait varier la génération.
Le dépôt officiel documente 720P sur 8× A800. Les curseurs de la démo ne sont pas les limites du modèle.
Gratuit ne signifie pas illimité
ZeroGPU attribue un quota quotidien selon le compte. Le Space demande un GPU xlarge ; résolution et étapes élevées épuisent vite le quota.
Les requêtes anonymes passent aussi par un pool partagé plus strict.
Mesures du code du Space
Deux mesures actuelles, ni benchmark normalisé ni délai garanti.
Le Space est aussi une API Gradio publique
Le bouton enregistre api_name="animate". Consultez le schéma actuel avec view_api() avant l’envoi.
from gradio_client import Client, handle_file
client = Client(
"hugging-apps/wan2-2-animate-2-14b"
)
client.view_api()
# Then call api_name="/animate"Utilisez view_api() ou OpenAPI plutôt que figer un ancien ordre d’arguments.
Image et vidéo doivent passer par le transfert de fichiers Gradio.
La génération est asynchrone, coûteuse et soumise à ZeroGPU.
Différent de l’ancien Wan2.2 Animate
Les deux animent des personnages, mais la nouvelle version change l’architecture de conditionnement.
Premier Wan2.2 Animate
Nouveau cadre de bout en bout
Représentations intermédiaires
Vidéo directement dans le DiT
Plus liée à la source
Point de vue contrôlé par texte
Non utilisé
Checkpoint Diffusers 14B distillé
À savoir avant de générer
Démo publique précoce et lourde ; le résultat dépend des entrées, de la file et du quota.
Seules les 1 à 5 premières secondes sont traitées.
Occlusions, rotations, mains et anatomies atypiques peuvent créer des erreurs.
Le Space peut dormir, attendre, échouer, changer ou disparaître.
Consentement, droit à l’image, copyright et usage légal restent votre responsabilité.
Le déploiement local exige du matériel lourd
La configuration officielle vise des systèmes multi-GPU haut de gamme.
- Configuration officielle : 8× A800 pour 720P
- Test officiel : 2× A800 pour 480P
- Base, distillation, Diffusers et intégration ComfyUI disponibles
Questions fréquentes
Différences entre modèle, Space public et API de production.
La démo est-elle vraiment gratuite ?+
Oui via ZeroGPU aujourd’hui, dans la limite du quota, de la file et de la disponibilité.
Faut-il un compte HF ?+
L’accès anonyme est possible, avec deux minutes quotidiennes et un pool partagé plus strict.
Utilise-t-elle le nouveau modèle ?+
Oui, le code nomme le checkpoint Diffusers 14B distillé de la nouvelle version.
Puis-je appeler l’API ?+
/animate est public tant que le Space fonctionne, sans SLA de production.
Longue vidéo ou 720P ?+
Pas dans l’iframe : 1–5 secondes et 320–640 px par côté. Le local demande bien plus de matériel.
Sources du modèle et de la démo
Vérifié dans les sources officielles le 29 août 2026.