Wan-Animate-2

End-to-End-Charakteranimation aus Bild und Bewegungsvideo

Wan-Animate-2 verarbeitet Referenzfigur, Bewegungsvideo und Text direkt in einem neu gestalteten 14B Diffusion Transformer. Diese Seite verbindet Modellguide und öffentliche ZeroGPU-Demo.

14B modelBase and distilled24fps demoApache-2.0
Referenzfigur
Bewegungsvideo
Aussehen und Hintergrund
Wan-Animate-2
Animiertes Video

Kurzes Wan-Animate-2-Video online erstellen

Bild und kurzes Bewegungsvideo hochladen. Der eingebettete Space nutzt das destillierte Diffusers-Modell auf ZeroGPU.

Echtes ZeroGPU-Modell

Der Space lädt Wan-AI/Wan2.2-Animate-2-14B-Distilled-Diffusers und leitet nicht an DashScope weiter. /animate ist als Gradio-Endpunkt verfügbar.

Öffentlicher Spacehugging-apps · ZeroGPU
Wan-Animate-2 Space wird geladen…
Uploads verlassen wan2.video

Bild, Bewegungsvideo und Prompt gehen direkt an einen externen Hugging-Face-Space. Keine privaten, vertraulichen oder nicht lizenzierten Inhalte hochladen.

Klares Figurenbild

Gesicht und Körper sollten sichtbar, wenig verdeckt und mit ausreichend Rand dargestellt sein.

Kurzes Bewegungsvideo

Die Demo verarbeitet 1–5 Sekunden und normalisiert auf 24fps.

Aussehen beschreiben

Prompt für Kleidung, Identität und Hintergrund nutzen; die Bewegung kommt aus dem Video.

Niedrig beginnen

Zuerst 320×480 und 4–6 Schritte testen, bevor mehr Kontingent verbraucht wird.

Was Wan-Animate-2 verändert

Wan-Animate-2 erschien am 7. August 2026 als neuer Animationsrahmen und ist keine Umbenennung des alten Wan2.2 Animate. Das Bewegungsvideo wird ohne separaten Bewegungsextraktor direkt im Video-DiT verarbeitet.

14BModellgröße
Apache-2.0Open-Source-Lizenz
2026-08-07Veröffentlichung von Code und Gewichten
Base + DistilledVarianten
Offizielle Wan-Animate-2-Architektur

Referenz, Bewegungsvideo und Textbedingung fließen direkt in den neu gestalteten Video-Diffusion-Transformer.

Direkte Videokonditionierung

Das DiT verwendet das Bewegungsvideo ohne vorgeschalteten Pose- oder Bewegungsextraktor.

Identitätserhalt

Referenzmerkmale sollen das Aussehen der Figur während der Bewegungsübertragung stabil halten.

Textgesteuerte Perspektive

Die Ausgabekamera kann von der Perspektive des Bewegungsvideos entkoppelt werden.

Destillierte Variante

Sie senkt den Sampling-Aufwand; genau diese Diffusers-Variante läuft im iframe.

Exaktes Modell dieser Seite

Das iframe nutzt Wan-AI/Wan2.2-Animate-2-14B-Distilled-Diffusers. Ältere Wan2.2-Animate-Endpunkte können noch das Vorgängermodell ausführen.

Vom Referenzbild zur Animation

Die Demo zeigt den kürzesten nutzbaren Ablauf mit allen drei Konditionierungseingaben.

1Figur wählen

Ein Bild definiert Gesicht, Kleidung, Proportionen und Identität.

2Bewegung liefern

Ein 1–5 Sekunden langer Clip steuert Körper-, Kopf- und Kamerabewegung.

3Aussehen und Szene beschreiben

Figur und Hintergrund objektiv beschreiben; Bewegung nicht doppelt anweisen.

4Generieren und prüfen

Mit niedrigen Einstellungen starten und Identität, Gliedmaßen, Verdeckungen und Kamera prüfen.

Parameter der kostenlosen Demo

Dies sind die aktuellen Regler des hugging-apps Space, nicht die vollständigen Grenzen des herunterladbaren Modells.

ParameterBereichBedeutung
Dauer1–5 s

Länge ab Beginn des Bewegungsvideos.

Höhe und Breite320–640 px

Jede Seite wird auf ein Vielfaches von 16 gerundet.

Inferenzschritte4–20

Mehr Schritte benötigen mehr GPU-Zeit; Standard ist 6.

Guidance Scale1.0–6.0

Bei 1.0 ist CFG für den schnellen destillierten Lauf aus.

Sample Shift1.0–12.0

Passt den Flow-Matching-Samplingplan an; Standard 5.0.

Bildrate24 fps

Ein- und Ausgabe werden mit 24fps verarbeitet.

Seed0+

Ergebnis reproduzieren oder variieren.

Das offizielle Repository dokumentiert 720P mit 8× A800. Die Demo-Regler sind keine Modellgrenzen.

Kostenlos heißt nicht unbegrenzt

ZeroGPU vergibt tägliche GPU-Zeit je Kontotyp. Dieser Space fordert xlarge an; höhere Auflösung und mehr Schritte verbrauchen das Kontingent schnell.

2 minNicht angemeldet
5 minKostenloses HF-Konto
40 minHF PRO

Anonyme Aufrufe nutzen zusätzlich einen strengeren gemeinsamen Pool. Warteschlange und Regeln können sich ändern.

Messwerte im Space-Code

320 × 480 · 4 steps≈ 23s
640 × 480 · 8 steps≈ 237s

Zwei aktuelle Messungen, kein standardisierter Benchmark und keine garantierte Wartezeit.

Der Space ist auch eine öffentliche Gradio-API

Der Generate-Button registriert api_name="animate". Vor dem Upload die aktuelle Struktur mit view_api() prüfen.

/animate
from gradio_client import Client, handle_file

client = Client(
    "hugging-apps/wan2-2-animate-2-14b"
)

client.view_api()
# Then call api_name="/animate"
Schema aktuell lesen

view_api() oder OpenAPI nutzen, statt eine alte Argumentreihenfolge fest einzubauen.

Beide Dateien behandeln

Bild und Video müssen über die Gradio-Dateiverarbeitung hochgeladen werden.

Warteschlange einplanen

Videogenerierung ist asynchron, rechenintensiv und vom ZeroGPU-Kontingent abhängig.

Den öffentlichen Space nicht als unbegrenzte Produktions-API weiterverkaufen. Es gibt kein SLA, und Modell, Oberfläche oder Verfügbarkeit können sich ändern.

Nicht das alte Wan2.2 Animate

Beide animieren Figuren, doch die neue Veröffentlichung besitzt eine andere Konditionierungsarchitektur.

MerkmalWan2.2 AnimateWan-Animate-2
Generation

Erste Wan2.2-Animate-Generation

Neuer End-to-End-Rahmen

Bewegung

Zwischenrepräsentationen

Video direkt im neu gestalteten DiT

Kamera

Stärker an Quelle gebunden

Textgesteuerte Perspektive

Diese Demo

Nicht verwendet

Destilliertes 14B-Diffusers-Modell

Vor dem Generieren beachten

Eine frühe, rechenintensive öffentliche Demo; Erfolg hängt von Eingabe, Warteschlange und Kontingent ab.

Kurze Demo

Nur die ersten 1–5 Sekunden werden verarbeitet.

Drift bleibt möglich

Verdeckungen, schnelle Drehungen, Hände und ungewöhnliche Anatomie können Fehler erzeugen.

Keine Verfügbarkeitsgarantie

Der Space kann schlafen, warten, fehlschlagen, aktualisiert oder beendet werden.

Rechte und Datenschutz

Einwilligung, Persönlichkeitsrechte, Urheberrecht und rechtmäßige Nutzung bleiben Verantwortung der Nutzer.

Lokaler Betrieb braucht große Hardware

Die Referenzkonfiguration zielt auf High-End-Mehrfach-GPU-Systeme.

  • Offizieller Standard: 8× A800 für 720P
  • Offiziell getestet: 2× A800 für 480P
  • Base, Destillation, Diffusers und ComfyUI-Integration verfügbar

Häufige Fragen

Unterschiede zwischen Modell, öffentlichem Space und Produktions-API.

Ist die Demo wirklich kostenlos?+

Der Space nutzt aktuell ZeroGPU ohne direkte Kosten, ist aber durch Tageskontingent, Warteschlange und Verfügbarkeit begrenzt.

Brauche ich ein HF-Konto?+

Anonym geht derzeit, jedoch nur mit zwei Minuten Tageskontingent und strengerem gemeinsamem Pool.

Ist es wirklich das neue Modell?+

Ja. Der Quellcode nennt den neuen destillierten 14B-Diffusers-Checkpoint.

Kann ich die API verwenden?+

/animate ist öffentlich, solange der Space läuft. Es ist ein Demo-Endpunkt ohne Produktions-SLA.

Sind lange Videos oder 720P möglich?+

Nicht im iframe: 1–5 Sekunden und 320–640 Pixel je Seite. Lokal sind andere Einstellungen mit deutlich mehr Hardware möglich.

Modell- und Demoquellen

Am 29. August 2026 anhand offizieller Quellen geprüft.

© 2026 wan2.video