Kostenloses audiogesteuertes Avatar-Video

OmniAvatar kostenlos testen

Kombiniere ein Charakterbild mit kurzer Sprache zu einem Avatar mit synchronen Lippen, Mimik und Körperbewegung auf öffentlichen ZeroGPU Spaces.

Echtes ZeroGPU Bild + Audio 5-Sekunden-Demo Prompt-Steuerung
Avatar erstellen

Offizielle OmniAvatar-Vorschau

Audio steuert Sprache, der Prompt Verhalten, Emotion und Szene.

Jetzt sprechenden Avatar erstellen

Zuerst den empfohlenen Space nutzen oder manuell wechseln. ZeroGPU kann schlafen, starten, warten oder den Status ändern.

Verfügbarkeit wird geprüft…

alexnasa · OmniAvatar

ZeroGPU-Konfiguration geprüft am 26. August 2026

ZeroGPU · dynamisch
OmniAvatar Space wird gestartet oder geladen…

Ein Porträt, eine Stimme, eine Regieanweisung

Drei einfache Eingaben werden zu einer kurzen Performance. Klare Referenzen und knappe Prompts funktionieren am besten.

1

Porträt wählen

Ein klares Charakterbild hochladen; der Space passt es an die Ausrichtung an.

2

Kurze Stimme hinzufügen

Audio hochladen, per Mikrofon aufnehmen oder ein Beispiel nutzen. Aktuell zählen die ersten 5 Sekunden.

3

Performance inszenieren

Adaptiven Prompt nutzen oder Ausdruck, Körper und Hintergrund beschreiben; dann Steps wählen.

Mehr als Lippensynchronität

OmniAvatar steuert Gesicht, Körper und Szene gemeinsam – für Moderation, Podcast, Gesang und Figuren.

Audiosynchrone Sprache

Wav2Vec richtet Mundbewegung und Mimik an der Stimme aus.

Adaptive Körperanimation

Die Figur kann gestikulieren und den Körper bewegen, statt nur als statischer Kopf zu sprechen.

Textgesteuerte Performance

Prompts steuern Handlung, Emotion, Kamera und optionale Hintergrunddetails.

Audio hochladen oder aufnehmen

Die UI akzeptiert Dateien, Browser-Mikrofon und gespeicherte Sprachbeispiele.

ZeroGPU ist kostenlos, nicht unbegrenzt

HF misst GPU-Zeit je Konto; Restquote beeinflusst die Warteschlange. xlarge kostet 2× large.

KontoGPU pro TagPriorität
Anonym2 minNiedrig
HF Free5 minMittel
HF PRO40 minHöchste

Warum die Demo fünf Sekunden nutzt

Die aktuelle Funktion kürzt Audio auf 5 Sekunden, damit der 14B-Job in die geteilte ZeroGPU-Kapazität passt.

Der aktuelle alexnasa-Code fordert eine 96-GB-xlarge-GPU. Vier Standard-Steps plus 2×-Faktor können die anonyme Tagesquote übersteigen. Schätzung aus Live-Code.

Das Modell läuft wirklich auf geteilten Hugging-Face-GPUs

Statt an eine kommerzielle API weiterzugeben, laden die Spaces OmniAvatar und fordern ZeroGPU bei der Inferenz an.

Dein Browser

Öffentlicher HF Space

ZeroGPU

Avatar-MP4

Öffentliche Gradio-API

Öffentliche Spaces bieten API, aber OmniAvatar hat Vorverarbeitung und Zustand. view_api() lesen statt /predict fest einzubauen.

Client.connect("alexnasa/OmniAvatar")

Das aktuelle Ereignis basiert auf infer_scene und nimmt Bild, Audio, Prompt, Ausrichtung, Steps und Sitzung. Experimentell behandeln.

Produktion und Self-Hosting

14B/1.3B-Gewichte und Code sind Apache-2.0, aber kein HF Inference Provider hostet 14B. Stabile Produkte benötigen eigenes Hosting.

14B 1.3B Apache-2.0 480p

OmniAvatar-Demo FAQ

Ist die OmniAvatar-Demo kostenlos?

ZeroGPU ist innerhalb der HF-Quote kostenlos. Neue 14B-Generierung ist teuer; anonyme Quote kann fehlen und die Wartezeit lang sein.

Kann ich ohne Anmeldung generieren?

Der Space öffnet ohne Login. Generierung hängt von Quote und Dauer ab; für mehr Quote kann HF eine Anmeldung verlangen.

Kann ich langes Audio hochladen?

Eine längere Datei ist wählbar, aber die aktuelle öffentliche Inferenz verarbeitet nur die ersten fünf Sekunden.

Kann ich das als kostenlose Produktions-API nutzen?

Die öffentliche API dient Tests. Status, Queue, Code und Quote ändern sich; es gibt keine Uptime-Zusage.

Wo werden Bild und Stimme verarbeitet?

Sie verlassen Wan2.Video und werden vom gewählten Drittanbieter-Space verarbeitet. Nur autorisiertes Material nutzen.