मुफ़्त ऑडियो-ड्रिवन अवतार वीडियो

OmniAvatar मुफ़्त ऑनलाइन डेमो

एक कैरेक्टर इमेज और छोटी आवाज़ से होंठ, भाव और शरीर की गति वाला बोलता अवतार बनाएँ—सार्वजनिक Hugging Face ZeroGPU पर।

वास्तविक ZeroGPU इमेज + ऑडियो 5-सेकंड डेमो Prompt control
अवतार बनाएँ

आधिकारिक OmniAvatar प्रदर्शन

ऑडियो भाषण और prompt व्यवहार, भावना व दृश्य को नियंत्रित करता है।

अभी बोलता अवतार बनाएँ

पहले सुझाया Space उपयोग करें या जरूरत पर बैकअप चुनें। ZeroGPU सो सकता, जाग सकता, कतार लगा सकता या स्थिति बदल सकता है।

alexnasa · OmniAvatar

ZeroGPU configuration जाँच: 26 अगस्त 2026

ZeroGPU · dynamic
OmniAvatar Space जाग या लोड हो रहा है…

एक portrait, एक voice, एक direction

तीन inputs से छोटा avatar performance बनता है। स्पष्ट reference और छोटा prompt बेहतर है।

1

Portrait चुनें

स्पष्ट character image अपलोड करें; Space orientation के अनुसार preprocess करता है।

2

छोटी voice जोड़ें

ऑडियो upload, microphone record या sample चुनें। वर्तमान free flow पहले 5 सेकंड रखता है।

3

Performance निर्देशित करें

Adaptive prompt रखें या expression, body movement और background लिखें, फिर steps चुनें।

सिर्फ lip-sync नहीं

OmniAvatar face, body और scene को साथ condition करता है—presenter, podcast, singing और character performance के लिए।

ऑडियो-सिंक भाषण

Wav2Vec conditioning mouth movement और expression को voice से मिलाती है।

Adaptive body animation

स्थिर talking head के बजाय gestures और body movement उत्पन्न हो सकते हैं।

Text-directed behavior

Prompt action, emotion, camera framing और background detail निर्देशित कर सकता है।

ऑडियो upload या record

Community UI audio files, browser microphone और cached voice examples लेता है।

ZeroGPU मुफ़्त है, असीमित नहीं

HF account tier के अनुसार GPU time मापता है और बचा quota queue priority बदलता है। xlarge की लागत large से 2× है।

खातादैनिक GPUQueue priority
Anonymous2 minकम
HF Free5 minमध्यम
HF PRO40 minसर्वोच्च

Public demo 5 सेकंड क्यों रखता है

वर्तमान inference function ऑडियो को पहले 5 सेकंड तक काटता है ताकि 14B job shared ZeroGPU में फिट हो।

वर्तमान alexnasa code 96GB xlarge GPU माँगता है। default 4 steps और 2× multiplier anonymous daily allowance से अधिक हो सकते हैं। यह live code से अनुमान है।

मॉडल वास्तव में Hugging Face shared GPU पर चलता है

Commercial API proxy के विपरीत ये Spaces open OmniAvatar stack load करते हैं और inference के समय ZeroGPU माँगते हैं।

आपका browser

Public HF Space

ZeroGPU

Avatar MP4

Public Gradio API

Public Gradio Space API देता है, पर OmniAvatar में preprocessing और state हैं। /predict hard-code करने की बजाय view_api() से live schema लें।

Client.connect("alexnasa/OmniAvatar")

वर्तमान event infer_scene पर आधारित है और image, audio, prompt, orientation, steps व session state लेता है। इसे experimental मानें।

Production और self-hosting

Official 14B/1.3B weights और code Apache-2.0 हैं, पर 14B का HF Inference Provider नहीं है। स्थिर product को अपना deployment चाहिए।

14B 1.3B Apache-2.0 480p

OmniAvatar डेमो FAQ

क्या OmniAvatar demo मुफ़्त है?

Public ZeroGPU HF quota में मुफ़्त है। नया 14B generation महँगा है, इसलिए anonymous quota कम पड़ सकता है और queue लंबी हो सकती है।

क्या बिना login generate कर सकता हूँ?

Space बिना login खुलता है। Generation anonymous quota और requested duration पर निर्भर है; अधिक quota के लिए login माँगा जा सकता है।

क्या लंबा audio upload कर सकता हूँ?

लंबी file चुनी जा सकती है, पर current public inference fresh generation में पहले 5 seconds ही process करता है।

क्या यह free production API है?

Public API experiments के लिए है। Space status, queue, code और quota बदल सकते हैं; production uptime तय नहीं है।

Image और voice कहाँ process होते हैं?

वे Wan2.Video से बाहर चुने हुए third-party HF Space पर process होते हैं। केवल अधिकृत material उपयोग करें।