Portrait चुनें
स्पष्ट character image अपलोड करें; Space orientation के अनुसार preprocess करता है।
मुफ़्त ऑडियो-ड्रिवन अवतार वीडियो
एक कैरेक्टर इमेज और छोटी आवाज़ से होंठ, भाव और शरीर की गति वाला बोलता अवतार बनाएँ—सार्वजनिक Hugging Face ZeroGPU पर।
आधिकारिक OmniAvatar प्रदर्शन
ऑडियो भाषण और prompt व्यवहार, भावना व दृश्य को नियंत्रित करता है।
पहले सुझाया Space उपयोग करें या जरूरत पर बैकअप चुनें। ZeroGPU सो सकता, जाग सकता, कतार लगा सकता या स्थिति बदल सकता है।
alexnasa · OmniAvatar
ZeroGPU configuration जाँच: 26 अगस्त 2026
तीन inputs से छोटा avatar performance बनता है। स्पष्ट reference और छोटा prompt बेहतर है।
स्पष्ट character image अपलोड करें; Space orientation के अनुसार preprocess करता है।
ऑडियो upload, microphone record या sample चुनें। वर्तमान free flow पहले 5 सेकंड रखता है।
Adaptive prompt रखें या expression, body movement और background लिखें, फिर steps चुनें।
OmniAvatar face, body और scene को साथ condition करता है—presenter, podcast, singing और character performance के लिए।
Wav2Vec conditioning mouth movement और expression को voice से मिलाती है।
स्थिर talking head के बजाय gestures और body movement उत्पन्न हो सकते हैं।
Prompt action, emotion, camera framing और background detail निर्देशित कर सकता है।
Community UI audio files, browser microphone और cached voice examples लेता है।
HF account tier के अनुसार GPU time मापता है और बचा quota queue priority बदलता है। xlarge की लागत large से 2× है।
| खाता | दैनिक GPU | Queue priority |
|---|---|---|
| Anonymous | 2 min | कम |
| HF Free | 5 min | मध्यम |
| HF PRO | 40 min | सर्वोच्च |
वर्तमान inference function ऑडियो को पहले 5 सेकंड तक काटता है ताकि 14B job shared ZeroGPU में फिट हो।
वर्तमान alexnasa code 96GB xlarge GPU माँगता है। default 4 steps और 2× multiplier anonymous daily allowance से अधिक हो सकते हैं। यह live code से अनुमान है।
Commercial API proxy के विपरीत ये Spaces open OmniAvatar stack load करते हैं और inference के समय ZeroGPU माँगते हैं।
आपका browser
Public HF Space
ZeroGPU
Avatar MP4
Public Gradio Space API देता है, पर OmniAvatar में preprocessing और state हैं। /predict hard-code करने की बजाय view_api() से live schema लें।
Client.connect("alexnasa/OmniAvatar") वर्तमान event infer_scene पर आधारित है और image, audio, prompt, orientation, steps व session state लेता है। इसे experimental मानें।
Official 14B/1.3B weights और code Apache-2.0 हैं, पर 14B का HF Inference Provider नहीं है। स्थिर product को अपना deployment चाहिए।
Public ZeroGPU HF quota में मुफ़्त है। नया 14B generation महँगा है, इसलिए anonymous quota कम पड़ सकता है और queue लंबी हो सकती है।
Space बिना login खुलता है। Generation anonymous quota और requested duration पर निर्भर है; अधिक quota के लिए login माँगा जा सकता है।
लंबी file चुनी जा सकती है, पर current public inference fresh generation में पहले 5 seconds ही process करता है।
Public API experiments के लिए है। Space status, queue, code और quota बदल सकते हैं; production uptime तय नहीं है।
वे Wan2.Video से बाहर चुने हुए third-party HF Space पर process होते हैं। केवल अधिकृत material उपयोग करें।
Wan2.Video पर motion transfer, sound generation और अन्य character-video tools देखें।