فيديو أفاتار مجاني مدفوع بالصوت

تجربة OmniAvatar المجانية

ادمج صورة شخصية وصوتًا قصيرًا لإنشاء أفاتار ناطق تتزامن شفتاه وتعابيره وحركة جسمه عبر Hugging Face ZeroGPU العام.

ZeroGPU حقيقي صورة + صوت تجربة 5 ثوانٍ تحكم بالنص
أنشئ أفاتار

عرض OmniAvatar الرسمي

يتحكم الصوت بالكلام ويوجّه النص السلوك والعاطفة والمشهد.

أنشئ أفاتار ناطقًا الآن

استخدم Space الموصى به أولًا أو انتقل يدويًا إلى البديل. قد ينام ZeroGPU أو يستيقظ أو يصطف أو يغيّر حالته.

جارٍ التحقق من توفر العرض…

alexnasa · OmniAvatar

تم التحقق من إعداد ZeroGPU في 26 أغسطس 2026

ZeroGPU · متغير
جارٍ إيقاظ أو تحميل OmniAvatar Space…

صورة وصوت وتوجيه

ثلاثة مدخلات بسيطة تتحول إلى أداء قصير. تعمل المراجع الواضحة والنصوص الموجزة أفضل.

1

اختر صورة

ارفع صورة واضحة وتعالجها المساحة لتناسب الاتجاه المختار.

2

أضف صوتًا قصيرًا

ارفع الصوت أو سجّل بالميكروفون أو استخدم عينة. يحتفظ المسار الحالي بأول 5 ثوانٍ.

3

وجّه الأداء

استخدم النص التكيفي أو صف التعبير والحركة والخلفية ثم اختر الخطوات.

أكثر من مزامنة الشفاه

يضبط OmniAvatar الوجه والجسم والمشهد معًا لمقدمين وبودكاست وغناء وأداء شخصيات.

كلام متزامن مع الصوت

تربط شروط Wav2Vec حركة الفم والتعبير بالصوت.

حركة جسم تكيفية

يمكن للشخصية الإيماء وتحريك جسمها بدل رأس ناطق ثابت.

أداء موجّه بالنص

يوجّه النص الحركة والعاطفة والكاميرا وتفاصيل الخلفية.

رفع أو تسجيل الصوت

تقبل الواجهة ملفات الصوت وتسجيل الميكروفون وأمثلة مخزنة.

ZeroGPU مجاني وليس بلا حدود

يقيس HF وقت GPU حسب الحساب، وتؤثر الحصة المتبقية في الطابور؛ xlarge يكلف ضعف large.

الحسابGPU اليوميالأولوية
مجهول2 minمنخفضة
HF Free5 minمتوسطة
HF PRO40 minالأعلى

لماذا تقتصر التجربة على خمس ثوانٍ

تقص الدالة الحالية الصوت إلى أول 5 ثوانٍ لتناسب مهمة 14B سعة ZeroGPU المشتركة.

يطلب كود alexnasa الحالي GPU xlarge بسعة 96GB. قد تتجاوز 4 خطوات ومعامل 2× الحصة اليومية للمجهول. هذا تقدير من الكود الحي.

يعمل النموذج فعلًا على GPU مشترك من Hugging Face

بدل تمرير الطلب إلى API تجارية، تحمّل المساحات OmniAvatar المفتوح وتطلب ZeroGPU وقت الاستدلال.

متصفحك

HF Space عام

ZeroGPU

أفاتار MP4

واجهة Gradio عامة

تعرض مساحات Gradio العامة API لكن OmniAvatar لديه معالجة وحالة. اقرأ view_api() بدل تثبيت /predict.

Client.connect("alexnasa/OmniAvatar")

يعتمد الحدث الحالي على infer_scene ويستقبل الصورة والصوت والنص والاتجاه والخطوات والجلسة. اعتبره تجريبيًا.

الإنتاج والاستضافة الذاتية

الأوزان 14B/1.3B والكود Apache-2.0، لكن لا يستضيف HF Inference Provider نموذج 14B. المنتج المستقر يحتاج نشرًا خاصًا.

14B 1.3B Apache-2.0 480p

أسئلة تجربة OmniAvatar

هل تجربة OmniAvatar مجانية؟

ZeroGPU العام مجاني ضمن حصة HF. توليد 14B مكلف وقد لا تكفي الحصة المجهولة وقد يطول الطابور.

هل يمكن التوليد دون دخول؟

يمكن فتح Space دون دخول. التوليد يعتمد على الحصة والمدة وقد يطلب HF تسجيل الدخول لمزيد من الحصة.

هل يمكن رفع صوت طويل؟

يمكن اختيار ملف أطول لكن الاستدلال العام الحالي يعالج أول خمس ثوانٍ فقط.

هل أستخدمه API إنتاج مجانية؟

الواجهة العامة للتجارب. تتغير الحالة والطابور والكود والحصة ولا يوجد التزام تشغيل.

أين تعالج الصورة والصوت؟

تغادر Wan2.Video وتعالجها مساحة HF خارجية مختارة. استخدم مواد مصرحًا بها فقط.