Choisissez un portrait
Importez une image nette ; le Space la prépare pour l'orientation choisie.
Avatar vidéo gratuit piloté par audio
Combinez une image et une voix courte pour créer un avatar parlant aux lèvres, expressions et mouvements synchronisés sur ZeroGPU public.
Présentation officielle OmniAvatar
L'audio contrôle la parole ; le prompt guide comportement, émotion et scène.
Utilisez d'abord le Space recommandé ou changez manuellement. ZeroGPU peut dormir, redémarrer, mettre en file ou changer d'état.
Vérification de la disponibilité…
alexnasa · OmniAvatar
Configuration ZeroGPU vérifiée le 26 août 2026
Trois entrées simples deviennent une courte performance. Références claires et prompts concis fonctionnent mieux.
Importez une image nette ; le Space la prépare pour l'orientation choisie.
Importez, enregistrez au micro ou utilisez un exemple. Le flux actuel conserve les 5 premières secondes.
Gardez le prompt adaptatif ou décrivez expression, corps et fond, puis choisissez les étapes.
OmniAvatar conditionne visage, corps et scène pour présentateurs, podcasts, chant et personnages.
Le conditionnement Wav2Vec aligne bouche et expression sur la voix.
Le personnage peut gesticuler et bouger, au-delà d'une tête parlante statique.
Le prompt guide action, émotion, cadrage et détails de fond.
L'UI accepte fichiers, micro du navigateur et exemples vocaux en cache.
HF mesure le temps par compte ; le solde influence la file et xlarge coûte deux fois large.
| Compte | GPU quotidien | Priorité |
|---|---|---|
| Anonyme | 2 min | Basse |
| HF Free | 5 min | Moyenne |
| HF PRO | 40 min | Maximale |
La fonction actuelle coupe l'audio à 5 secondes pour adapter le travail 14B à la capacité ZeroGPU partagée.
Le code alexnasa actuel demande un GPU xlarge de 96 Go. Quatre étapes et le facteur 2× peuvent dépasser le quota anonyme. Estimation du code en ligne.
Au lieu d'appeler une API commerciale, les Spaces chargent OmniAvatar ouvert et demandent ZeroGPU pendant l'inférence.
Votre navigateur
Space HF public
ZeroGPU
Avatar MP4
Les Spaces publics exposent une API, mais OmniAvatar a prétraitement et état. Lisez view_api() au lieu de fixer /predict.
Client.connect("alexnasa/OmniAvatar") L'événement actuel repose sur infer_scene et reçoit image, audio, prompt, orientation, étapes et session. Considérez-le expérimental.
Poids 14B/1.3B et code sont Apache-2.0, mais aucun HF Inference Provider n'héberge 14B. Un produit stable requiert son propre déploiement.
ZeroGPU public est gratuit dans le quota HF. Une génération 14B coûte cher ; le quota anonyme peut manquer et la file être longue.
Le Space s'ouvre sans compte. Générer dépend du quota et de la durée ; HF peut demander une connexion pour plus de quota.
Un fichier plus long peut être choisi, mais l'inférence publique actuelle ne traite que les cinq premières secondes.
L'API publique sert aux essais. État, file, code et quota changent ; aucun engagement de disponibilité.
Elles quittent Wan2.Video et sont traitées par le Space tiers choisi. Utilisez uniquement du contenu autorisé.
Explorez transfert de mouvement, génération sonore et autres outils sur Wan2.Video.
Transférez un mouvement ou remplacez un personnage par vidéo.
ExplorerDécouvrez la génération sonore synchronisée.
ExplorerCréez audio et vidéo synchronisés via des Spaces publics.
ExplorerTestez le remplacement de visage dans le navigateur.
Explorer