인물 이미지 선택
선명한 캐릭터 이미지를 올리면 Space가 선택한 방향에 맞게 전처리합니다.
무료 오디오 기반 아바타 영상
캐릭터 이미지 한 장과 짧은 음성을 결합해 입 모양, 표정, 몸동작이 동기화된 말하는 아바타를 공개 Hugging Face ZeroGPU에서 생성합니다.
OmniAvatar 공식 쇼케이스
오디오는 말하기를, 프롬프트는 행동·감정·장면을 제어합니다.
추천 Space를 먼저 사용하고 불가능하면 백업으로 수동 전환하세요. ZeroGPU는 절전, 기동, 대기, 상태 변경이 발생합니다.
데모 상태 확인 중…
alexnasa · OmniAvatar
ZeroGPU 구성 확인: 2026년 8월 26일
세 가지 입력으로 짧은 아바타 연기를 만듭니다. 선명한 참조와 간결한 지시가 좋습니다.
선명한 캐릭터 이미지를 올리면 Space가 선택한 방향에 맞게 전처리합니다.
오디오 업로드, 마이크 녹음 또는 샘플을 사용하세요. 현재 무료 흐름은 앞 5초만 유지합니다.
적응형 프롬프트를 쓰거나 표정, 몸동작, 배경을 설명하고 단계 수를 선택하세요.
OmniAvatar는 얼굴, 몸, 주변 장면을 함께 조절해 발표자, 팟캐스트, 노래, 캐릭터 연기에 적합합니다.
Wav2Vec 오디오 조건이 입 모양과 표정을 입력 음성에 맞춥니다.
정적인 말하는 머리를 넘어 손짓과 몸동작을 생성할 수 있습니다.
프롬프트로 행동, 감정, 카메라 구도와 선택적 배경을 지시합니다.
커뮤니티 UI는 오디오 파일, 브라우저 마이크 녹음과 캐시 예제를 지원합니다.
HF는 계정 등급별 공유 GPU 시간을 측정하고 잔여량이 대기 우선순위에 영향을 줍니다. xlarge는 large의 2배입니다.
| 계정 | 일일 GPU 한도 | 대기 우선순위 |
|---|---|---|
| 익명 | 2 min | 낮음 |
| HF Free | 5 min | 중간 |
| HF PRO | 40 min | 최고 |
현재 추론 함수는 음성을 앞 5초로 잘라 14B 아바타 작업을 공유 ZeroGPU 용량에 맞춥니다.
alexnasa 현재 코드는 96GB xlarge GPU를 요청합니다. 기본 4단계 예약 추정과 2배 계수로 익명 일일 한도를 넘을 수 있습니다. 실시간 코드 기반 추정입니다.
상용 API 중계 데모와 달리 이 Space들은 오픈 OmniAvatar 스택을 로드하고 추론 함수에서만 ZeroGPU를 요청합니다.
내 브라우저
공개 HF Space
ZeroGPU
아바타 MP4
공개 Gradio Space는 API를 제공하지만 OmniAvatar는 전처리와 상태가 있습니다. /predict를 고정하지 말고 view_api()로 현재 정의를 확인하세요.
Client.connect("alexnasa/OmniAvatar") 현재 생성 이벤트는 infer_scene 기반이며 이미지, 오디오, 프롬프트, 방향, 단계, 세션 상태를 받습니다. 실험용으로 취급하세요.
공식 14B·1.3B 가중치와 코드는 Apache-2.0이지만 14B를 제공하는 HF Inference Provider는 없습니다. 안정적 제품은 자체 배포가 필요합니다.
공개 ZeroGPU는 HF 한도 내에서 무료입니다. 14B 새 생성은 비싸서 익명 한도가 부족하거나 대기가 길 수 있습니다.
Space는 로그인 없이 열립니다. 생성은 익명 잔여량과 요청 시간에 따라 달라지며 추가 한도를 위해 로그인을 요구할 수 있습니다.
긴 파일을 선택할 수 있지만 현재 공개 추론은 새 생성에서 앞 5초만 처리합니다.
공개 API는 실험용입니다. Space 상태, 대기열, 코드, 일일 한도가 바뀌므로 운영 가용성을 보장하지 않습니다.
Wan2.Video를 벗어나 선택한 제3자 HF Space에서 처리됩니다. 권한 있는 자료만 사용하세요.
Wan2.Video에서 모션 전송, 사운드 생성과 다른 캐릭터 영상 도구를 탐색하세요.