무료 오디오 기반 아바타 영상

OmniAvatar 무료 온라인 데모

캐릭터 이미지 한 장과 짧은 음성을 결합해 입 모양, 표정, 몸동작이 동기화된 말하는 아바타를 공개 Hugging Face ZeroGPU에서 생성합니다.

실제 ZeroGPU 이미지 + 오디오 5초 데모 프롬프트 제어
아바타 만들기

OmniAvatar 공식 쇼케이스

오디오는 말하기를, 프롬프트는 행동·감정·장면을 제어합니다.

말하는 아바타 바로 만들기

추천 Space를 먼저 사용하고 불가능하면 백업으로 수동 전환하세요. ZeroGPU는 절전, 기동, 대기, 상태 변경이 발생합니다.

데모 상태 확인 중…

alexnasa · OmniAvatar

ZeroGPU 구성 확인: 2026년 8월 26일

ZeroGPU · 동적
OmniAvatar Space를 깨우거나 불러오는 중…

인물, 목소리, 연기 지시

세 가지 입력으로 짧은 아바타 연기를 만듭니다. 선명한 참조와 간결한 지시가 좋습니다.

1

인물 이미지 선택

선명한 캐릭터 이미지를 올리면 Space가 선택한 방향에 맞게 전처리합니다.

2

짧은 음성 추가

오디오 업로드, 마이크 녹음 또는 샘플을 사용하세요. 현재 무료 흐름은 앞 5초만 유지합니다.

3

연기 지시

적응형 프롬프트를 쓰거나 표정, 몸동작, 배경을 설명하고 단계 수를 선택하세요.

단순 립싱크 이상

OmniAvatar는 얼굴, 몸, 주변 장면을 함께 조절해 발표자, 팟캐스트, 노래, 캐릭터 연기에 적합합니다.

음성 동기화 말하기

Wav2Vec 오디오 조건이 입 모양과 표정을 입력 음성에 맞춥니다.

적응형 몸 애니메이션

정적인 말하는 머리를 넘어 손짓과 몸동작을 생성할 수 있습니다.

텍스트 연출

프롬프트로 행동, 감정, 카메라 구도와 선택적 배경을 지시합니다.

오디오 업로드 또는 녹음

커뮤니티 UI는 오디오 파일, 브라우저 마이크 녹음과 캐시 예제를 지원합니다.

ZeroGPU는 무료지만 무제한이 아닙니다

HF는 계정 등급별 공유 GPU 시간을 측정하고 잔여량이 대기 우선순위에 영향을 줍니다. xlarge는 large의 2배입니다.

계정일일 GPU 한도대기 우선순위
익명2 min낮음
HF Free5 min중간
HF PRO40 min최고

공개 데모가 5초만 처리하는 이유

현재 추론 함수는 음성을 앞 5초로 잘라 14B 아바타 작업을 공유 ZeroGPU 용량에 맞춥니다.

alexnasa 현재 코드는 96GB xlarge GPU를 요청합니다. 기본 4단계 예약 추정과 2배 계수로 익명 일일 한도를 넘을 수 있습니다. 실시간 코드 기반 추정입니다.

모델이 실제 Hugging Face 공유 GPU에서 실행됩니다

상용 API 중계 데모와 달리 이 Space들은 오픈 OmniAvatar 스택을 로드하고 추론 함수에서만 ZeroGPU를 요청합니다.

내 브라우저

공개 HF Space

ZeroGPU

아바타 MP4

공개 Gradio API

공개 Gradio Space는 API를 제공하지만 OmniAvatar는 전처리와 상태가 있습니다. /predict를 고정하지 말고 view_api()로 현재 정의를 확인하세요.

Client.connect("alexnasa/OmniAvatar")

현재 생성 이벤트는 infer_scene 기반이며 이미지, 오디오, 프롬프트, 방향, 단계, 세션 상태를 받습니다. 실험용으로 취급하세요.

운영 및 자체 호스팅

공식 14B·1.3B 가중치와 코드는 Apache-2.0이지만 14B를 제공하는 HF Inference Provider는 없습니다. 안정적 제품은 자체 배포가 필요합니다.

14B 1.3B Apache-2.0 480p

OmniAvatar 데모 FAQ

OmniAvatar 데모는 무료인가요?

공개 ZeroGPU는 HF 한도 내에서 무료입니다. 14B 새 생성은 비싸서 익명 한도가 부족하거나 대기가 길 수 있습니다.

로그인 없이 생성할 수 있나요?

Space는 로그인 없이 열립니다. 생성은 익명 잔여량과 요청 시간에 따라 달라지며 추가 한도를 위해 로그인을 요구할 수 있습니다.

긴 오디오를 올릴 수 있나요?

긴 파일을 선택할 수 있지만 현재 공개 추론은 새 생성에서 앞 5초만 처리합니다.

무료 운영 API로 사용할 수 있나요?

공개 API는 실험용입니다. Space 상태, 대기열, 코드, 일일 한도가 바뀌므로 운영 가용성을 보장하지 않습니다.

이미지와 음성은 어디서 처리되나요?

Wan2.Video를 벗어나 선택한 제3자 HF Space에서 처리됩니다. 권한 있는 자료만 사용하세요.