Voice Clone
Voice Clone에서 텍스트를 입력하고 선명한 3–10초 참조 음성을 업로드하거나 녹음하세요. 선택적으로 전사를 추가한 뒤 24 kHz 음성을 생성하고 다운로드하세요.
OmniVoice · k2-fsa
k2-fsa의 OmniVoice로 텍스트를 음성으로 변환하세요. 646개 언어를 지원하는 공식 데모에서 제로샷 음성 복제와 음성 디자인을 체험할 수 있습니다.
데모 불러오는 중…
공개 ZeroGPU 데모에는 공유 GPU 할당량과 대기열이 있습니다. 로그인하거나 할당량이 회복될 때까지 기다려야 할 수 있습니다. Wan2.Video는 이 페이지 이용료를 받지 않습니다.
Voice Clone에서 텍스트를 입력하고 선명한 3–10초 참조 음성을 업로드하거나 녹음하세요. 선택적으로 전사를 추가한 뒤 24 kHz 음성을 생성하고 다운로드하세요.
Voice Design에서는 참조 녹음 없이 성별, 나이, 음높이, 억양이나 방언, 속삭임 속성을 조합해 목소리를 만듭니다. 중국어와 영어에서 더 안정적으로 작동합니다.
[laughter], [sigh] 태그로 웃음과 한숨을 추가하세요. 중국어는 성조 숫자가 있는 병음, 영어는 대괄호 안의 CMU 음소로 발음을 교정할 수 있습니다.
모델은 약 0.6B 매개변수입니다. 개발팀은 최저 RTF 0.025(실시간 대비 약 40배)를 보고했습니다. 공개 데모 속도는 대기열과 하드웨어에 따라 달라집니다.
공개 ZeroGPU 데모에는 공유 GPU 할당량과 대기열이 있습니다. 로그인하거나 할당량이 회복될 때까지 기다려야 할 수 있습니다. Wan2.Video는 이 페이지 이용료를 받지 않습니다.
선택한 Hugging Face Space가 입력을 받으며 운영자가 처리와 보관을 관리합니다. 이 안내는 번역되지만 데모 내부 언어는 운영자가 제공합니다.
새로고침하거나 사용 가능한 예비 서버를 선택하세요. GPU 할당량을 소진했다면 복구를 기다리거나 관련 도구를 사용하세요.