목소리
목소리
ElevenLabs로 목소리를 만들고, 사용자 지정하고, 관리하는 방법을 알아보세요.
개요
ElevenLabs는 목소리 생성 및 사용자 지정을 위한 모델을 제공합니다. 플랫폼은 방대한 보이스 라이브러리의 목소리, 음성 복제, 텍스트 프롬프트로 생성한 목소리 등 다양한 목소리 옵션을 지원합니다.
목소리 유형
- 커뮤니티: ElevenLabs 보이스 라이브러리에서 커뮤니티가 공유한 목소리입니다.
- 복제: 즉석 음성 복제 또는 프로페셔널 음성 복제로 만든 사용자 지정 목소리입니다.
- 보이스 디자인: 보이스 디자인 도구로 만든 생성 목소리입니다.
기본 목소리는 앞으로 영구적으로 사용할 수 있는 새 목소리로 대체됩니다. 모든 기본 목소리는 2026년 12월 31일에 만료되며, 이 날짜 이후에는 더 이상 사용할 수 없습니다.
커뮤니티
보이스 라이브러리에는 ElevenLabs 커뮤니티가 공유한 10,000개 이상의 목소리가 있습니다. 다음 작업에 활용하세요.
- ElevenLabs 커뮤니티가 공유한 고유한 목소리 탐색
- 개인 컬렉션에 목소리 추가
- 다른 유료 구독자가 사용할 때 현금 보상을 받을 수 있도록 자신의 음성 복제 공유
커뮤니티와 목소리를 공유하고 조건을 설정한 뒤, 다른 사용자가 이용할 때 현금 보상을 받으세요. 지금까지 $14M 이상을 지급했습니다.
복제
짧은 오디오 샘플로 즉석 음성 복제를 통해 자신의 목소리를 복제하거나, 프로페셔널 음성 복제로 사실적인 목소리를 만들 수 있습니다.
- 즉석 음성 복제: 짧은 오디오 샘플로 빠르게 목소리를 복제합니다.
- 프로페셔널 음성 복제: 더 긴 학습 오디오로 전문가 수준의 음성 복제를 생성합니다.
프로페셔널 음성 복제가 자신의 목소리 샘플로 만들어졌는지 확인하기 위해 음성 캡차 기술을 사용합니다.
보이스 디자인
보이스 디자인을 사용하면 나이, 성별, 억양, 톤 등의 속성을 지정해 완전히 새로운 목소리를 만들 수 있습니다. 생성 목소리는 다음과 같은 용도에 적합합니다.
- 뉘앙스 있는 특성을 갖춘 사실적인 목소리
- 게임과 스토리텔링을 위한 창의적인 캐릭터 목소리
보이스 디자인은 목소리 미리 보기 3개를 생성합니다. 다음만 제공하면 됩니다.
- 20~1000자의 목소리 설명
- 100~1000자의 목소리 미리 보기용 선택적 텍스트
Eleven v4를 사용한 보이스 디자인
Eleven v4가 사용할 모델입니다. 보이스 디자인 목소리는 이 모델에서 작동하지만, 이전 모델보다 표현력이 낮을 수 있습니다. Eleven v3도 폭넓은 감정 범위를 아우르는 목소리를 디자인할 수 있습니다.
이 모델을 사용하면 다음과 같은 이점이 있습니다.
- 더 자연스럽고 다재다능한 목소리 생성
- 목소리 특성을 더 효과적으로 제어
- 미리 보기 생성에서 오디오 태그 지원
- v2 모델과의 하위 호환성
보이스 리믹싱
보이스 리믹싱을 사용하면 알아볼 수 있는 특성을 유지하면서 핵심 속성을 수정해 소유한 목소리를 변환할 수 있습니다. 자연어 프롬프트를 통해 성별, 억양, 말하기 스타일, 속도 및 오디오 품질을 조정할 수 있습니다. 이 기능은 다양한 상황에 맞춰 목소리를 조정하거나, 캐릭터 변형을 만들거나, 기존 목소리 프로필의 오디오 품질을 개선할 때 특히 유용합니다. 보이스 리믹싱은 직접 소유한 모든 복제 목소리(즉석 음성 복제 또는 프로페셔널 음성 복제) 또는 보이스 디자인으로 만든 목소리에서 작동합니다.
목소리 관리
모든 목소리는 내 목소리에서 관리할 수 있으며, 다음과 같은 작업을 수행할 수 있습니다.
- 목소리 검색, 필터링 및 분류
- 설명과 사용자 지정 태그 추가
- 빠르게 액세스할 수 있도록 목소리 정리
내 목소리 문서에서 목소리 컬렉션 관리 방법을 알아보세요.
- 검색 및 필터: 키워드 또는 태그로 목소리를 찾습니다.
- 샘플 미리 보기: 사용 전에 목소리 데모를 들어봅니다.
- 컬렉션에 추가: 프로젝트에서 쉽게 사용할 수 있도록 목소리를 저장합니다.
팁: “Australian narration”과 같이 특정 억양이나 장르로 검색해 보세요.
지원 언어
모든 ElevenLabs 목소리는 여러 언어를 지원합니다. ElevenLabs는 32개 언어로 목소리 생성을 지원합니다. 가장 자연스러운 결과를 위해 대상 지역에 맞는 목소리를 선택하세요.
- 생성 및 복제 목소리: 억양 충실도는 입력 샘플 또는 선택한 속성에 따라 달라집니다.
다국어 v2 모델은 29개 언어를 지원합니다.
영어(미국, 영국, 호주, 캐나다), 일본어, 중국어, 독일어, 힌디어, 프랑스어(프랑스, 캐나다), 한국어, 포르투갈어(브라질, 포르투갈), 이탈리아어, 스페인어(스페인, 멕시코), 인도네시아어, 네덜란드어, 터키어, 필리핀어, 폴란드어, 스웨덴어, 불가리아어, 루마니아어, 아랍어(사우디아라비아, UAE), 체코어, 그리스어, 핀란드어, 크로아티아어, 말레이어, 슬로바키아어, 덴마크어, 타밀어, 우크라이나어 및 러시아어.
Flash v2.5는 v2 모델의 모든 언어와 다음 언어를 포함해 32개 언어를 지원합니다.
헝가리어, 노르웨이어 및 베트남어
주요 정보
- 즉석 음성 복제: 짧은 오디오 샘플(2분 미만)로 생성되며 대부분의 요금제에서 사용할 수 있습니다.
- 프로페셔널 음성 복제: 최고의 충실도를 위해 긴 학습 오디오가 필요하며 크리에이터 이상의 요금제가 필요합니다.
- 목소리 공유: 프로페셔널 음성 복제는 보이스 라이브러리에 공개적으로 공유할 수 있지만, 즉석 음성 복제와 생성 목소리는 공유할 수 없습니다.
- 생성 목소리: 보이스 디자인을 통해 텍스트 설명으로 생성되며, 게임, 애니메이션 및 창의적인 스토리텔링의 고유한 캐릭터에 적합합니다.