콘텐츠로 건너뛰기

Eleven v3 (알파) 출시

게시일

듣기이 글 오디오로 듣기

Eleven v3 is no longer in alpha, and is now generally available.


Eleven v3(alpha)를 가장 뛰어난 표현력을 갖춘 텍스트 음성 변환 모델로 선보이게 되어 기쁩니다.

이번 연구 프리뷰에서는 다음 기능으로 음성 생성에 전례 없는 수준의 제어력과 사실감을 제공합니다.

  • 70개 이상의 언어
  • 다화자 대화
  • 오디오 태그 — [excited], [whispers], [sighs] 등

Eleven v3(alpha)는 이전 모델보다 더 많은 프롬프트 엔지니어링이 필요하지만, 생성 결과는 놀라울 만큼 뛰어납니다.

비디오, 오디오북, 미디어 도구를 제작한다면 한층 더 풍부한 표현력을 구현할 수 있습니다. 실시간 및 대화형 사용 사례에는 현재로서는 v2.5 Turbo 또는 Flash를 계속 사용하는 것을 권장합니다. v3의 실시간 버전은 현재 개발 중입니다.

Eleven v3는 오늘부터 웹사이트와 API에서 사용할 수 있습니다.

v3를 만든 이유

Multilingual v2를 출시한 이후, 전문 영화 제작, 게임 개발, 교육, 접근성 분야에서 음성 AI가 활용되는 모습을 확인했습니다. 하지만 꾸준히 남아 있던 한계는 음질이 아니라 표현력이었습니다. 더욱 과장된 감정, 대화 중 끼어들기, 자연스러운 주고받기를 구현하기는 어려웠습니다.

Eleven v3는 이 간극을 해소합니다. 한숨 쉬고, 속삭이고, 웃고, 반응하는 목소리를 제공하도록 처음부터 설계되어, 진정으로 반응하며 살아 있는 듯한 음성을 만들어 냅니다.

Eleven v3(alpha)의 새로운 기능

Feature What it unlocks
Audio tags Inline control of tone, emotion, and non-verbal reactions
Dialogue mode Multi-speaker conversations with natural pacing and interruptions
70+ languages Full coverage of high-demand global languages
Deeper text understanding Better stress, cadence, and expressivity from text input

직접 들어보는 v3

Background
Background

오디오 태그 사용하기

오디오 태그는 스크립트 안에 직접 넣으며, 소문자 대괄호 형식으로 작성합니다. 오디오 태그에 대한 자세한 내용은 문서의 v3 프롬프팅 가이드에서 확인할 수 있습니다.

프로페셔널 음성 복제(PVC)는 현재 Eleven v3에 완전히 최적화되지 않아 이전 모델보다 복제 품질이 낮을 수 있습니다. 이번 연구 프리뷰 단계에서 v3 기능을 사용해야 한다면 프로젝트에 맞는 Instant 음성 복제(IVC) 또는 디자인된 음성을 찾는 것이 좋습니다. v3용 PVC 최적화는 가까운 시일 내에 제공될 예정입니다.

예를 들어, 다음과 같이 프롬프트를 입력할 수 있습니다. “[whispers] 뭔가 오고 있어… [sighs] 느껴져.” 더 풍부하게 제어하려면 여러 태그를 조합할 수도 있습니다.

“[happily][shouts] We did it! [laughs].”

다화자 대화 만들기

Eleven v3는 기존 텍스트 음성 변환 엔드포인트에서 지원됩니다. 또한 새로운 텍스트 투 다이얼로그 API 엔드포인트를 선보입니다. 각 화자의 발화를 나타내는 구조화된 JSON 객체 배열을 제공하면, 모델이 자연스럽게 겹치는 하나의 일관된 오디오 파일을 생성합니다.

[
  {"speaker_id": "scarlett", "text": "(cheerfully) Perfect! And if that pop-up is bothering you, there’s a setting to turn it off under Notifications → Preferences."},
  {"speaker_id": "lex", "text": "You are a hero. An actual digital wizard. I was two seconds from sending a very passive-aggressive support email."},
  {"speaker_id": "scarlett", "text": "(laughs) Glad we could stop that in time. Anything else I can help with today?"}
]

이 엔드포인트는 화자 전환, 감정 변화, 끼어들기를 자동으로 처리합니다.

자세한 내용은 여기에서 확인하세요.

v3는 가장 뛰어난 표현력을 갖춘 모델입니다

Background
Background

가격 및 이용 가능 여부

Plan Launch promo At the end of June
UI (self-serve) 80% off (~5× cheaper) Same as Multilingual V2
UI (enterprise) 80% off business plan pricing Business plan pricing

v3를 활성화하려면 다음을 따르세요.

  • 모델 선택기에서 Eleven v3(alpha)

를 선택하세요. API 액세스와 Studio 지원은 곧 제공됩니다. 얼리 액세스를 원하시면 영업팀에 문의하세요.

v3를 사용하지 말아야 할 경우

Eleven v3(alpha)는 이전 모델보다 더 많은 프롬프트 엔지니어링이 필요합니다. 제대로 작동할 때 결과물은 놀랍지만, 안정성과 높은 지연 시간으로 인해 실시간 및 대화형 사용 사례에는 적합하지 않습니다. 이러한 경우에는 Eleven v2.5 Turbo/Flash를 권장합니다.

자세한 내용은 전체 v3 문서 및 FAQ를 참조하세요.

지금 사용해 보세요

Background
Background
  1. ElevenLabs UI에 로그인
  2. 모델 드롭다운에서 v3(alpha)를 선택
  3. 스크립트를 붙여넣고 태그 또는 대화를 사용하세요 
  4. 오디오 생성

몰입감 있는 스토리텔링부터 영화 같은 제작 파이프라인까지, 새로운 사용 사례에서 v3를 어떻게 활용할지 기대됩니다.

최고 품질의 AI 오디오로 창작하세요