Eleven v4를 소개합니다역대 가장 감성적인 모델, Eleven v4를 만나보세요. 10월 12일까지 Creator+에 크레딧 3배 제공

콘텐츠로 건너뛰기

발음 사전 가이드: Eleven v4의 TTS에서 모든 단어 발음 수정하기

작성자
Jack Limebear
게시일
최종 업데이트

듣기이 글 오디오로 듣기

Eleven v4는 약어, 기술 용어, 이름, 혼합 언어 텍스트를 이전 어떤 모델보다 정확하게 처리하며 텍스트 음성 변환 모델의 발음 성능에 새로운 기준을 제시합니다. 하지만 모든 브랜드에는 고유한 제품명부터 업계별 전문 용어까지 자체 어휘가 있으므로, 이러한 단어가 어떻게 들리는지 완벽하게 제어하고 싶을 것입니다.

Eleven v4는 발음을 수정하는 다양한 방법을 제공하여 모델의 발화 방식을 세밀하게 제어할 수 있게 합니다. TTS 앱에서 작성하는 모든 스크립트에 적용되는 포괄적인 발음 사전을 만들 수 있습니다. 또는 일회성 수정을 위해 텍스트에 IPA를 직접 입력할 수도 있습니다.

다음은 까다로운 용어가 가득한 스크립트를 Eleven v4가 처리하는 간단한 예시입니다:

At 2:47 A.M., Siobhan Lester's phone lit up. The search service on the Kubernetes cluster was timing out. She read the pod logs and found the cause in Tuesday's release. A new fuzzy matching feature compared every query against the entire product catalog using Levenshtein distance, so each search took 1,400 milliseconds, well past the one-second limit. Her lead, a purist who quotes Dijkstra and Euler in code reviews, wanted to rewrite the matcher from scratch. Instead, she rolled back to Monday's build, and by 3:30 A.M., the rollback was live and response times were back under 50 milliseconds. The proper fix, an index that narrows each search to close matches, shipped in Thursday's release.
0:00

이 가이드에서는 TTS 발음 사전을 만들고 사용하는 방법과, 원하는 결과에 최대한 가깝게 오디오를 만들기 위해 활용할 수 있는 모든 관련 전략을 다룹니다.

요약

  • 발음 사전은 텍스트 음성 변환 모델에 특정 단어나 구절을 어떻게 발음할지 알려주기 위해 작성하는 규칙 모음입니다.
  • TTS 발음 규칙은 다른 텍스트로 바꾸는 별칭 기반 규칙 또는 음성 철자를 사용하는 음소 기반 규칙으로 나뉩니다.
  • Eleven v4는 음소 규칙과 인라인 IPA(국제 음성 기호)를 지원합니다.
  • SSML 음소 및 break 태그는 Eleven v4에서 작동하지 않지만, 발음 사전 또는 오디오 태그를 자연어 대안으로 사용할 수 있습니다.
  • ElevenAPI를 통해 요청당 최대 3개의 발음 사전을 적용할 수 있습니다.

발음 사전이란 무엇인가요?

발음 사전은 텍스트 음성 변환 모델이 특정 단어를 정확히 어떻게 말할지 설정할 수 있는 도구입니다. 발음 사전에 특정 단어나 구절을 추가하면 TTS 스크립트에 해당 표현이 나올 때마다 어떻게 들릴지 정의할 수 있습니다.

발음 사전은 일반적으로 다음과 같은 경우에 사용됩니다:

  • 브랜드명: 브랜드명은 특히 고유하거나 특이한 철자를 가진 경우 발음 사전에 자주 추가됩니다.
  • 두문자어: 일부 두문자어는 정해진 발음 방식이 있습니다. 예를 들어 AEO는 /ˌeɪ.iːˈoʊ/("A-E-O")로 발음해야 하며, /eɪˈjoʊ/("ay-yo")가 아닙니다. 고정된 사전 규칙을 사용하면 입력할 때마다 모델이 올바르게 발음하도록 할 수 있습니다.
  • 지명 및 기타 고유명사: 일부 지명은 철자를 보고 예상하는 발음과 실제 발음이 상당히 다를 수 있습니다. Worcestershire는 발음 가이드가 문제를 방지하는 데 도움이 되는 대표적인 예입니다.
  • 업계 용어: 예를 들어 의료 또는 법률 분야의 업계 전문 용어나 특수 용어는 모델이 해당 분야의 데이터로 명시적으로 학습하지 않은 경우 발음 사전의 도움을 받을 수 있습니다.

텍스트 음성 변환 외의 분야에서 발음 사전은 일반적으로 원어민의 오디오 클립을 크라우드소싱해 모은 저장소를 의미하며, 학습자는 이를 통해 특정 단어의 발음을 듣습니다.

Different uses of pronunciation dictionaries in TTS apps

Eleven v4에서 TTS 발음 제어하기

Eleven v4는 Artificial Analysis의 Provider Voice Arena에서 최고 품질의 텍스트 음성 변환 모델로 평가받았습니다.1 Eleven v4가 시장을 선도하는 이유 중 하나는 복잡한 텍스트도 처리하면서 자연스러운 출력 음성을 유지하는 모델의 역량입니다.

Eleven v4에서 최상의 경험을 제공하기 위해, 이 모델은 발음을 맞춤 설정하는 다양한 방법을 제공하여 모든 출력이 정확도 기준을 충족하도록 합니다.

Eleven v4에서 발음을 제어하는 방법은 다음과 같습니다:

  • 인라인 IPA: 발음 사전을 사용하지 않고도 스크립트에서 슬래시 사이에 IPA를 입력해 발음을 지정할 수 있습니다. 구체적인 방법은 잠시 후 살펴보겠습니다.
  • 사전의 음소 규칙: 발음 사전에 음소 기반 규칙을 작성하여 반복해서 나오는 단어의 음성적 소리를 제어하세요.
  • 언어 간 자연스러운 발음: Eleven v4는 90개 이상의 언어에서 자연스러운 음성을 생성할 수 있습니다. 일관된 사운드 브랜딩 경험을 위해 동일한 음성을 사용하면서 각 언어의 원어민 발음을 유지하세요.

다양한 ElevenLabs TTS 모델의 발음 제어 기능을 비교해 보세요:

모델

별칭 규칙(사전)

음소 규칙(사전)

인라인 IPA(/.../)

SSML 음소 태그(<phoneme>)

Eleven v4

예

예

예

아니요

Eleven v4 Turbo

예

예

예

아니요

Eleven v3

예

예

예

아니요

Eleven Flash v2

예

예

아니요

예(영어만)

Eleven Turbo v2

예

아니요

아니요

예(영어만)

Eleven Multilingual v2

예

아니요

아니요

아니요

Pronunciation dictionary guide on ElevenLabs across different models

발음 사전의 별칭 규칙과 음소 규칙은 무엇이 다른가요?

별칭 발음 규칙은 모델이 단어를 말하기 전에 한 텍스트를 다른 텍스트로 바꿉니다. 모델이 오디오를 생성할 때마다 백그라운드에서 이 작업이 이루어지며, 단어 또는 구절의 소리를 발음 사전에 포함한 내용으로 대체합니다.

별칭 발음 규칙의 예시는 다음과 같습니다:

  • “SaaS”는 “sass”가 됩니다
  • “UN”은 “United Nations”가 됩니다
  • “OAuth”는 “oh auth”가 됩니다

반면 음소 규칙은 모델이 사용할 정확한 음성 철자를 제공합니다. 직접 IPA 전사 표기를 작성하거나 생성하여 사전에 입력해야 하므로 만들기가 더 어렵습니다. 예를 들어 "Kubernetes"는 /ˌkuː.bərˈnɛt.iːz/가 됩니다.

TTS 모델에서 브랜드명 발음 수정하기

브랜드명은 항상 실제 단어인 것은 아니므로 발음 사전에 가장 흔히 추가되는 항목 중 하나입니다. 회사에서 새로운 단어를 만들었거나 브랜드에 독특한 철자를 사용한다면, 해당 발음을 포함한 접근 가능한 학습 데이터가 매우 적기 때문에 TTS 모델이 정확하게 발음하기 어려울 수 있습니다.

Eleven v4에서 브랜드명 발음을 수정하는 방법은 다음과 같습니다:

  1. 기본 음성 테스트: 텍스트 음성 변환 앱을 열고 브랜드명을 입력하세요. 클립을 생성하고 어떻게 들리는지 확인하세요. 발음 오류가 있다면 다음 단계로 진행해야 합니다.
  2. 별칭 규칙 사용: 브랜드 발음 오류를 수정하는 가장 쉬운 방법은 별칭 규칙을 만드는 것입니다. 빠르게 작성할 수 있고 직관적입니다.
  3. 음소 규칙으로 전환: 별칭 규칙이 제대로 작동하지 않으면 IPA를 사용하세요. IPA로 브랜드명을 전사한 다음 텍스트 음성 변환 발음 사전에 규칙을 만들어 발음을 수정하세요.
  4. 모든 대소문자 표기 포함: 브랜드명을 소문자와 대문자로 모두 사용한다면 두 버전 모두의 IPA 전사 표기를 반드시 포함하세요.
  5. 일회성 변경에는 인라인 IPA 사용: 일회성 생성에서 빠르게 수정하고 싶다면 사전 항목을 설정하는 대신 스크립트에 IPA를 직접 추가하면 됩니다.

브랜드명 규칙을 설정하면 앞으로 AI 에이전트 또는 API를 통해 액세스하는 모든 공유 프로젝트에서 사용할 수 있습니다.

ElevenLabs로 발음 사전 만들기

텍스트 음성 변환 앱에서 규칙을 추가하거나 .pls 파일을 업로드하거나 ElevenAPI를 통해 발음 사전을 만들 수 있습니다. 이 가이드에서는 몇 단계만으로 가능한 첫 번째 방법을 다룹니다.

Title slide: “How to create a pronunciation dictionary,” by ElevenLabs and ElevenCreative.

발음 사전을 만들려면 다음 단계를 따르세요:

  1. 발음 사전 패널 열기: 텍스트 음성 변환 페이지에서 상단 검색창을 클릭하고 "Pronunciation dictionary"를 입력한 다음 Actions 아래에서 Pronunciation dictionaries를 선택하세요.
  2. 사전 만들기 또는 선택: New를 클릭해 새 사전을 만들거나 왼쪽 목록에서 기존 사전을 선택하세요.
  3. 규칙 추가: Add rule을 클릭해 새 행을 만드세요. 수정하려는 단어를 입력하세요. 스크립트에 표시되는 그대로의 단어 또는 구절을 Input 필드에 입력하세요. 규칙은 대소문자를 구분하므로 사용하는 대소문자 표기와 일치해야 합니다.
  4. 규칙 유형 선택: 다른 텍스트로 바꾸려면 Alias를, IPA 또는 CMU 표기를 입력하려면 Phoneme을 선택하세요.
  5. 대체 항목 입력: Output 필드에 별칭 또는 음성 철자를 입력하세요. 패널 상단의 음성 선택기를 사용하면 작업 중인 음성으로 규칙을 들어볼 수 있습니다.
  6. 변경 사항 저장: 패널 하단에서 Save changes를 클릭하세요.

에이전트에 발음 가이드를 연결하거나 API를 통해 적용하려면 발음 사전 문서를 참조하세요.

Eleven v4에서 텍스트 음성 변환에 IPA 사용하기

작은 변경이나 흔하지 않은 단어의 경우, 실수를 수정하기 위해 TTS 발음 사전에 반드시 새 항목을 만들 필요는 없습니다. 대신 인라인 IPA를 사용하여 모델이 단어를 정확히 어떻게 발음해야 하는지 지정할 수 있습니다.

Eleven v4에서는 슬래시를 사용해 인라인 IPA를 활성화할 수 있습니다. 오디오 태그처럼 스크립트에 직접 입력할 수 있어 최대한 간편합니다. Eleven v4에서 IPA를 사용하는 몇 가지 예시는 다음과 같습니다:

  • 기술 용어: "/ˌbaɪoʊˈkemɪstri/"라는 용어는 화학 공정 연구를 의미합니다.
  • 의학 용어: "/ɡluːˈkoʊs/"와 "/ˈɪnsjəlɪn/"은 "/ˌdaɪəˈbiːtiːz/"와 같은 질환을 관리하는 데 흔히 사용됩니다.
  • 브랜드 및 제품명: 트래픽 급증을 처리하기 위해 서버는 "/ˌɛndʒɪnˈɛks/"에서 실행됩니다.

참고로 언어학 학위가 없는 분이라면, IPA 변환기를 사용해 자연어 입력을 스크립트에 붙여 넣을 올바른 IPA로 변환할 수 있습니다.

SSML 음소 태그가 Eleven v4에서 작동하지 않는 이유

Eleven v4는 SSML을 지원하지 않습니다. 대신 오디오 태그와 발음 사전처럼 더 유연한 다양한 기능을 선택하여 최종 오디오 제작을 더욱 효과적으로 제어할 수 있게 합니다.

SSML이 제공하는 모든 기능은 v4에서 직접 대체할 수 있습니다:

SSML 태그

기능

Eleven v4 대체 기능

<phoneme>

음성 발음 설정

인라인 IPA(/…/) 또는 사전 음소 규칙

<sub alias>

발화 전 텍스트 교체

사전 별칭 규칙

<break>

일시 정지 추가

[pause] 같은 오디오 태그, 줄임표 또는 줄바꿈

<prosody rate>

말하기 속도 변경

[slowly] 또는 [rushed] 같은 속도 조절 오디오 태그

<emphasis>

단어 강조

대문자 또는 전달 방식 오디오 태그

Eleven v4에서 자연스러운 텍스트 음성 변환 발음 시작하기

Eleven v4의 발음 정확도를 세밀하게 조정하는 다양한 도구를 사용하면 상세한 스크립트를 작성하고 모델이 상상한 그대로 구현하게 할 수 있습니다.

ElevenLabs 텍스트 음성 변환 앱에서 발음 사전을 만들고 ElevenAPI로 대규모 적용하세요.

가입하기를 통해 시작하거나 Eleven v4에 대해 지금 자세히 알아보세요.

FAQ

  1. Artificial Analysis, Provider Voice Arena Preference Elo, 2026년 9월 30일

작성자

Jack Limebear는 Growth 팀에서 블로그와 인사이트 페이지의 콘텐츠 작가이자 전략가로 활동하고 있습니다. ElevenLabs에 합류하기 전에는 빠르게 성장하는 SaaS 스타트업부터 포춘 500대 기업까지 다양한 조직에서 10년 넘게 콘텐츠 전략을 이끌었습니다. 케임브리지 대학교에서 영문학 석사 학위를 취득했습니다.

유사한 기사

최고 품질의 AI 오디오로 창작하세요