Eleven v4 Audio Tags 목록: 먼저 사용해 보고, 나만의 태그 만들기
- 게시일
Eleven v4는 텍스트를 하나의 연기로 바꾸는 획기적인 텍스트 음성 변환 모델입니다. Audio Tags를 사용하면 감정 표현을 세밀하게 제어하며 그 연출을 직접 지시할 수 있습니다. [whispers] 또는 [excited]처럼 대괄호로 묶인 자연어 신호를 넣으면 v4가 이에 맞춰 전달 방식을 바꾸는 것을 들을 수 있습니다.
이 ElevenLabs Audio Tags 목록에서는 전체 Eleven v4 감정 범위의 모든 감정과 전달 방식, 속도, 반응, 억양, 음향 효과를 위한 태그를 다룹니다. 기본을 익힌 뒤에는 자연어로 나만의 태그를 작성하는 방법도 알려드립니다.
Eleven v4의 감정 살펴보기
감정 범위 들어보기요약
- Audio Tags는 Eleven v4가 연기 지시로 읽는 대괄호 속 자연어 신호로, 뒤따르는 단어의 전달 방식을 바꿉니다.
- Eleven v4는 Artificial Analysis Speech Arena [September 2026]에서 최고 순위 모델이며, Audio Tags를 사용하면 대사 한 줄 한 줄의 연기를 지시할 수 있습니다.
- Eleven v4 감정 범위 휠에서는 다양한 감정을 들어 보며 모델의 기능을 빠르게 파악할 수 있습니다.
- 태그는 정해진 목록에 제한되지 않습니다. [whispering, fearful]처럼 특성을 조합하거나 대사 뒤의 상황 또는 캐릭터를 묘사해 직접 작성할 수 있습니다.
- Audio Tags는 ElevenAPI를 통해 Eleven v4, Eleven v4 Turbo 및 Eleven v3에서 사용할 수 있습니다.
ElevenLabs Audio Tags란 무엇인가요?
Audio Tags는 글 안에 대괄호로 넣을 수 있는 자연어 신호입니다. Eleven v4는 이를 연기 표식으로 읽고 특정 단어나 구절을 말하는 방식을 바꾸는 지시로 활용합니다. ElevenLabs 텍스트 음성 변환 앱에서 스크립트에 인라인으로 작성하면 모델이 이를 생생하게 구현합니다.
Eleven v4는 Artificial Analysis Speech Arena에서 최고 순위인 TTS 모델로, 청취자들이 가장 자연스럽게 들리는 텍스트 음성 변환에 투표합니다.1 Audio Tags를 사용하면 각 대사의 전달 방식을 정확히 지시해 연기를 한층 더 발전시킬 수 있습니다.
스크립트에서 Audio Tags를 사용하는 방법은 다음과 같습니다.
- 태그는 영향을 줄 단어 앞에 배치하세요: “[shouts] I can’t believe you said that to me”라고 작성하면 전체 대사가 외치는 톤으로 전달됩니다.
- 감정은 이어집니다: 태그를 추가하면 해당 감정이 대사 전체에 이어지므로, 전달 방식을 바꾸고 싶을 때만 다른 태그를 넣으면 됩니다. 예: “[proud] I’ve been cooking for over a decade. I know how to boil an egg. [startled] What’s that burning smell?"
- 태그를 조합해 연출을 겹치세요: [whispering, playful]처럼 하나의 대괄호 안에서 쉼표로 Audio Tags를 구분하면 TTS 연기에 뉘앙스를 더할 수 있습니다.
- 태그와 문장 부호를 함께 사용하세요: Audio Tags가 분위기와 전달 방식을 정한다면, 스크립트의 문장 부호로 속도를 자연스럽게 제어할 수 있습니다. 말줄임표, 대시 또는 대문자를 추가해 운율을 조절하세요.
태그의 작동 방식과 SSML을 대체하는 방법을 더 자세히 설명한 Audio Tags 완벽 가이드도 준비했습니다.

감정 Audio Tags 목록
Eleven v4 감정 휠에는 수십 가지 감정이 있으며, 각 감정을 v4가 연기하므로 태그를 작성하기 전에 차이를 들어 볼 수 있습니다.
아래 감정을 클릭해 휠에서 들어 보거나, 문장과 감정을 직접 바꿔 보며 Eleven v4가 감정 Audio Tags를 생생하게 구현하는 모습을 확인하세요.
감정 계열 | 감정 Audio Tags |
고에너지 | [excited], [playful], [amazed], [powerful], [proud], [optimistic], [startled] |
격앙됨 | |
긴장됨 | [anxious], [stressed], [scared], [threatened], [vulnerable], [confused], [busy] |
저에너지 | |
차분하고 사색적 |
여기서는 일부 감정만 소개했지만, 원하는 감정은 무엇이든 자연어로 구현할 수 있습니다. 아래 예시에서는 위에 소개하지 않은 다양한 Audio Tags를 사용해 자연어 프롬프트로 할 수 있는 일을 보여드립니다.
이 샘플은 Jonathan Livingston의 목소리로 구현했습니다.
전달 방식 및 볼륨 Audio Tags 목록
전달 방식 및 볼륨 태그는 선택한 감정과 별개로 대사가 얼마나 크고 강렬하게 들릴지 제어합니다. v4가 더 구체적인 연출 의도를 따르도록 하려면 전달 방식 태그와 감정 태그를 함께 사용해 더욱 세밀하게 제어하세요.
몇 가지 예시는 다음과 같습니다.
- [whispers] 움직이지 마, 바로 네 뒤에 있어.
- [shouts] 모두 지금 당장 건물에서 대피하세요!
- [softly] 할 수 있는 건 모두 했어.
- [quietly] 간 것 같아.
- [low, threatening] 여기 오지 말았어야 했어.
볼륨과 전달 방식 제어가 어떻게 작동하는지 살펴보세요.
위 샘플은 Rod의 목소리로 구현했습니다.
속도 Audio Tags 목록
속도 Audio Tags는 대사의 속도를 바꿉니다. 긴장감을 조성하거나 완벽한 코믹 타이밍을 만들 때 추가해 보세요. 단어만큼 타이밍도 중요하다면 속도 태그를 사용해야 합니다.
추가 팁으로, 문장 부호는 텍스트 음성 변환 성능에 자연스럽게 도움이 되므로 함께 사용하면 문장을 완벽하게 제어할 수 있습니다.
- [slowly] 그리고 우승자는...
- [rushed] 미안, 늦었어. 기차가 고장 나서 여기까지 뛰어왔어.
- [pause] 그러고 나서 전화가 울렸다.
- [drawn out] 말도 안 돼에에.
Adam의 목소리로 이 샘플을 구현했습니다.
사람 같은 반응 Audio Tags 목록
반응 태그는 웃음, 헐떡임, 울음, 기침, 한숨 같은 소리를 문장에 더합니다. 이런 태그는 텍스트에 생동감을 불어넣어 TTS 오디오 샘플이 대본을 읽는 것이 아니라 즉흥적으로 말하는 사람처럼 자연스럽게 들리도록 합니다.
반응 Audio Tags의 몇 가지 예시는 다음과 같습니다.
- [laughs] 정말 그걸 믿은 거야?
- [sighs] 알았어. 내가 설거지할게.
- [gasps] 저거 진짜 다이아몬드야?
- [clears throat] 모두 주목해 주시면 감사하겠습니다.
- [crying] 돌아올 줄은 몰랐어.
Eleven v4는 감정에 맞는 작은 인간적인 표현도 추가합니다. 감정 휠을 들어 보면 v4가 스스로 말더듬이나 신음 소리를 넣은 "Y- you came back?" 또는 "Ugh, this is real?" 같은 대사를 들을 수 있습니다.
이 목소리를 직접 제작물에 사용하려면 Jack John을 찾아보세요.
억양 및 캐릭터 Audio Tags 목록
Eleven v4에서는 다양한 억양이나 캐릭터 목소리로 풍부한 장면을 만드는 일이 그 어느 때보다 쉬워졌습니다. 몇 개의 Audio Tags만으로도 목소리의 기본 특성은 유지하면서 새로운 페르소나로 바꿀 수 있습니다. 한 번의 생성에서 하나의 목소리가 전체 배역을 연기할 수 있습니다.
- [British accent] 차 한 잔 할래요?
- [French accent] 제 작은 카페에 오신 것을 환영합니다.
- [Australian accent] 걱정 마, 친구. 우리가 해결할게.
- [pirate voice] 돛을 올리고 럼주를 건네라.
Lauren이 이 샘플을 생생하게 구현하는 데 도움을 주었습니다.
음향 효과 Audio Tags 목록
음향 효과 Audio Tags는 음성이 아닌 이벤트를 생성 결과에 직접 추가합니다. 예를 들어 내러티브 장면이나 비디오 게임 트랙을 만들 때 별도의 SFX 트랙 없이도 이러한 태그로 극적인 효과를 더할 수 있습니다. 특정한 효과가 필요하다면 언제든 AI 음향 효과 생성기를 사용할 수도 있습니다.
- [thunder rumbling] 점점 가까워지고 있어.
- [footsteps] 누군가 계단을 올라오고 있어.
- [door creaking] 여보세요? 아무도 없나요?
- [clapping] 감사합니다, 감사합니다. 너무 과찬이세요.
위 클립의 목소리는 Siren입니다.
자연어로 나만의 Audio Tags 작성하기
위에서 소개한 어떤 Audio Tags로 시작해도 좋습니다. 하지만 ElevenLabs TTS의 장점은 모델이 활용할 추가 맥락을 제공하기 위해 새로운 Audio Tag를 자연어로 자유롭게 작성할 수 있다는 점입니다.
원하는 바를 한 단어 태그로 담아낼 수 없다면, 더 포괄적인 지시를 작성해 보세요.
- 감정과 특성 조합하기: [tense, cautious] 또는 [whispering, fearful]
- 방식 묘사하기: [like a sports commentator, speeding up]
- 상황 묘사하기: [out of breath after running up the stairs]
- 캐릭터 묘사하기: [a tired detective who has heard it all before]
- 변화 묘사하기: [starting calm, then losing patience]
장면에 생동감을 더하려면 Spuds Oxley를 사용해 보세요.
Audio Tags 선택 팁
자연어로 작성하면 텍스트 음성 변환 오디오 샘플을 만들 때 폭넓은 유연성을 누릴 수 있지만, 완벽한 결과를 얻으려면 몇 차례 조정이 필요할 수도 있습니다.
Eleven v4에서 TTS를 최대한 매끄럽게 사용하기 위한 Audio Tags 활용 팁을 소개합니다.
- 작성하기 전에 들어 보세요: 몇 가지 감정을 감정 휠에서 재생해 v4가 각각을 어떻게 해석하는지 들어 보고(또는 영감을 얻고), 대사에 가장 가까운 감정을 선택하세요.
- 대사를 다시 쓰기 전에 태그를 바꾸세요: 전달 방식이 기대에 미치지 못하면 [despair] 대신 [let down]처럼 인접한 감정을 시도한 뒤 다시 생성하세요.
- 절마다 태그 하나를 사용하세요: 같은 단어에 대비되는 태그를 쓰면 연기가 흐려질 수 있습니다. 감정을 바꾸고 싶은 지점에 새 태그를 추가하세요.
- 모델에 완전한 장면을 제공하세요: Eleven v4는 맥락이 있을 때 더 뛰어난 성능을 발휘합니다. 텍스트 음성 변환 앱에서는 생성당 최대 10,000자의 컨텍스트를 사용할 수 있으므로, 여러 겹의 지시를 구성해 장면에 마법을 더할 충분한 공간이 있습니다.
- 프리셋으로 시작한 다음 구체화하세요. [nervous]가 비슷하지만 완벽하지 않다면 부족한 부분을 작성하세요: [nervous, trying to sound confident].
무엇보다 ElevenLabs TTS 앱에서 직접 실험해 보는 것이 빠르게 익히고 고품질 TTS 오디오를 만들기 시작하는 가장 좋은 방법입니다.

Eleven v4로 몰입감 있는 오디오 시작하기
자연어로 원하는 조합을 만들 수 있으므로 정해진 ElevenLabs Audio Tags 목록은 없습니다. 이 목록의 모든 태그는 Eleven v4에서 작동하며, 장면을 작성하면서 떠올린 태그도 마찬가지로 작동합니다.
17,500개 이상의 목소리 중 보이스 라이브러리에서 하나를 선택하고 스크립트를 붙여 넣은 뒤 첫 Audio Tag를 추가해 시작하세요.
Eleven v4에 관해 자세히 알아보거나 가입하여 인상적인 오디오 연기를 만들어 보세요.
ElevenLabs Audio Tags FAQ
- Artificial Analysis, Provider Voice Arena Preference Elo, 2026년 9월 30일
Jack Limebear는 Growth 팀에서 블로그와 인사이트 페이지의 콘텐츠 작가이자 전략가로 활동하고 있습니다. ElevenLabs에 합류하기 전에는 빠르게 성장하는 SaaS 스타트업부터 포춘 500대 기업까지 다양한 조직에서 10년 넘게 콘텐츠 전략을 이끌었습니다. 케임브리지 대학교에서 영문학 석사 학위를 취득했습니다.




