보이스 디자인

텍스트 프롬프트로 음성을 만드는 방법을 안내합니다.

보이스 디자인

개요

보이스 디자인은 보이스 라이브러리에서 원하는 음성을 정확히 찾을 수 없을 때 제작자가 그 공백을 채울 수 있도록 돕습니다. 프로젝트에 적합한 음성을 찾을 수 없다면 직접 만들 수 있습니다. 보이스 디자인은 빠른 탐색과 반복 작업에 가장 적합하며, 출력 품질은 프롬프트와 사용 사례에 따라 달라질 수 있습니다. 가장 일관되고 프로덕션에 바로 사용할 수 있는 품질이 필요하다면, 현재 플랫폼에서 가장 높은 품질의 음성은 프로페셔널 음성 복제(PVC)입니다. 따라서 라이브러리에 필요에 맞는 PVC가 있다면 이를 사용하는 것을 권장합니다.

ElevenLabs 앱에서 Voices -> My Voices -> Add a new voice -> Voice Design으로 이동하거나 API를 통해 보이스 디자인을 찾을 수 있습니다.

생성을 누르면 3가지 음성 옵션이 생성됩니다. 보이스 디자인 사용 시에는 미리 보기 텍스트 생성에 필요한 크레딧만 청구되며, 3개의 샘플을 생성하더라도 한 번만 청구됩니다. 차감될 문자 수는 “Text to preview” 텍스트 상자에서 확인할 수 있습니다.

생성 후에는 결과 중 하나를 선택해 저장할 수 있으며, 이는 음성 슬롯 하나를 사용합니다.

프롬프트 가이드

프롬프트는 음성의 기반입니다. 프롬프트는 억양과 캐릭터 유형부터 음성의 성별과 분위기까지, 만들고자 하는 음성의 종류를 모델에 알려 줍니다. 잘 만든 프롬프트는 평범한 음성과 비전에 꼭 맞는 음성의 차이를 만듭니다. 일반적으로 더 자세하고 세분화된 프롬프트일수록 더 정확하고 섬세한 결과를 얻을 수 있습니다. 나이, 성별, 톤, 억양, 속도, 감정, 스타일 등을 포함해 자세한 정보를 제공할수록 모델은 의도에 맞게 맞춤화된 느낌의 음성을 더 잘 해석하고 생성할 수 있습니다.

하지만 특히 중립적이거나 폭넓게 활용할 수 있는 음성을 원할 때는 짧고 간단한 프롬프트도 효과적일 수 있습니다. 예를 들어 매우 구체적인 캐릭터나 스타일을 만들려는 것이 아니라면, “차분한 남성 내레이터”만으로도 자세한 설명 없이 필요한 결과를 얻을 수 있습니다. 적절한 세부 수준은 사용 사례에 따라 다릅니다. 판타지 캐릭터를 만들고 있나요? 가상 비서인가요? 건조한 유머 감각을 지닌 60대 뉴욕 여성인가요? 프롬프트에서 이를 명확하게 정의할수록 출력은 상상한 모습에 더 가까워집니다.

권장 프롬프트 형식

일관된 결과를 위해 다음 형식으로 프롬프트를 구성하세요.

Native <Language>. <Gender>, <Age range>. <Quality level>.
Persona: <2–5 words>. Emotion: <2–3 adjectives>.
<1–2 sentences about timbre, pacing, delivery>

예시:

Native Spanish, español europeo (sin rasgos de español latinoamericano). Female, 35–40. Ok quality. Persona: operadora de soporte confiable. Emotion: reassuring, attentive, confident. Smooth, natural timbre with gentle intonation, forward proximity, and a noise-free signal. Delivers updates at a relaxed pace with clear emphasis on helpful information, projecting empathy and professionalism.

피해야 할 일반적인 실수

  • 억양을 의미할 때 “accent”를 사용하지 마세요 — 원치 않는 방언 변화가 발생할 수 있습니다. 대신 억양, 강조 또는 전달 패턴을 설명하세요.
  • FX 단어는 피하세요 — “reverb”, “echo”, “phone”, “tape” 같은 용어는 출력 품질에 부정적인 영향을 줄 수 있습니다.
  • 언어와 방언을 명확히 지정하세요 — 변화가 생기지 않도록 첫 문장에 언어와 지역별 변형을 항상 명시하세요.

오디오 품질

오디오 품질은 생성된 음성의 선명도, 깨끗함, 전반적인 충실도를 의미합니다. 기본적으로 ElevenLabs는 깨끗하고 자연스럽게 들리는 오디오를 생성하지만, 프로젝트에 특정 수준의 품질이 필요하다면 프롬프트에 명시하는 것이 좋습니다.

고품질 결과를 위해 음성 설명에 “완벽한 오디오 품질” 또는 “스튜디오 품질 녹음” 같은 문구를 추가해 모델을 도울 수 있습니다. 이렇게 하면 최대한 선명하고 왜곡은 최소화하며 완성도 높게 음성이 렌더링되도록 할 수 있습니다.

일관된 결과를 제공하는 구체적인 품질 설명도 사용할 수 있습니다.

  • 보통 품질
  • 좋은 품질
  • 매우 좋은 품질
  • 뛰어난 품질
  • 스튜디오 품질
  • 방송 품질

이러한 설명을 프롬프트에 포함하면 최고 수준의 오디오 품질을 얻는 데 도움이 됩니다.

음성이 매우 구체적이거나 특수한 경우, 이러한 유형의 문구를 포함하면 전반적인 프롬프트 정확도가 낮아질 수 있습니다.

오래된 전화 통화, 라디오 방송 또는 발견 영상 같은 효과를 재현할 때처럼 낮은 오디오 품질이 의도적인 창의적 사례도 있을 수 있습니다. 이런 상황에서는 품질 설명을 완전히 제외하거나 다음과 같은 문구를 명시적으로 포함하세요.

  • “낮은 충실도의 오디오”
  • “낮은 오디오 품질”
  • “음성사서함처럼 들림”
  • “오래된 테이프 레코더처럼 먹먹하고 멀리서 들림”

이 문구는 프롬프트의 처음이나 끝 어디에든 자유롭게 배치할 수 있으며, 두 위치 모두에서 잘 작동하는 것으로 확인되었습니다.

연령, 톤/음색 및 성별

이 세 가지 특성은 음성 디자인의 기반으로, 음성의 전반적인 정체성과 감정적 울림을 결정합니다. 세부 정보를 더 많이 제공할수록 AI가 창의적인 비전에 맞는 음성을 더 쉽게 만들 수 있습니다. 사실적인 캐릭터를 만들거나, 매력적인 내레이터를 구성하거나, 가상 비서를 디자인할 때 모두 마찬가지입니다.

연령

음성에서 느껴지는 연령을 설명하면 성숙도, 음성 질감, 에너지를 정의하는 데 도움이 됩니다. 적절한 음질을 구현하도록 AI를 안내하려면 구체적인 용어를 사용하세요.

유용한 설명 표현:

  • “사춘기 남성” / “사춘기 여성”
  • “젊은 성인” / “20대” / “30대 초반”
  • “중년 남성” / “40대 여성”
  • “노인 남성” / “나이 든 여성” / “80대 남성”

톤/음색

피치, 공명, 음성 질감으로 형성되는 음성의 물리적 특성을 말합니다. 감정 표현이나 태도와는 다릅니다.

일반적인 톤/음색 설명 표현:

  • “깊은” / “낮은 피치의”
  • “부드러운” / “풍부한”
  • “걸걸한” / “쉰”
  • “콧소리가 나는” / “날카로운”
  • “공기 섞인” / “숨소리 섞인”
  • “웅장한” / “울림이 있는”
  • “가벼운” / “얇은”
  • “따뜻한” / “부드러운”
  • “쇳소리가 나는” / “금속성의”

성별

성별은 흔히 피치, 음성의 무게감, 음색의 존재감에 영향을 줍니다. 하지만 정체성 대신 소리를 묘사하면 단순한 범주를 넘어설 수 있습니다.

예시:

  • “낮은 피치의 허스키한 여성 목소리”
  • “깊고 울림 있는 남성적인 남성 목소리”
  • “성별이 중립적이며 부드럽고 중간 피치인 목소리”

억양

억양은 음성의 지역적, 문화적, 감정적 정체성을 정의하는 데 중요한 역할을 합니다. 사실성을 기반으로 하든 캐릭터를 위해 스타일화하든, 프로젝트에 진정성 있는 소리가 필요하다면 원하는 억양을 명확하고 의도적으로 설명하는 것이 필수입니다.

표현 선택은 중요합니다. 특정 용어는 더 일관된 결과를 내는 경향이 있습니다. 예를 들어 억양의 두드러짐을 설명할 때는 “강한”보다 “짙은”이 더 좋은 결과를 내는 경우가 많습니다. 시행착오가 필요한 부분이므로, 다양한 표현을 실험하고 최대한 창의적이고 자세하게 묘사해 보세요.

“accent”라는 단어를 사용할 때는 주의하세요. 지역 방언이 아닌 억양이나 강조 패턴을 의미한다면 해당 용어를 대신 사용하세요. 억양을 의미하면서 “accent”를 사용하면 원치 않는 방언 변화가 발생할 수 있습니다.

  • 명확한 억양 프롬프트 예시:
    • “짙은 프랑스 억양을 가진 중년 남성”
    • “약간의 미국 남부 억양을 지닌 젊은 여성”
    • “강한 동유럽 억양을 가진 노인 남성”
    • “또렷한 영국 억양으로 말하는 쾌활한 여성”
    • “부드러운 아일랜드식 억양이 있는 젊은 남성”
    • “중립적인 미국 억양을 지닌 권위 있는 목소리”
    • “느긋하고 콧소리가 나는 지역적 호주 억양의 남성”

“외국식”이나 “이국적인”처럼 지나치게 모호한 설명은 피하세요. 부정확하며 일관되지 않은 결과를 낼 수 있습니다.

더 정교하게 제어하려면 억양을 톤, 연령, 속도 같은 다른 특성과 함께 사용하세요. 예: “짙은 뉴욕 억양으로 천천히 말하는, 빈정대는 노년 여성.”

판타지 또는 가상 음성에는 실제 억양을 영감으로 제안할 수 있습니다.

  • “제대로 된 짙은 영국 억양을 가진 엘프. 위엄 있고 서정적이다.”
  • “쉰 동유럽 억양을 가진 고블린.”

속도

속도는 음성이 말하는 속력과 리듬을 의미합니다. 음성의 개성, 감정적 톤, 명료함을 형성하는 핵심 요소입니다. 특히 스토리텔링, 광고, 캐릭터 대사, 교육 콘텐츠처럼 특정 용도에 맞는 음성을 디자인할 때는 속도를 명확히 지정하는 것이 중요합니다.

음성이 얼마나 빠르거나 느리게 말해야 하는지 명확한 언어로 설명하세요. 속도가 어떻게 느껴지는지도 묘사할 수 있습니다. 일정한지, 불규칙한지, 신중한지, 경쾌한지 등을 설명해 보세요. 속도가 바뀐다면 어디서, 왜 바뀌는지 반드시 표시하세요.

속도 설명 표현 예시:

  • “빠르게 말하는” / “빠른 속도로”
  • “보통 속도로” / “평소처럼 말하는”
  • “천천히 말하는” / “느린 리듬으로”
  • “신중하고 절제된 속도”
  • “각 단어를 음미하듯 길게 끄는”
  • “급한 일이 있는 것처럼 서두르는 리듬으로”
  • “편안하고 대화체 같은 속도”
  • “리드미컬하고 음악적인 속도”
  • “갑작스러운 멈춤과 폭발적인 구간이 있는 불규칙한 속도”
  • “단어 사이의 간격이 일정한 균일한 속도”
  • “스타카토식 표현”

미리 듣기용 텍스트

좋은 음성 프롬프트를 작성한 후에는 해당 음성을 미리 듣는 데 사용하는 텍스트가 실제 음성의 소리를 결정하는 데 중요한 역할을 합니다. 미리 듣기 텍스트는 연기 대본처럼 작동하며, 음성이 맞추려는 톤, 속도, 감정 표현을 설정합니다.

최상의 결과를 얻으려면 미리 듣기 텍스트가 음성 설명을 보완해야 하며, 모순되어서는 안 됩니다. 예를 들어 프롬프트가 “약간의 일본 억양이 있는 차분하고 사색적인 젊은 여성 목소리”를 설명하는데 “이봐! 네가 이 엉망인 곳에 해 놓은 짓은 정말 못 참겠어!!!” 같은 문장을 사용하면 의도와 충돌합니다. 모델은 이러한 불일치를 조정하려 하며, 그 결과 부자연스럽거나 일관되지 않은 결과가 나오는 경우가 많습니다.

대신 음성이 의도한 개성과 감정적 톤을 반영하는 샘플 텍스트를 사용하세요. 위 예시라면 “요즘은 조용하네요… 생각할 시간이 있었고, 어쩌면 그게 내게 가장 필요했던 일이었는지도 모르겠어요.”와 같은 문장이 프롬프트를 뒷받침하고 더 자연스럽고 일관된 음성을 생성하는 데 도움이 됩니다.

또한 더 긴 미리 듣기 텍스트가 더 안정적이고 표현력 있는 결과를 내는 경향이 있습니다. 특히 톤이나 속도처럼 미묘한 특성을 테스트할 때 짧은 문구는 다소 갑작스럽거나 일관되지 않게 들릴 수 있습니다. 모델에 문장 전체 또는 짧은 단락처럼 더 많은 맥락을 제공하면 음성을 더 매끄럽고 정확하게 구현할 수 있습니다.

파라미터

음량

텍스트 미리 듣기 생성의 볼륨과 저장 후 음성의 볼륨을 제어합니다.

가이던스 스케일

프롬프트를 얼마나 충실히 따를지 결정합니다. 값이 높을수록 프롬프트를 더 엄격하게 따르지만, 프롬프트가 매우 특수한 경우 오디오 품질이 낮아질 수 있습니다. 반면 값이 낮을수록 프롬프트 정확도는 떨어지지만 모델이 더 창의적으로 생성할 수 있습니다. 프롬프트를 완벽히 구현하는 것보다 전반적인 표현과 오디오 품질이 더 중요하다면 낮은 값을 사용하세요. 억양이나 톤의 정확성이 매우 중요할 때는 높은 값을 권장합니다.

속성 및 예시

이러한 설명 표현을 작성하는 방식을 다양하게 실험해 보세요. 예를 들어 “완벽한 오디오 품질”은 “오디오 품질이 완벽함”으로도 작성할 수 있습니다. 이처럼 표현에 따라 서로 다른 결과가 나올 수 있습니다!

속성예시
연령젊은, 더 젊은, 성인, 나이 든, 노년, 40대 남성/여성
억양”짙은” 스코틀랜드 억양, “약간의” 아시아계 미국인 억양, 미국 남부 억양
성별남성, 여성, 성별 중립적, 모호한 성별
톤/음색/피치깊은, 따뜻한, 걸걸한, 부드러운, 날카로운, 매끄러운, 쉰, 콧소리 나는, 목소리가 잠긴, 거친, 로봇 같은, 신비로운
속도보통 리듬, 빠른 속도, 빠르게, 천천히, 길게 끄는, 차분한 속도, 자연스러운/대화체 속도
오디오 품질완벽한 오디오 품질, 오디오 품질은 ‘괜찮음’, 낮은 오디오 품질
캐릭터 / 직업해적, 사업가, 농부, 정치인, 치료사, 오우거, 신과 같은 존재, TV 아나운서
감정활기찬, 신나는, 슬픈, 감정적인, 빈정대는, 무미건조한
피치낮은 피치, 높은 피치, 보통 피치

프롬프트 및 텍스트 미리보기 예시

음성 유형프롬프트/설명텍스트 미리보기가이던스 스케일
여성 스포츠 해설가강한 영국 억양을 지닌 에너지 넘치는 여성 스포츠 해설가로, 매우 빠른 속도로 축구 경기의 플레이 바이 플레이 중계를 열정적으로 전달합니다. 목소리는 생동감 있고 열정적이며 경기 상황에 완전히 몰입해 있습니다.세상에나 — 엄청난 골입니다! 하프라인을 막 넘어서 공을 잡더니, 거기 있는지도 모를 정도로 수비수 두 명을 제치고, 그대로 골대 상단 구석에 강하게 꽂아 넣습니다! 골키퍼에게는 기회가 전혀 없었어요! 젊은 공격수의 WORLD-CLASS 플레이였고, 관중은 모두 자리에서 일어섰습니다! 이 경기가 살아나기 시작했고, 흐름이 바뀌는 게 느껴집니다!25%
훈련 교관부대원들에게 고함치는 육군 훈련 교관입니다. 화가 난 듯하며 빠른 속도로 말합니다.잘 들어, 이 한심한 것들아! 내가 여기 온 건 너희를 돌보러 온 게 아니야 — 군인을 만들러 왔다! 내가 움직이라면 움직이고, 숨 쉬라면 숨 쉬어! 10초 안에 줄 맞춰 서지 않으면 후회하게 될 거다!!25%
사악한 오우거빠른 속도로 말하는 거대한 사악한 오우거입니다. 우스꽝스럽고 울림 있는 어조를 지녔습니다.”내게 너희 무기는 이쑤시개나 다름없다. [laughs] 지금 항복하면 고통 없이 끝내 주지. 나는 왕국을 무너뜨리고 군대를 삼켜 버렸다. 네가 나를 상대로 무슨 희망이 있겠느냐?“30%
친근한 영국인 기업가뛰어난 오디오 품질. 30대에서 40대 초반의 남성으로, 친구에게 말하듯 자연스러운 속도로 강한 영국 억양을 구사합니다.[laughs] 그러니까 말이야. 너는 회사를 보지만, 나는… [lip smacks] 나는 약속을 본다고, 무슨 말인지 알겠어? [exhales] 우리는 단지 이익을 위해 만드는 게 아니야. 더 나은 세상을 만들기 위해, 사람들을 북돋우기 위해 만드는 거지! 우리 기술이 세상을 지금보다 더 친절하고, 더 똑똑하고, 더 연결된 곳으로 만들지 못한다면… [sighs] 우리가 여기서 대체 뭘 하고 있는 거겠어?40%
남부 억양 여성강한 미국 남부 억양을 지닌 나이 든 여성입니다. 다정하면서도 빈정거립니다.”있잖아, 우리가 하는 일이란 게 직함과 트로피만 좇는 거라면 정말 중요한 걸 전부 놓치게 될 거야. [light chuckle] 난 사람들 삶을 더 편하게 만드는 걸 만들고 싶어. 그리고 굽 높은 신발을 신고 미소와 약간의 재치를 곁들여 해낼 수 있다면, 그보다 더 좋을 건 없지.”35%
영화 예고편 목소리액션이나 스릴러 영화 예고편에서 기대감을 조성하는 데 사용하는 극적인 목소리”혼돈의 벼랑 끝에 선 세상, 한 영웅이 일어납니다. 곧 대형 스크린에서 펼쳐질 장대한 이야기의 준비를 하세요.”20%
삐걱거리는 생쥐귀엽고 작은 삐걱거리는 생쥐”나는 작지만, 내 기세는 전혀 작지 않아! [giggles] 조심해, 큰 발아. 아니면 절대 잊지 못할 만큼 발가락을 깨물어 줄 테니까!“20%
화난 해적시끄럽고 호탕한 화난 늙은 해적”네 머리를 하얗게 만들 폭풍도 겪었고, 네 무릎을 떨게 할 바다 괴물도 봤다. 네가 블랙하트 선장을 건드리고 살아서 그 이야기를 전할 수 있을 거라 생각하느냐?“30%
뉴요커깊고 거친 강한 뉴욕 억양으로, 터프하고 세상에 지쳐 있으며 종종 냉소적입니다.”애송이, 네가 상상하는 것보다 훨씬 오래 이 거리를 걸어 다녔어. 이제 네가 무슨 말을 하든 뭘 하든 날 놀라게 할 수는 없어.”40%
스페인어 지원 상담원스페인어 원어민, 유럽 스페인어(라틴아메리카 스페인어 특징 없음). 여성, 35~40세. 보통 품질. 페르소나: 신뢰할 수 있는 지원 상담원. 감정: 안심시키는, 세심한, 자신감 있는.부드럽고 자연스러운 음색에 섬세한 억양, 가까운 마이크 수음, 노이즈 없는 신호를 갖췄습니다. 편안한 속도로 업데이트를 전달하며 유용한 정보는 명확히 강조하고, 공감과 전문성을 드러냅니다.30%
아랍어 고객 서비스아랍어 원어민, 부드러운 걸프(UAE) 억양의 영향. 여성, 30~40세. 뛰어난 품질. 페르소나: 전문적인 고객 서비스 상담원. 감정: 따뜻한, 자신감 있는, 정중한.차분한 톤과 안정적인 속도, 섬세한 억양을 갖춘 벨벳 같은 음색으로, 고충실도 및 아티팩트 없는 신호를 위해 마이크 가까이에서 녹음한 느낌을 유지합니다. 또렷한 존재감과 고객 친화적 문구의 부드러운 강조로 쉽게 이해할 수 있도록 합니다.35%
폴란드어 창의적 내레이터폴란드어 원어민. 남성, 48~58세. 뛰어난 품질. 페르소나: 창의적인 몽상가. 감정: 호기심 많은, 부드러운, 친근한.따뜻하고 몰입감 있는 질감과 안정적인 속도를 갖춘 매끄럽고 아티팩트 없는 목소리로, 자연스러운 근접감 있게 전달됩니다. 밝은 억양과 정확한 강조가 청자를 내러티브로 이끕니다.32%
미친 과학자흥분할수록 빨라지는, 빠르고 불규칙한 말투를 지닌 괴짜 과학 천재의 목소리입니다. 동요하면 독일어 느낌의 억양이 더 두드러집니다. 사색적인 중얼거림부터 광적인 외침까지 음높이가 크게 변하며, 광기 어린 웃음이 자주 터져 나옵니다.”나는 편협한 과학계에서 거부당한 혁명적 천재, 하인리히 박사다! 흥! 놈들은 내 이론은 불가능하고 내 방법은 비윤리적이라고 했지. 하지만 지금 누가 웃고 있나? (maniacal laughter) 20년 동안 이 산속 연구실에서 내 창조물을 완성하며, 필멸자의 이해를 넘어선 에너지를 이용해 왔다! 내 양자 불안정화 장치가 다중우주를 드러내면 학계의 바보들은 자신들의 조롱을 후회하게 될 거다. 아니면 새로운 생명체가 될 수도 있고… 실험에는 예측할 수 없는 변수가 몇 가지 있지… 매혹적인 변수들이 말이야!“38%

FAQ

보이스 디자인을 사용하면 텍스트 프롬프트로 고유한 음성을 만들 수 있습니다.

보이스 라이브러리에서 필요한 음성을 정확히 찾지 못했을 때 유용하도록 설계되었습니다. 기존 옵션 중에서 선택하는 대신, 원하는 음성을 직접 설명해 맞춤 음성을 생성할 수 있습니다.

시작하려면 원하는 음성을 설명하는 프롬프트를 입력하세요. 억양, 성별, 말하기 속도, 톤, 화법 등의 세부 정보를 포함할 수 있습니다. 프롬프트가 구체적일수록 의도에 더 잘 맞는 음성이 생성됩니다. 확신이 없다면 “차분한 남성 내레이터”처럼 간단한 프롬프트도 사용할 수 있습니다.

보이스 디자인으로 만든 음성은 최신 모델인 Eleven v4와 Eleven v3를 포함한 이전 모델에서 사용할 수 있습니다. 오디오 태그를 지원합니다. Eleven v4에서는 이전 모델보다 표현력이 다소 낮을 수 있습니다.

효과적인 프롬프트 작성 팁은 보이스 디자인 가이드를 참조하세요.

참고: 보이스 디자인은 아직 실험적 기능입니다. 프로페셔널 음성 복제는 더 높은 품질과 일관성을 제공합니다. 필요에 맞는 PVC를 찾았다면 사용을 권장합니다. 프로페셔널 음성 복제는 Eleven v4에서 완전히 지원됩니다. Eleven v3에는 완전히 최적화되어 있지 않습니다.

보이스 디자인은 사실적인 사람 음성부터 창의적인 캐릭터 스타일 음성까지 다양한 음성을 생성할 수 있습니다.

어디서부터 시작할지 모르겠다면 “중년 여성 뉴스 진행자”처럼 간단한 프롬프트를 사용해 보세요. 하지만 일반적으로 더 상세한 프롬프트가 더 정확하고 섬세한 결과를 만듭니다.

프롬프트에는 다음과 같은 다양한 특성을 포함할 수 있습니다.

  • 연령
  • 성별
  • 억양
  • 톤
  • 말하기 속도
  • 감정
  • 화법
  • 오디오 품질

출력 결과를 조정하는 추가 제어 기능은 2가지입니다.

  • 음량은 미리 듣기와 저장된 음성 모두의 볼륨을 조절합니다.
  • 가이던스 스케일은 생성된 음성이 프롬프트를 따르는 정도를 결정합니다.

프롬프트 작성에 대한 자세한 도움은 보이스 디자인 가이드를 참조하세요.

보이스 디자인은 음성을 생성할 때만 크레딧을 사용합니다.

음성 생성을 클릭할 때마다 프롬프트를 기반으로 3개의 음성 옵션이 생성됩니다. 미리 보기 텍스트의 문자 수에 따라 비용이 청구됩니다.

직접 미리 보기 텍스트를 입력하거나 자동 생성 버튼을 사용해 자동으로 만들 수 있습니다. 자동 생성된 미리 보기에는 관련 오디오 태그가 포함됩니다.

자세한 내용은 보이스 디자인 가이드를 참고하세요.

No results