숫자, 날짜, 기호, 약어가 제대로 발음되지 않거나 올바른 언어로 읽히지 않는 이유는 무엇인가요?

숫자, 날짜, 기호, 약어는 올바르게 읽는 방식이 여러 가지일 수 있어 AI에 어려움이 될 수 있습니다. 사용하는 언어에 따라서도 달라질 수 있습니다. 예를 들어 “11”은 “Eleven”으로 읽을 수도 있지만, 스페인어에서는 “Once”, 독일어에서는 “Elf”로 읽을 수도 있습니다.

숫자, 날짜, 약어, 기호를 올바르게 읽도록 하는 방법은 여러 가지가 있습니다.

단어로 모두 풀어서 쓰기

최상의 결과를 위해 숫자, 약어, 날짜, 기호를 AI가 읽기를 원하는 방식대로 단어로 모두 풀어 쓰는 것을 권장합니다. 이렇게 하면 AI가 충분한 문맥을 이해하여 올바른 결과를 제공할 수 있습니다. 예를 들어 “$100”의 경우, 원하는 결과를 얻으려면 “a hundred dollars” 또는 “one hundred dollars”라고 쓰는 것을 권장합니다.

LLM 사용하기

예를 들어 ElevenAgents를 사용할 때처럼 대규모 언어 모델을 사용해 텍스트 프롬프트를 생성하는 경우, 숫자, 날짜, 기호, 약어를 AI가 읽기를 원하는 방식에 맞춰 항상 단어로 풀어 쓰도록 모델에 프롬프트를 지정할 수 있습니다.

정규화

API를 통해 생성하는 경우 apply_text_normalization 파라미터를 사용하여 텍스트 정규화를 적용할지 지정할 수 있습니다. 텍스트 정규화는 더 나은 발음을 위해 숫자와 날짜를 단어로 풀어 씁니다. 이 옵션은 정규화 과정에 추가 처리 시간이 필요하므로 지연 시간이 늘어납니다.

apply_text_normalization 파라미터에는 세 가지 모드가 있습니다.

  • on: 항상 적용합니다.
  • off: 적용하지 않습니다.
  • auto: AI가 텍스트 정규화를 적용할 시점을 자동으로 결정합니다.

language_code 파라미터를 사용하여 프롬프트의 언어를 지정할 수도 있습니다. 이 선택적 파라미터는 ISO 639-1 언어 코드를 허용합니다.

텍스트에 숫자나 기호만 포함된 경우처럼 짧거나 모호한 프롬프트에 유용할 수 있습니다. 언어를 지정하면 정규화 도구가 해당 언어에 맞는 올바른 규칙을 적용합니다.

자세한 내용은 API 레퍼런스를 참고하세요.

웹사이트에서 텍스트 음성 변환을 사용해 생성할 때는 기본적으로 정규화가 활성화됩니다.

Studio에서는 기본적으로 정규화가 자동 적용되며, AI가 텍스트 정규화를 적용할 시점을 결정합니다. 정규화를 항상 적용하도록 설정할 수도 있습니다. 이 옵션은 프로젝트 설정의 고급 탭에 있습니다.