为什么数字、日期、符号和缩写没有正确发音或未使用正确语言读出?
为什么数字、日期、符号和缩写没有正确发音或未使用正确语言读出?
数字、日期、符号和缩写可能会给 AI 带来挑战,因为它们通常有多种正确的读法。这也取决于所用语言,例如,“11” 可以读作英语的 “Eleven”,也可以是西班牙语的 “Once” 或德语的 “Elf”。
可通过多种方式确保数字、日期、缩写和符号被正确读出。
完整写成文字为获得最佳效果,建议按照希望 AI 读出的方式,将数字、缩写、日期和符号完整写成文字。这能让 AI 获得最充分的上下文,从而提供正确输出。例如,对于 “$100”,建议写成 “a hundred dollars” 或 “one hundred dollars”,以确保获得想要的结果。
使用 LLM如果使用大语言模型生成文本提示词,例如使用 ElevenAgents 时,可以提示模型始终按照希望 AI 读出的方式,将数字、日期、符号和缩写写成文字。
规范化如果通过 API 生成,可以使用 apply_text_normalization 参数指定是否应用文本规范化。文本规范化会将数字和日期写成文字,以确保更好的发音。此选项会增加延迟,因为规范化过程需要额外处理时间。
apply_text_normalization 参数有三种模式:
- on,表示始终应用
- off,表示从不应用
- auto,表示 AI 会自动决定何时应用文本规范化
还可以使用 language_code 参数指定提示词语言。这是一个可选参数,接受 ISO 639-1 语言代码。
这对于简短或有歧义的提示词很有用,例如文本只包含数字或符号时。指定语言可确保规范化器应用该语言的正确规则。
更多信息请参阅我们的 API 参考文档。
通过网站使用文本转语音生成时,默认启用规范化。
在 Studio 中,默认自动应用规范化,即由 AI 决定何时应用文本规范化。也可以将规范化设为始终应用——该选项位于项目设置的高级标签页下。