发音词典
发音词典
了解如何控制 AI 智能体对特定单词和短语的发音。
概述
发音词典可让你自定义 AI 智能体对特定单词或短语的发音。尤其适用于:
- 纠正姓名、地名或技术术语的发音
- 确保不同对话中的发音保持一致
- 自定义地区发音差异
配置
发音词典的音素标签仅适用于 eleven_v4、eleven_flash_v2 和 eleven_v3 模型。
其他模型会跳过词典音素标签,并使用默认发音。对于其他模型,请改用别名标签,替换为能产生所需发音的拼写或短语。
如果想在英语以外的语言中使用 IPA 和 CMU 发音,需切换到 eleven_v3 或 eleven_v4 模型。
为智能体添加词典
通过控制台更新
通过 CLI 更新
通过 API 更新
在控制台中打开智能体,前往 音色设置,然后添加发音词典。保存更改。

词典文件格式
发音词典使用基于 XML 的 .pls 文件。以下是示例结构:
支持的格式
发音词典支持两种发音标注:
-
IPA(国际音标)
- 更精确地控制发音
- 需要了解 IPA 符号
- 示例:“nginx” 的发音为
/ˈɛndʒɪnˈɛks/
-
CMU(卡内基梅隆大学)词典格式
- 更简单的基于 ASCII 的格式
- 更易用于英语发音
- 示例:“tomato” 的发音为 “T AH M EY T OW”
可使用 Claude 或 ChatGPT 等 AI 工具,为特定单词生成 IPA 或 CMU 标注。
最佳实践
- 大小写敏感:如有需要,请为单词的大写和小写形式分别创建条目
- 测试:务必使用所选音色和模型测试发音
- 维护:保持词典有序并记录说明
- 范围:重点关注经常被误读或对使用场景至关重要的单词
常见问题
哪些模型支持基于音素的发音?
发音词典的音素标签仅适用于 eleven_v4、eleven_flash_v2 和 eleven_v3 模型。
其他模型会跳过词典音素标签,并使用默认发音。对于其他模型,请改用别名标签,替换为能产生所需发音的拼写或短语。
如果想在英语以外的语言中使用 IPA 和 CMU 发音,需切换到 eleven_v4 或 eleven_v3 模型。
可以使用多个词典吗?
可以。你可以上传多个词典文件,以处理不同的发音集合。
如果词典中没有某个单词,会怎样?
对于词典中未指定的单词,模型会使用其默认发音规则。