声音设计

Deprecated

根据文本提示词创建音色。

请求头

xi-api-keystring可选

查询参数

output_formatenum可选

生成音频的输出格式。

请求

This endpoint expects an object.
voice_descriptionstring必需20-1000 characters

用于创建音色的说明。

textstring or null可选100-1000 characters

要生成的文本,长度必须在 100 到 1000 之间。

auto_generate_textboolean可选默认为 false

是否自动生成适合音色描述的文本。

loudnessdouble可选-1-1默认为 0.5

控制生成语音的音量级别。-1 最安静,1 最响,0 大致对应 -24 LUFS。

qualitydouble可选-1-1默认为 0.9

更高质量可带来更好的语音输出,但多样性较低。

seedinteger or null可选0-2147483647

控制语音生成的随机数。相同种子和相同输入会生成相同的语音。

guidance_scaledouble可选0-100默认为 5
Controls how closely the AI follows the prompt. Lower numbers give the AI more freedom to be creative, while higher numbers force it to stick more to the prompt. High numbers can cause voice to sound artificial or robotic. We recommend to use longer, more detailed prompts at lower Guidance Scale.
should_enhanceboolean可选默认为 false

是否使用 AI 增强声音描述,以补充更多细节并提升语音生成质量。启用后,系统会自动将简单提示词扩展为更详细的声音描述。默认为 False。

响应

成功响应

previewslist of objects

生成音色的预览。

textstring

用于预览音色的文本。

错误

409
Conflict Error
422
Unprocessable Entity Error