Design de voz

Deprecated
Crie uma voz a partir de um prompt de texto.

Cabeçalhos

xi-api-keystringOpcional

Parâmetros de consulta

output_formatenumOpcional

O formato de saída do áudio gerado.

Solicitação

This endpoint expects an object.
voice_descriptionstringObrigatório20-1000 characters

Descrição a ser usada para a voz criada.

textstring or nullOpcional100-1000 characters

Texto a gerar; o comprimento deve estar entre 100 e 1000.

auto_generate_textbooleanOpcionalPadrão é false

Indica se deve gerar automaticamente um texto adequado para a descrição da voz.

loudnessdoubleOpcional-1-1Padrão é 0.5

Controla o nível de volume da voz gerada. -1 é o mais baixo, 1 é o mais alto e 0 corresponde a aproximadamente -24 LUFS.

qualitydoubleOpcional-1-1Padrão é 0.9
Uma qualidade mais alta resulta em uma voz melhor, mas com menos variedade.
seedinteger or nullOpcional0-2147483647

Número aleatório que controla a geração de voz. A mesma seed com as mesmas entradas produz a mesma voz.

guidance_scaledoubleOpcional0-100Padrão é 5

Controla o quanto a IA segue o prompt de perto. Valores menores dão à IA mais liberdade criativa, enquanto valores maiores a fazem seguir mais o prompt. Valores altos podem fazer a voz soar artificial ou robótica. Recomendamos usar prompts mais longos e detalhados com uma Guidance Scale menor.

should_enhancebooleanOpcionalPadrão é false

Indica se deve aprimorar a descrição da voz usando IA para adicionar mais detalhes e melhorar a qualidade da geração de voz. Quando ativado, o sistema expandirá automaticamente prompts simples em descrições de voz mais detalhadas. O padrão é False.

Resposta

Resposta bem-sucedida

previewslist of objects

As prévias das vozes geradas.

textstring
O texto usado para visualizar as vozes.

Erros

409
Conflict Error
422
Unprocessable Entity Error