Design de voz
Cabeçalhos
Parâmetros de consulta
O formato de saída do áudio gerado.
Solicitação
Descrição a ser usada para a voz criada.
Texto a gerar; o comprimento deve estar entre 100 e 1000.
Indica se deve gerar automaticamente um texto adequado para a descrição da voz.
Controla o nível de volume da voz gerada. -1 é o mais baixo, 1 é o mais alto e 0 corresponde a aproximadamente -24 LUFS.
Número aleatório que controla a geração de voz. A mesma seed com as mesmas entradas produz a mesma voz.
Controla o quanto a IA segue o prompt de perto. Valores menores dão à IA mais liberdade criativa, enquanto valores maiores a fazem seguir mais o prompt. Valores altos podem fazer a voz soar artificial ou robótica. Recomendamos usar prompts mais longos e detalhados com uma Guidance Scale menor.
Indica se deve aprimorar a descrição da voz usando IA para adicionar mais detalhes e melhorar a qualidade da geração de voz. Quando ativado, o sistema expandirá automaticamente prompts simples em descrições de voz mais detalhadas. O padrão é False.
Resposta
Resposta bem-sucedida
As prévias das vozes geradas.