Remixar uma voz.
Remixe uma voz existente por meio de um prompt. Este método retorna uma lista de prévias de voz. Cada prévia tem um generated_voice_id e uma amostra da voz como áudio mp3 codificado em base64. Para criar uma voz, use o generated_voice_id da prévia escolhida com o endpoint /v1/text-to-voice.
Parâmetros de caminho
Cabeçalhos
Parâmetros de consulta
Solicitação
Descrição das alterações a serem feitas na voz.
Texto a gerar; o comprimento deve estar entre 100 e 1000.
Indica se deve gerar automaticamente um texto adequado para a descrição da voz.
Controla o nível de volume da voz gerada. -1 é o mais baixo, 1 é o mais alto e 0 corresponde a aproximadamente -24 LUFS.
Número aleatório que controla a geração de voz. A mesma seed com as mesmas entradas produz a mesma voz.
Controla o quanto a IA segue o prompt de perto. Valores menores dão à IA mais liberdade criativa, enquanto valores maiores a fazem seguir mais o prompt. Valores altos podem fazer a voz soar artificial ou robótica. Recomendamos usar prompts mais longos e detalhados com uma Guidance Scale menor.
Determina se as prévias do Text to Voice devem ser incluídas na resposta. Se for true, apenas os IDs gerados serão retornados e poderão ser transmitidos pelo endpoint /v1/text-to-voice/:generated_voice_id/stream.
O ID da sessão de remixagem.
O ID da iteração da sessão de remixagem à qual estas gerações devem ser anexadas. Se não for fornecido, uma nova iteração será criada.
Controla o equilíbrio entre o prompt e o áudio de referência ao gerar amostras de voz. 0 significa quase nenhuma influência do prompt; 1 significa quase nenhuma influência do áudio de referência. Compatível apenas com o modelo eleven_ttv_v3.
Resposta
Resposta bem-sucedida
As prévias das vozes geradas.