Vai alla navigazione

Remixa una voce.

Crea un remix di una voce esistente tramite un prompt. Questo metodo restituisce un elenco di anteprime vocali. Ogni anteprima contiene un generated_voice_id e un campione della voce come audio mp3 codificato in base64. Per creare una voce, usa il generated_voice_id dell’anteprima preferita con l’endpoint /v1/text-to-voice.

Parametri di percorso

voice_idstringObbligatorio

ID della voce da usare. Puoi usare https://api.elevenlabs.io/v1/voices per elencare tutte le voci disponibili.

Header

xi-api-keystringOpzionale

Parametri di query

output_formatenumOpzionale

Output format of the generated audio. Formatted as codec_sample_rate_bitrate. So an mp3 with 22.05kHz sample rate at 32kbs is represented as mp3_22050_32. MP3 with 192kbps bitrate requires you to be subscribed to Creator tier or above. PCM with 44.1kHz sample rate requires you to be subscribed to Pro tier or above. Note that the μ-law format (sometimes written mu-law, often approximated as u-law) is commonly used for Twilio audio inputs.

Richiesta

This endpoint expects an object.
voice_descriptionstringObbligatorio5-1000 characters
Descrizione delle modifiche da apportare alla voce.
textstring or nullOpzionale100-1000 characters

Testo da generare; la lunghezza deve essere compresa tra 100 e 1000 caratteri.

auto_generate_textbooleanOpzionalePredefinito a false
Indica se generare automaticamente un testo adatto alla descrizione della voce.
loudnessdoubleOpzionale-1-1Predefinito a 0.5

Controlla il livello del volume della voce generata. -1 è il più basso, 1 è il più alto, 0 corrisponde a circa -24 LUFS.

seedinteger or nullOpzionale0-2147483647
Numero casuale che controlla la generazione della voce. Lo stesso seed con gli stessi input produce la stessa voce.
guidance_scaledoubleOpzionale0-100Predefinito a 2

Controlla quanto fedelmente l'IA segue il prompt. Valori più bassi lasciano all'IA maggiore libertà creativa, mentre valori più alti la vincolano maggiormente al prompt. Valori alti possono far sembrare la voce artificiale o robotica. Ti consigliamo di usare prompt più lunghi e dettagliati con una Guidance Scale più bassa.

stream_previewsbooleanOpzionalePredefinito a false

Determina se le anteprime di Text to Voice devono essere incluse nella risposta. Se true, vengono restituiti solo gli ID generati, che possono poi essere trasmessi in streaming tramite l'endpoint /v1/text-to-voice/:generated_voice_id/stream.

remixing_session_idstring or nullOpzionale
L'ID della sessione di remix.
remixing_session_iteration_idstring or nullOpzionale

L'ID dell'iterazione della sessione di remix a cui associare queste generazioni. Se non viene fornito, verrà creata una nuova iterazione.

prompt_strengthdouble or nullOpzionale0-1

Controlla il bilanciamento tra prompt e audio di riferimento durante la generazione di campioni vocali. 0 indica un'influenza quasi nulla del prompt, 1 un'influenza quasi nulla dell'audio di riferimento. Supportato solo con il modello eleven_ttv_v3.

Risposta

Risposta riuscita
previewslist of objects
Le anteprime delle voci generate.
textstring
Il testo usato per l'anteprima delle voci.

Errori

409
Conflict Error
422
Unprocessable Entity Error