Eleven v4 e Eleven v4 Turbo
Eleven v4 e Eleven v4 Turbo sono ora disponibili. Eleven v4 offre un parlato di qualità superiore e più espressivo, oltre a una clonazione vocale migliorata in oltre 90 lingue. Eleven v4 Turbo offre la stessa famiglia di modelli per applicazioni in tempo reale, con una latenza di inferenza mediana di circa 100 ms.
Usa eleven_v4 tramite l’API Text to Dialogue per la creazione di contenuti e audio di lunga durata. Usa eleven_v4_turbo tramite il WebSocket Text to Dialogue per agenti e applicazioni interattive.
Speech to Text
- Modifica della trascrizione: la trascrizione batch e in tempo reale ora accettano un’istruzione di modifica in linguaggio naturale fino a 2.000 caratteri. Le risposte batch restituiscono il risultato in
edited_transcript, mentre le sessioni in tempo reale emettono un eventoedited_transcript. Consulta le guide batch e in tempo reale per incompatibilità, gestione delle risposte e prezzi.
ElevenAgents
- Modelli degli agenti: aggiunti
gpt-6-sol,gpt-6-luna,glm-52,deepseek-v41-flash,claude-opus-5eclaude-opus-5-5alle opzioni LLM supportate per gli agenti. - Utilizzo dei test degli agenti: i riepiloghi delle invocazioni di test possono includere i crediti totali e il prezzo in USD. Le singole esecuzioni di test possono includere i crediti e un dettaglio degli addebiti.
Flows
- API dei template: aggiunti endpoint per elencare e recuperare i template Flows pubblicati, avviare esecuzioni di template e recuperare i risultati delle esecuzioni. Le esecuzioni possono usare una versione pubblicata e inviare il risultato finale a un webhook configurato.
Text to Dialogue
- Continuità della generazione: le richieste Text to Dialogue possono usare testo precedente o successivo e ID richiesta per mantenere la continuità tra generazioni.
- Modalità voce professionale: le richieste Text to Dialogue possono usare la versione Instant Voice Clone di una Professional Voice Clone per ridurre la latenza o migliorare l’espressività.
Rilasci SDK
SDK JavaScript
- v2.70.0 - Aggiunti tipi per la modifica delle trascrizioni Speech to Text batch e in tempo reale, il filtro
branchIde campi di costo per i riepiloghi delle invocazioni di test, l’individuazione automatica della knowledge base,usePvcAsIvcper Text to Dialogue e il modello di agentedeepseek-v41-flash.
SDK Python
- v2.70.0 - Aggiunti tipi per la modifica delle trascrizioni Speech to Text batch e in tempo reale, il filtro
branch_ide campi di costo per i riepiloghi delle invocazioni di test, l’individuazione automatica della knowledge base,use_pvc_as_ivcper Text to Dialogue e il modello di agentedeepseek-v41-flash.
CLI ElevenLabs
- v1.4.0 - Corrette le richieste con una chiave API esplicita, che ora non inviano più anche le credenziali OAuth archiviate, causando errori di autenticazione. Aggiunte descrizioni per il gruppo di comandi di feedback e istruzioni per segnalare funzionalità mancanti alle competenze degli agenti generate. Rigenerato il client API con gli endpoint dei template Flows e i tipi di schema correnti.
API
Visualizza le modifiche all'API
Nuovi endpoint
Flows
- Elenca template -
GET /v1/flows/templates- Elenca i template pubblicati e le relative versioni eseguibili. - Ottieni template -
GET /v1/flows/templates/{template_id}- Recupera un template e le relative versioni eseguibili. - Crea esecuzione di un template -
POST /v1/flows/templates/{template_id}/runs- Avvia l’esecuzione di un template con valori di input, una versione facoltativa e un webhook facoltativo. - Elenca esecuzioni di template -
GET /v1/flows/templates/{template_id}/runs- Elenca le esecuzioni di template con paginazione tramite cursore e filtro di versione facoltativo. - Ottieni esecuzione di un template -
GET /v1/flows/templates/{template_id}/runs/{run_id}- Recupera l’esecuzione di un template e lo stato del relativo output.
Endpoint aggiornati
Speech to Text
- Converti parlato in testo -
POST /v1/speech-to-text- Aggiunto
transcript_editfacoltativo e nullable (stringa), che accetta un’istruzione di modifica in linguaggio naturale fino a 2.000 caratteri. - Le risposte aggiungono
edited_transcriptfacoltativo e nullable. Una modifica riuscita contiene i campi obbligatorikind: "transcript"etext. Una modifica non riuscita contiene i campi obbligatorikind: "error",error_type: "edit_failed"emessage.
- Aggiunto
- Speech to Text in tempo reale accetta
transcript_edit(stringa) ed emette eventiedited_transcriptcon i campi obbligatoritexteedited_text.
ElevenAgents
- Crea agente, Ottieni agente e Aggiorna agente
- Aggiunti
gpt-6-sol,gpt-6-luna,glm-52,deepseek-v41-flash,claude-opus-5eclaude-opus-5-5all’enumLLM. - I monitor di avviso aggiungono
enabledfacoltativo e nullable (booleano) per controllare se un monitor può inviare notifiche.
- Aggiunti
- Elenca conversazioni e Ricerca testuale
data_collection_paramsedynamic_variable_paramsaggiungono gli operatorineqein. I valori diinusano un delimitatore pipe.evaluation_paramsaccettasuccess,failureounknowncome valore del risultato.
- Ricerca intelligente -
GET /v1/convai/conversations/messages/smart-search- Aggiunto
branch_idfacoltativo e nullable (stringa).
- Aggiunto
- Elenca invocazioni di test -
GET /v1/convai/test-invocations- Aggiunto
branch_idfacoltativo e nullable (stringa). - I riepiloghi delle invocazioni di test aggiungono
credits_usedfacoltativo e nullable (intero) etotal_price(numero).
- Aggiunto
- Ottieni invocazione di test -
GET /v1/convai/test-invocations/{test_invocation_id}- Le singole esecuzioni di test aggiungono
credits_usedfacoltativo e nullable (intero) echarging(ConversationChargingCommonModel).
- Le singole esecuzioni di test aggiungono
- Simula conversazione e Simula stream di conversazione
- Modificato il valore predefinito facoltativo di
new_turns_limitda10,000a100e impostato il valore massimo a100.
- Modificato il valore predefinito facoltativo di
- Crea job di crawling e Ottieni job di crawling
- Aggiunto
auto_discoverfacoltativo (booleano, valore predefinitofalse) per seguire i link e aggiungere le pagine appena individuate durante la sincronizzazione automatica. Richiedeenable_auto_sync: true.
- Aggiunto
- Aggiorna documento della knowledge base -
POST /v1/convai/knowledge-base/{documentation_id}/refreshAutoSyncInfoaggiungeauto_discoverfacoltativo (booleano, valore predefinitofalse) per indicare se gli aggiornamenti eseguono il crawling e aggiungono le pagine appena individuate.
- Elenca strumenti del server MCP -
GET /v1/convai/mcp-servers/{mcp_server_id}/tools- Le risposte aggiungono
tool_approval_statusesfacoltativo (array). Ogni elemento contienetool_idobbligatorio (stringa) estate(up_to_date,needs_reviewonot_approved), con campi facoltativi relativi alla policy di approvazione e alla definizione approvata.
- Le risposte aggiungono
Text to Dialogue
- Converti testo in dialogo, Trasmetti testo in dialogo, Converti con timestamp e Trasmetti con timestamp
- Aggiunto
use_pvc_as_ivcfacoltativo (booleano, valore predefinitofalse) per usare la versione Instant Voice Clone di una Professional Voice Clone. - Aggiunti
previous_textefuture_textfacoltativi e nullable (stringhe, massimo 100 caratteri) eprevious_request_idsenext_request_ids(array di stringhe, massimo 3 ID) per la continuità della generazione. - L’oggetto
settingsfacoltativo aggiungesimilaritynullable (numero, 0–1, valore predefinito0.75).
- Aggiunto
Text to Speech
- Converti testo in parlato, Trasmetti testo in parlato, Converti con timestamp e Trasmetti con timestamp
- Il campo
use_pvc_as_ivcesistente non è più deprecato.
- Il campo
Flows
- Crea generazione di immagini, Crea generazione di video e Crea esecuzione di un template
- Le destinazioni webhook ora richiedono un discriminatore
typeesplicito (alloids). I valori predefiniti precedenti sono stati rimossi.
- Le destinazioni webhook ora richiedono un discriminatore
Voice Design
- Crea voce dall’anteprima, Crea anteprime vocali, Progetta una voce e Remixa una voce
- Aggiunta una risposta
409quando è già in corso una generazione per l’anteprima. Riprova la richiesta dopo aver ricevuto questa risposta.
- Aggiunta una risposta
Workspace
- Crea chiave API dell’account di servizio -
POST /v1/service-accounts/{service_account_user_id}/api-keys- Aggiunti
tts_concurrency_limit,music_concurrency_limitedubbing_concurrency_limitfacoltativi e nullable (interi) per le chiavi API degli account di servizio Enterprise.
- Aggiunti
- Aggiorna chiave API dell’account di servizio -
PATCH /v1/service-accounts/{service_account_user_id}/api-keys/{api_key_id}- Aggiunti
tts_concurrency_limit,music_concurrency_limitedubbing_concurrency_limitfacoltativi. Ogni campo accetta un intero,clear,no_updateonulle il valore predefinito èno_update.
- Aggiunti
Modelli
- Elenca modelli -
GET /v1/models- Deprecati i campi obbligatori
max_characters_request_free_useremax_characters_request_subscribed_user. Questi campi non vengono applicati; usa invecemaximum_text_length_per_request.
- Deprecati i campi obbligatori