Vai alla navigazione

Eleven v4 e Eleven v4 Turbo

Eleven v4 e Eleven v4 Turbo sono ora disponibili. Eleven v4 offre un parlato di qualità superiore e più espressivo, oltre a una clonazione vocale migliorata in oltre 90 lingue. Eleven v4 Turbo offre la stessa famiglia di modelli per applicazioni in tempo reale, con una latenza di inferenza mediana di circa 100 ms.

Usa eleven_v4 tramite l’API Text to Dialogue per la creazione di contenuti e audio di lunga durata. Usa eleven_v4_turbo tramite il WebSocket Text to Dialogue per agenti e applicazioni interattive.

Speech to Text

  • Modifica della trascrizione: la trascrizione batch e in tempo reale ora accettano un’istruzione di modifica in linguaggio naturale fino a 2.000 caratteri. Le risposte batch restituiscono il risultato in edited_transcript, mentre le sessioni in tempo reale emettono un evento edited_transcript. Consulta le guide batch e in tempo reale per incompatibilità, gestione delle risposte e prezzi.

ElevenAgents

  • Modelli degli agenti: aggiunti gpt-6-sol, gpt-6-luna, glm-52, deepseek-v41-flash, claude-opus-5 e claude-opus-5-5 alle opzioni LLM supportate per gli agenti.
  • Utilizzo dei test degli agenti: i riepiloghi delle invocazioni di test possono includere i crediti totali e il prezzo in USD. Le singole esecuzioni di test possono includere i crediti e un dettaglio degli addebiti.

Flows

  • API dei template: aggiunti endpoint per elencare e recuperare i template Flows pubblicati, avviare esecuzioni di template e recuperare i risultati delle esecuzioni. Le esecuzioni possono usare una versione pubblicata e inviare il risultato finale a un webhook configurato.

Text to Dialogue

  • Continuità della generazione: le richieste Text to Dialogue possono usare testo precedente o successivo e ID richiesta per mantenere la continuità tra generazioni.
  • Modalità voce professionale: le richieste Text to Dialogue possono usare la versione Instant Voice Clone di una Professional Voice Clone per ridurre la latenza o migliorare l’espressività.

Rilasci SDK

SDK JavaScript

  • v2.70.0 - Aggiunti tipi per la modifica delle trascrizioni Speech to Text batch e in tempo reale, il filtro branchId e campi di costo per i riepiloghi delle invocazioni di test, l’individuazione automatica della knowledge base, usePvcAsIvc per Text to Dialogue e il modello di agente deepseek-v41-flash.

SDK Python

  • v2.70.0 - Aggiunti tipi per la modifica delle trascrizioni Speech to Text batch e in tempo reale, il filtro branch_id e campi di costo per i riepiloghi delle invocazioni di test, l’individuazione automatica della knowledge base, use_pvc_as_ivc per Text to Dialogue e il modello di agente deepseek-v41-flash.

CLI ElevenLabs

  • v1.4.0 - Corrette le richieste con una chiave API esplicita, che ora non inviano più anche le credenziali OAuth archiviate, causando errori di autenticazione. Aggiunte descrizioni per il gruppo di comandi di feedback e istruzioni per segnalare funzionalità mancanti alle competenze degli agenti generate. Rigenerato il client API con gli endpoint dei template Flows e i tipi di schema correnti.

API

Nuovi endpoint

Flows

  • Elenca template - GET /v1/flows/templates - Elenca i template pubblicati e le relative versioni eseguibili.
  • Ottieni template - GET /v1/flows/templates/{template_id} - Recupera un template e le relative versioni eseguibili.
  • Crea esecuzione di un template - POST /v1/flows/templates/{template_id}/runs - Avvia l’esecuzione di un template con valori di input, una versione facoltativa e un webhook facoltativo.
  • Elenca esecuzioni di template - GET /v1/flows/templates/{template_id}/runs - Elenca le esecuzioni di template con paginazione tramite cursore e filtro di versione facoltativo.
  • Ottieni esecuzione di un template - GET /v1/flows/templates/{template_id}/runs/{run_id} - Recupera l’esecuzione di un template e lo stato del relativo output.

Endpoint aggiornati

Speech to Text

  • Converti parlato in testo - POST /v1/speech-to-text
    • Aggiunto transcript_edit facoltativo e nullable (stringa), che accetta un’istruzione di modifica in linguaggio naturale fino a 2.000 caratteri.
    • Le risposte aggiungono edited_transcript facoltativo e nullable. Una modifica riuscita contiene i campi obbligatori kind: "transcript" e text. Una modifica non riuscita contiene i campi obbligatori kind: "error", error_type: "edit_failed" e message.
  • Speech to Text in tempo reale accetta transcript_edit (stringa) ed emette eventi edited_transcript con i campi obbligatori text e edited_text.

ElevenAgents

  • Crea agente, Ottieni agente e Aggiorna agente
    • Aggiunti gpt-6-sol, gpt-6-luna, glm-52, deepseek-v41-flash, claude-opus-5 e claude-opus-5-5 all’enum LLM.
    • I monitor di avviso aggiungono enabled facoltativo e nullable (booleano) per controllare se un monitor può inviare notifiche.
  • Elenca conversazioni e Ricerca testuale
    • data_collection_params e dynamic_variable_params aggiungono gli operatori neq e in. I valori di in usano un delimitatore pipe.
    • evaluation_params accetta success, failure o unknown come valore del risultato.
  • Ricerca intelligente - GET /v1/convai/conversations/messages/smart-search
    • Aggiunto branch_id facoltativo e nullable (stringa).
  • Elenca invocazioni di test - GET /v1/convai/test-invocations
    • Aggiunto branch_id facoltativo e nullable (stringa).
    • I riepiloghi delle invocazioni di test aggiungono credits_used facoltativo e nullable (intero) e total_price (numero).
  • Ottieni invocazione di test - GET /v1/convai/test-invocations/{test_invocation_id}
    • Le singole esecuzioni di test aggiungono credits_used facoltativo e nullable (intero) e charging (ConversationChargingCommonModel).
  • Simula conversazione e Simula stream di conversazione
    • Modificato il valore predefinito facoltativo di new_turns_limit da 10,000 a 100 e impostato il valore massimo a 100.
  • Crea job di crawling e Ottieni job di crawling
    • Aggiunto auto_discover facoltativo (booleano, valore predefinito false) per seguire i link e aggiungere le pagine appena individuate durante la sincronizzazione automatica. Richiede enable_auto_sync: true.
  • Aggiorna documento della knowledge base - POST /v1/convai/knowledge-base/{documentation_id}/refresh
    • AutoSyncInfo aggiunge auto_discover facoltativo (booleano, valore predefinito false) per indicare se gli aggiornamenti eseguono il crawling e aggiungono le pagine appena individuate.
  • Elenca strumenti del server MCP - GET /v1/convai/mcp-servers/{mcp_server_id}/tools
    • Le risposte aggiungono tool_approval_statuses facoltativo (array). Ogni elemento contiene tool_id obbligatorio (stringa) e state (up_to_date, needs_review o not_approved), con campi facoltativi relativi alla policy di approvazione e alla definizione approvata.

Text to Dialogue

  • Converti testo in dialogo, Trasmetti testo in dialogo, Converti con timestamp e Trasmetti con timestamp
    • Aggiunto use_pvc_as_ivc facoltativo (booleano, valore predefinito false) per usare la versione Instant Voice Clone di una Professional Voice Clone.
    • Aggiunti previous_text e future_text facoltativi e nullable (stringhe, massimo 100 caratteri) e previous_request_ids e next_request_ids (array di stringhe, massimo 3 ID) per la continuità della generazione.
    • L’oggetto settings facoltativo aggiunge similarity nullable (numero, 0–1, valore predefinito 0.75).

Text to Speech

Flows

Voice Design

Workspace

  • Crea chiave API dell’account di servizio - POST /v1/service-accounts/{service_account_user_id}/api-keys
    • Aggiunti tts_concurrency_limit, music_concurrency_limit e dubbing_concurrency_limit facoltativi e nullable (interi) per le chiavi API degli account di servizio Enterprise.
  • Aggiorna chiave API dell’account di servizio - PATCH /v1/service-accounts/{service_account_user_id}/api-keys/{api_key_id}
    • Aggiunti tts_concurrency_limit, music_concurrency_limit e dubbing_concurrency_limit facoltativi. Ogni campo accetta un intero, clear, no_update o null e il valore predefinito è no_update.

Modelli

  • Elenca modelli - GET /v1/models
    • Deprecati i campi obbligatori max_characters_request_free_user e max_characters_request_subscribed_user. Questi campi non vengono applicati; usa invece maximum_text_length_per_request.