Vai alla navigazione

Musica

  • API Music Finetunes: aggiunto il supporto API per gestire i Music Finetunes. Cinque endpoint consentono di creare un Finetune da audio caricato, elencare i Finetune accessibili, recuperare lo stato dell’addestramento, aggiornare metadati e visibilità oppure eliminare un Finetune. Tutti i metodi SDK di generazione musicale ora espongono finetune_id.

ElevenAgents

  • Risolvi riferimenti esterni alle conversazioni: aggiunto GET /v1/convai/conversations/resolve per risolvere l’URL di un messaggio Slack o di un ticket Zendesk in una conversazione. Le richieste richiedono i parametri query agent_id e reference (stringhe).
  • Interroga le knowledge base degli agenti: aggiunto POST /v1/convai/agents/{agent_id}/knowledge-base/rag-query per query RAG in sola lettura sulla knowledge base di un agente. La richiesta richiede query (stringa), accetta branch_id (stringa) facoltativo e restituisce chunk classificati con metadati di documento, chunk, testo e distanza vettoriale. Questo endpoint è escluso dagli SDK generati.
  • Formati dei contenuti della knowledge base: le risposte per file, testo e URL della knowledge base aggiungono content_format (html | markdown, valore predefinito html) facoltativo.
  • Configurazione vocale dell’agente: gli schemi di override TTS aggiungono model_id (TTSConversationalModel) facoltativo e modificabile dal client. Il valore predefinito di enable_phoneme_tags passa da false a true.
  • Cascata LLM di backup più rapida: il valore predefinito di cascade_timeout_seconds passa da 8 a 4 secondi. L’intervallo consentito rimane 2–15 secondi.
  • Origini dei valori dei parametri degli strumenti: i parametri degli strumenti oggetto ora possono usare dynamic_variable, constant_value o is_omitted, in linea con i controlli scalari e degli array esistenti. Gli override dello schema delle costanti ora accettano array e oggetti arbitrari.
  • Guardrail per la risposta completa: i guardrail personalizzati aggiungono evaluate_full_response_only (booleano, valore predefinito false) facoltativo per valutare una volta l’intera risposta non TTS. Questa opzione richiede la modalità di blocco.
  • Registrazione delle chiamate Twilio: la configurazione delle chiamate di telefonia aggiunge twilio_call_recording_enabled (booleano, valore predefinito false) facoltativo. Le registrazioni vengono archiviate nell’account Twilio connesso e l’impostazione viene ignorata dagli altri provider.
  • Testo per il caricamento file nel widget: la configurazione del testo del widget aggiunge etichette e messaggi di errore facoltativi per allegare e rimuovere file, errori di caricamento, tipi non supportati, file troppo grandi, limiti sul numero di file e l’indicatore di digitazione.
  • Stato di sincronizzazione della knowledge base: le risposte dei file della knowledge base aggiungono auto_sync_info e refresh_status (FileRefreshStatus) facoltativi. Le risposte delle cartelle aggiungono document_count (intero) obbligatorio, un conteggio ricorsivo dei documenti non cartella limitato a 1000.
  • Filtri di ricerca testuale delle conversazioni: Ricerca testuale nei messaggi della conversazione aggiunge i parametri query array exclude_statuses e termination_reasons facoltativi.
  • Opzioni LLM: la configurazione LLM dell’agente aggiunge gpt-5.6-sol, gpt-5.6-terra e gpt-5.6-luna. LLMReasoningEffort aggiunge max.
  • Indicatori di digitazione WhatsApp: gli schemi di richiesta e risposta dell’account WhatsApp aggiungono enable_typing_indicator (booleano) facoltativo.

Speech to Text

  • Autenticazione batch monouso: Converti parlato in testo aggiunge token (stringa) facoltativo come alternativa all’autenticazione tramite chiave API o bearer. Crea il token monouso con POST /v1/single-use-token/batch_scribe; scade dopo 15 minuti.
  • Affidabilità del client realtime: @elevenlabs/client ora segnala gli errori di configurazione del microfono e gli errori del server non validi tramite RealtimeEvents.ERROR, rilascia le risorse del microfono dopo gli errori di configurazione e la chiusura della connessione e scarta i frame del microfono tardivi dopo lo smantellamento del socket.

Text to Speech

Workspace

  • Sottoscrizioni agli eventi webhook: le richieste Aggiorna webhook del workspace aggiungono events (WorkspaceWebhookEventType[]) facoltativo con voice_library_removal_notice, speech_to_text e agent_qa. Le risposte webhook possono restituire l’elenco degli eventi sottoscritti.
  • Dimensioni delle analisi di utilizzo: Ottieni utilizzo del workspace aggiunge surface e actor ai valori di group_by.
  • Cancella limiti dell’account di servizio: Aggiorna chiave API dell’account di servizio accetta character_limit: "clear" per rimuovere un limite mensile di caratteri, oltre a "no_update" e ai valori interi.
  • Riferimenti webhook per gli avvisi: gli schemi dei notificatori webhook di avviso ora identificano un webhook del workspace con webhook_id (stringa) obbligatorio invece di incorporare url, method e headers.

Rilasci SDK

SDK JavaScript

  • v2.59.0 - Aggiunti metodi music.finetunes per elencare, creare, ottenere, aggiornare ed eliminare Music Finetunes. Aggiunte anche la risoluzione dei riferimenti alle conversazioni, il filtro dei dizionari di pronuncia archiviati e i token Speech to Text monouso.

SDK Python

  • v2.59.0 - Aggiunti Music Finetunes e la risoluzione dei riferimenti alle conversazioni dallo schema API più recente. OnPremInitiationData aggiunge inoltre configurazioni tipizzate post_call_transcription_webhook e post_call_audio_webhook con hmac_secret facoltativo per webhook post-chiamata firmati.

Pacchetti

SDK Android

  • v0.11.1 - Impedito a R8 e ProGuard di offuscare i campi degli eventi WebSocket e WebRTC in uscita, come text e type.

CLI

  • @elevenlabs/cli@0.5.6 - Aggiornati i template predefiniti degli agenti per usare scribe_realtime anziché il provider ASR elevenlabs rimosso. I template minimi continuano a usare il valore predefinito del server.

API

Nuovi endpoint

Musica

  • Elenca Music Finetunes - GET /v1/music/finetunes
    • Supporta la paginazione tramite cursore, filtri per visibilità e creatore e l’ordinamento per data di creazione o nome
  • Crea Music Finetune - POST /v1/music/finetunes
    • Richiede name e primary_genre
    • Accetta fino a 50 file audio, tag, visibilità e model_id
  • Ottieni Music Finetune - GET /v1/music/finetunes/{finetune_id}
  • Aggiorna Music Finetune - PATCH /v1/music/finetunes/{finetune_id}
    • Aggiorna name, tags, primary_genre o visibility
  • Elimina Music Finetune - DELETE /v1/music/finetunes/{finetune_id}

ElevenAgents

  • GET /v1/convai/conversations/resolve
    • Richiede i parametri query agent_id (stringa) e reference (stringa)
    • Restituisce GetConversationResponseModel
  • POST /v1/convai/agents/{agent_id}/knowledge-base/rag-query
    • Richiede query (stringa) nel body della richiesta
    • Accetta il parametro query branch_id (stringa) facoltativo
    • Restituisce AgentKnowledgeBaseRagQueryResponseModel
    • Escluso dagli SDK generati

Endpoint aggiornati

ElevenAgents

Speech to Text

  • Converti parlato in testo - POST /v1/speech-to-text
    • Aggiunto parametro query token (stringa) facoltativo per un token Scribe batch monouso

Text to Speech

  • Elenca dizionari di pronuncia - GET /v1/pronunciation-dictionaries
    • Aggiunto parametro query include_archived (booleano, valore predefinito true) facoltativo

Workspace

Modifiche allo schema

ElevenAgents

  • Gli schemi di risposta della knowledge base di ElevenAgents aggiungono content_format (html | markdown, valore predefinito html) facoltativo
  • Le risposte dei file della knowledge base aggiungono auto_sync_info e refresh_status (FileRefreshStatus) facoltativi
  • Le risposte delle cartelle della knowledge base aggiungono document_count (intero) obbligatorio
  • Gli schemi di override TTS dell’agente aggiungono model_id (TTSConversationalModel) facoltativo
  • enable_phoneme_tags TTS dell’agente ora ha valore predefinito true anziché false
  • cascade_timeout_seconds dell’LLM di backup ora ha valore predefinito 4 anziché 8 secondi
  • La configurazione LLM dell’agente aggiunge gpt-5.6-sol, gpt-5.6-terra e gpt-5.6-luna; LLMReasoningEffort aggiunge max
  • I guardrail personalizzati aggiungono evaluate_full_response_only (booleano, valore predefinito false) facoltativo
  • La configurazione delle chiamate di telefonia aggiunge twilio_call_recording_enabled (booleano, valore predefinito false) facoltativo
  • I parametri degli strumenti oggetto aggiungono dynamic_variable, constant_value e is_omitted; gli override delle costanti accettano valori di array e oggetti arbitrari
  • La configurazione del testo del widget aggiunge etichette facoltative per caricamento file e indicatore di digitazione
  • Gli schemi dell’account WhatsApp aggiungono enable_typing_indicator (booleano) facoltativo
  • Gli schemi di simulazione e test aggiungono AutoGenerationMetadata e SimulationLibrarySettings

Musica

  • Aggiunti schemi di richiesta, risposta, paginazione, visibilità, creatore, stato e motivo dell’errore per Music Finetune
  • Tutti gli schemi di richiesta per la generazione musicale espongono finetune_id agli SDK generati

Workspace

  • Gli schemi di richiesta e risposta dei webhook del workspace aggiungono events (WorkspaceWebhookEventType[]) facoltativo
  • Gli schemi dei notificatori webhook di avviso usano webhook_id (stringa) obbligatorio anziché url, method e headers