Presentazione di Speech Engine
ElevenLabs Speech Engine aggiunge la voce in tempo reale al tuo agente chat o LLM. ElevenLabs gestisce speech-to-text, gestione dei turni, text-to-speech e riproduzione nel browser, mentre il tuo server gestisce la logica dell’agente e trasmette il testo della risposta tramite un WebSocket di Speech Engine. Usalo quando vuoi aggiungere la voce a un runtime personalizzato anziché a una configurazione ElevenAgents completamente fornita.
ElevenAgents
- Override del comportamento del testo: Aggiunto
text_behavior_overrides, una mappa perConversationInitiationSourcedi oggettiBehaviorOverridecon campi facoltativiverbosity,output_formateinteraction_budgetper il comportamento dell’agente specifico per canale. - Fonti di integrazione: Aggiunti Intercom, Telegram e Freshdesk.
- Tracce di conversazione OTLP: Ottieni i dettagli della conversazione ora accetta un parametro query
formatfacoltativo. Impostaformat=otlp_tracesper restituire dati di traccia compatibili con OTLP insieme al payload standard della conversazione. - Override delle keyword ASR: Aggiunti gli schemi
ASRConversationalConfigOverrideeASRConversationalConfigOverrideConfigcon arraykeywordsfacoltativi, integrati nei modelli di override client della configurazione delle conversazioni. - Metadati di autenticazione webhook: Gli schemi di configurazione degli strumenti webhook ora espongono
auth_resolved_paramsfacoltativo (array di stringhe), che documenta i segnaposto URL risolti dalla connessione di autenticazione.
Musica
- Modalità di generazione: Aggiunti
MusicGenerationMode(track,loop,ambience) e un campogeneration_modefacoltativo nei body delle richieste di prompt musicali. - Modello da video a musica: Da video a musica (
POST /v1/music/video-to-music) ora accettamodel_idfacoltativo (stringa, valore predefinitomusic_v1).
ElevenCreative Studio
- Crediti di conversione: I modelli di risposta per le statistiche di conversione di capitoli e voci ora includono
credits_needed_to_convertfacoltativo (numero intero), che indica i crediti richiesti prima della conversione.
Workspace
- Tipi di risorsa: Aggiunto
studio_projectsaWorkspaceResourceType.
Release SDK
SDK Python
- v2.50.0 - Rigenerato l’SDK per lo schema API del 25 maggio 2026.
- v2.49.1 - Aggiornate le chiamate API di Speech Engine affinché restituiscano l’oggetto risposta completo.
- v2.49.0 - Rigenerato l’SDK per lo schema API dal 18 al 25 maggio 2026, inclusi gli override del comportamento del testo di ElevenAgents,
generation_modeper la musica estudio_projectsper il workspace.
SDK JavaScript
- v2.50.0 - Aggiunti metodi e test mancanti per l’API Music e rigenerato l’SDK per lo schema API del 25 maggio 2026.
- v2.49.1 - Aggiornate le chiamate API di Speech Engine affinché restituiscano l’oggetto risposta completo.
- v2.49.0 - Rigenerato l’SDK per lo schema API dal 18 al 25 maggio 2026, inclusi gli override del comportamento del testo di ElevenAgents,
generation_modeper la musica estudio_projectsper il workspace.
Pacchetti
- @elevenlabs/client@1.8.1 - Corretto un problema per cui Safari su iOS perdeva il primo messaggio dell’agente nelle sessioni vocali WebSocket, sbloccando un
AudioContextal primo gesto dell’utente e inizializzando il grafo di riproduzione dopo il caricamento dell’audio worklet. - @elevenlabs/convai-widget-core@0.12.8 e @elevenlabs/convai-widget-embed@0.12.8 - Applicati stili ai tag di emozione e audio nelle trascrizioni vocali quando
strip_audio_tagsè disattivato e consideratiterms_htmloterms_textnull al livello superiore come un interruttore di disattivazione per la modale di termini e condizioni. - @elevenlabs/convai-widget-core@0.12.7 e @elevenlabs/convai-widget-embed@0.12.7 - Aggiornate le dipendenze del widget a
@elevenlabs/client@1.8.1.
API
Visualizza le modifiche API
Endpoint e schemi aggiornati
ElevenAgents
- Ottieni i dettagli della conversazione -
GET /v1/convai/conversations/{conversation_id}- Aggiunto il parametro query
formatfacoltativo;otlp_tracesrestituisce dati di traccia compatibili con OTLP
- Aggiunto il parametro query
- Schemi di configurazione dell’agente
- Aggiunta la mappa
text_behavior_overrides, indicizzata daConversationInitiationSource, con valoriBehaviorOverride(verbosity,output_format,interaction_budget)
- Aggiunta la mappa
- Enum
ConversationInitiationSource- Aggiunti
intercom_integration,telegram_integrationefreshdesk_integration
- Aggiunti
- Schemi di override ASR
- Aggiunti
ASRConversationalConfigOverrideeASRConversationalConfigOverrideConfigconkeywordsfacoltativo (array di stringhe)
- Aggiunti
- Schemi degli strumenti webhook
- Aggiunto
auth_resolved_paramsfacoltativo (array di stringhe) nei modelli di configurazione webhook
- Aggiunto
Musica
- Da video a musica -
POST /v1/music/video-to-music- Aggiunto
model_idfacoltativo (stringa, valore predefinitomusic_v1)
- Aggiunto
- Schemi delle richieste di prompt musicali
- Aggiunto
generation_modefacoltativo che fa riferimento aMusicGenerationMode(track,loop,ambience)
- Aggiunto
ElevenCreative Studio
- Schemi delle statistiche di conversione di capitoli e voci
- Aggiunto
credits_needed_to_convertfacoltativo (numero intero)
- Aggiunto
Workspace
- Enum
WorkspaceResourceType- Aggiunto
studio_projects
- Aggiunto