ElevenAgents
-
Evento WebSocket
agent_response_complete: Un nuovo evento clientagent_response_completeviene attivato esattamente una volta quando la risposta di un agente è stata inviata completamente — dopo il completamento della generazione LLM, delle catene di chiamate agli strumenti e della riproduzione audio. Dopo questo evento, l’agente produrrà altro output solo se l’utente fornisce un nuovo input o se un timeout del turno attiva un nuovo turno. L’evento consente ai client di rilevare in modo affidabile la fine del turno per raggruppare i messaggi, attivare la wake word o aggiornare l’interfaccia dopo il turno. Aggiunto un nuovo valoreAGENT_RESPONSE_COMPLETEall’enumClientEvente un modello di rispostaAgentResponseCompleteClientEventcorrispondente. -
Modalità di parlato prima dello strumento: Aggiunto un nuovo campo
pre_tool_speech(enumPreToolSpeechMode, valore predefinitoauto) nella configurazione del server MCP e nelle sostituzioni per singolo strumento. Sostituisce il booleanoforce_pre_tool_speech, ora deprecato. Valori:autodecide se l’agente parla prima della chiamata allo strumento in base alla recente latenza degli strumenti,forcechiede sempre all’agente di parlare eoffdisattiva completamente questa funzionalità. -
L’invio agli strumenti rispetta la modalità di esecuzione: I nodi di invio degli strumenti del workflow ora rispettano correttamente il valore
execution_modedi ogni strumento nidificato. Se uno strumento in un nodo di invio usaPOST_TOOL_SPEECH, il workflow attende che l’audio del turno corrente sia completamente esposto prima di eseguire l’invio. -
Timeout delle risposte MCP: Aggiunto un campo
response_timeout_secs(intero, valore predefinito30, minimo5, massimo120) nella configurazione del server MCP e nelle sostituzioni per singolo strumento, che controlla il tempo massimo di attesa per il completamento di ogni chiamata allo strumento MCP. -
Contesto di attendibilità dell’agente: Aggiunto un campo
trust_contextnelle impostazioni della piattaforma dell’agente (enumAgentTrustContext:unknown|low|high, valore predefinitounknown).lowè destinato agli agenti al servizio di partecipanti esterni non attendibili, i cui output devono essere verificati e l’accesso agli strumenti limitato;highè destinato agli agenti al servizio del proprietario, per cui è appropriato l’accesso completo agli strumenti;unknowninclude gli agenti creati prima di questa funzionalità. -
Interruttore per l’attribuzione delle fonti: Aggiunto un booleano
source_attribution(valore predefinitofalse) nella configurazione della conversazione. Quando è abilitato e sono presenti contenuti della knowledge base, all’LLM viene chiesto di indicare quali fonti ha utilizzato. -
Filtro della modalità di condivisione dei test: L’endpoint elenca test ora accetta un parametro query
sharing_mode(all|shared_with_me, valore predefinitoall) per filtrare test e cartelle mostrando solo quelli condivisi con l’utente corrente che non ha creato. -
Icone degli strumenti e metadati di esecuzione: Aggiunti i campi
icons(array diIcon) edexecution(ToolExecution) allo schemaTool.Iconincludesrc,mimeTypeesizesper la visualizzazione nell’interfaccia utente, mentreToolExecution.taskSupport(forbidden|optional|required) dichiara come lo strumento partecipa alle attività. -
Valore predefinito del compilatore di procedure: Il valore predefinito di
ProcedureCompilerModeè cambiato dadeterministicaappend, mentre il valorellmè stato rimosso. Gli agenti esistenti che impostano esplicitamentedeterministicnon subiscono modifiche. -
Metadati di attribuzione per RAG e knowledge base: Aggiunto
used_static_kb_document_ids(array di stringhe) inConversationHistoryTranscriptCommonModeleConversationHistoryTranscriptResponseModel, eused_chunk_idsinRagRetrievalInfo, per mostrare esattamente quali documenti della knowledge base e chunk RAG hanno contribuito a ogni turno della trascrizione. -
Refactoring delle variabili dinamiche:
dynamic_variablesedynamic_variable_placeholdersora fanno riferimento agli schemi unificatiDynamicVariableValueType-Input/DynamicVariableValueType-Output(in sostituzione dei precedenti schemiDynamicVariableContainerValueType-*), con un supporto più ampio per valori nidificati e in elenco.DynamicVariableAssignmentha acquisito un campopreserve_native_typeper conservare i valori tipizzati anziché convertirli in stringhe.
Isolamento audio
- Endpoint della cronologia: Due nuovi endpoint espongono la cronologia dell’isolamento audio.
- Elenca la cronologia dell’isolamento audio (
GET /v1/audio-isolation/history) restituisce un elenco paginato di tutte le generazioni di isolamento audio. Supporta i parametri querypage_size,pageesearch. - Elimina elemento della cronologia dell’isolamento audio (
DELETE /v1/audio-isolation/history/{history_item_id}) elimina un elemento specifico e i file multimediali associati.
- Elenca la cronologia dell’isolamento audio (
Speech to Text
- Keyterm in tempo reale e modalità verbatim: Il WebSocket Scribe in tempo reale ora accetta un parametro
keyterms(array di stringhe, massimo 50 elementi fino a 20 caratteri ciascuno) per orientare il modello verso termini specifici e un booleanono_verbatimper rimuovere parole riempitive, false partenze e disfluenze dalle trascrizioni. Entrambi i parametri vengono restituiti nell’eventosession_started. Disponibili con SDK JavaScript, SDK Python e SDK client per browser/Node@elevenlabs/client.
Release degli SDK
SDK Python
- v2.45.0 - Rigenerazione Fern per lo schema API del 27 aprile 2026, inclusi endpoint della cronologia di isolamento audio, esecuzioni degli strumenti,
pre_tool_speecheresponse_timeout_secsdi MCP e l’evento clientagent_response_complete. Include anche una correzione al suggerimento di installazione per notebook nel README. - v2.44.0 - Rigenerazione Fern per lo schema API del 21 aprile 2026, con il campo
trust_context, la modalitàpre_tool_speech, il supporto per la trascrizione degli asset e la configurazione del timeout delle risposte MCP.
SDK JavaScript
- v2.45.0 - Aggiunte le opzioni
keyterms(array di stringhe, massimo 50 keyterm fino a 20 caratteri ciascuno) enoVerbatim(booleano) al client Scribe in tempo reale. Ikeytermsvengono inviati come parametri query ripetuti nell’URL WebSocket per orientare la trascrizione, mentrenoVerbatimrimuove parole riempitive e disfluenze. Entrambi i campi sono stati aggiunti anche all’interfacciaConfigtipizzata per l’ecosession_started. Include anche la rigenerazione Fern del 27 aprile 2026 (#376). - v2.44.0 - Rigenerazione Fern per lo schema API del 21 aprile 2026, con il campo
trust_context, la modalitàpre_tool_speeche la configurazione del timeout delle risposte MCP.
SDK Swift
- v3.1.4 - Corretto un problema per cui il microfono locale continuava a trasmettere dopo la disconnessione di un agente (timeout del silenzio o strumento
end_call). OraonAgentDisconnecteddisconnette la stanza LiveKit e rimuove lo stato della conversazione, mentreonDisconnectviene attivato con un motivo.agent.ConnectionManaging.onAgentDisconnectedora èasync. Rimosso il wrapperConversationConnectionManagerinutilizzato.
Pacchetti
- @elevenlabs/client@1.3.1 - Corretto il problema per cui il suono della chiamata allo strumento dell’agente veniva interpretato come parlato dell’utente, interrompendo l’agente durante l’esecuzione dello strumento.
- @elevenlabs/client@1.3.0 - Aggiunto il supporto per l’endpoint carica file della conversazione, che consente ai client di allegare file a una conversazione in corso direttamente dall’SDK client.
- @elevenlabs/react@1.2.1, @elevenlabs/react@1.2.0 - Aggiornati a
@elevenlabs/client@1.3.1/@elevenlabs/client@1.3.0, includendo la correzione del suono delle chiamate agli strumenti e il supporto per il caricamento dei file delle conversazioni. - @elevenlabs/react-native@1.1.3, @elevenlabs/react-native@1.1.2 - Aggiornati all’ultima versione di
@elevenlabs/clientcon le stesse correzioni. - @elevenlabs/convai-widget-core@0.11.6, @elevenlabs/convai-widget-embed@0.11.6 - Aggiornati a
@elevenlabs/client@1.3.1per la correzione del suono delle chiamate agli strumenti. - @elevenlabs/convai-widget-core@0.11.5, @elevenlabs/convai-widget-embed@0.11.5 - Aggiornati a
@elevenlabs/client@1.3.0per il supporto del caricamento dei file delle conversazioni.
API
Visualizza le modifiche API
Nuovi endpoint
- Elenca la cronologia dell’isolamento audio -
GET /v1/audio-isolation/history - Elimina elemento della cronologia dell’isolamento audio -
DELETE /v1/audio-isolation/history/{history_item_id} - Ottieni esecuzioni degli strumenti -
GET /v1/convai/tools/{tool_id}/executionsrestituisce esecuzioni paginate per uno strumento specifico con filtri facoltativicursor,page_size,is_error,agent_id,branch_id,start_timeeend_time
Endpoint aggiornati
ElevenAgents
-
Crea agente, Ottieni agente, Aggiorna agente
- Aggiunto il campo
trust_context(enumAgentTrustContext:unknown|low|high, valore predefinitounknown) inAgentPlatformSettingsRequestModel - Aggiunto il campo
source_attribution(booleano, valore predefinitofalse) inConversationConfig
- Aggiunto il campo
-
Aggiorna configurazione del server MCP, Crea server MCP
- Aggiunto il campo
pre_tool_speech(enumPreToolSpeechMode:auto|force|off, valore predefinitoauto) - Aggiunto il campo
response_timeout_secs(intero, valore predefinito30, minimo5, massimo120)
- Aggiunto il campo
-
Crea sostituzione della configurazione, Aggiorna sostituzione della configurazione
- Aggiunto il campo
pre_tool_speech(enumPreToolSpeechMode, nullable, facoltativo) - Aggiunto il campo
response_timeout_secs(intero, nullable, facoltativo) - Aggiunto il campo
response_mocksinMCPToolConfigOverride-Input/MCPToolConfigOverride-Output - Contrassegnato
force_pre_tool_speechcome deprecato; usa invecepre_tool_speech
- Aggiunto il campo
-
- Aggiunto il parametro query facoltativo
sharing_mode(enumTestSharingMode:all|shared_with_me, valore predefinitoall)
- Aggiunto il parametro query facoltativo
-
Simula conversazione, Simula conversazione in streaming
- Refactor dei payload
dynamic_variablesedynamic_variable_placeholders, che ora fanno riferimento agli schemi unificatiDynamicVariableValueType-Input/DynamicVariableValueType-Outputcon un supporto più ampio per valori nidificati e in elenco
- Refactor dei payload
-
Schema
Tool- Aggiunto il campo
icons(array diIcon, nullable) per la visualizzazione nell’interfaccia utente - Aggiunto il campo
execution(ToolExecution, nullable), inclusotaskSupport(forbidden|optional|required)
- Aggiunto il campo
-
Enum
ClientEvent- Aggiunto il valore
agent_response_completecon il nuovo modello di rispostaAgentResponseCompleteClientEvent
- Aggiunto il valore
-
Enum
ProcedureCompilerMode- Valore predefinito modificato da
deterministicaappend - Rimosso il valore
llm
- Valore predefinito modificato da
-
ConversationHistoryTranscriptCommonModel,ConversationHistoryTranscriptResponseModel- Aggiunto il campo
used_static_kb_document_ids(array di stringhe)
- Aggiunto il campo
-
RagRetrievalInfo- Aggiunto il campo
used_chunk_ids(array di stringhe)
- Aggiunto il campo
-
DynamicVariableAssignment- Aggiunto il campo
preserve_native_type(booleano) per conservare i valori tipizzati anziché convertirli in stringhe
- Aggiunto il campo
-
Nodi del workflow
- Aggiunto il campo
auto_advance_after_first_responsenegli schemi dei nodi del workflow pertinenti
- Aggiunto il campo
-
Documentazione della configurazione degli strumenti
- Aggiunto il campo
response_body_schemaper documentare la struttura prevista della risposta
- Aggiunto il campo
Workspace
-
GetUserSubscriptionResponseModel- Aggiunto il campo
max_credit_limit_extension
- Aggiunto il campo
-
Ottieni l’utilizzo del workspace per prodotto nel tempo
- Convalida della richiesta più rigorosa: i valori minimi di
start_timeeend_timesono stati aumentati a2020-01-01, con descrizioni aggiunte per entrambi i campi. Il riepilogo dell’endpoint è stato rinominato inGet Workspace Usage.
- Convalida della richiesta più rigorosa: i valori minimi di
Altro
- Nuovo enum condiviso
Currencycon valorieur,inr,usd, che sostituisce le stringhe di valuta inline in diversi schemi. - I nuovi schemi
AssetTranscriptioneAssetTranscriptionDataestendono i modelli degli asset con il supporto alla trascrizione. - I nuovi
PendingBlocksMetadataModelePendingExternalAudiosMetadataModelforniscono metadati più ricchi sulle attività in attesa. - Aggiunto il nuovo valore
InVPCagli enum relativi alle fonti. - I
keytermsdella trascrizione ora hanno restrizioni esplicite sulla lunghezza nella specifica. - Aggiunti i nuovi schemi
MemoryEntrySearchResult,ConversationSourceeManualSource.