Vai alla navigazione

ElevenAgents

  • Nuove opzioni di configurazione del widget: Nel dashboard degli agenti sono ora disponibili diverse nuove impostazioni per il widget di conversazione ElevenAgents:

    • Widget comprimibile (widget.dismissible): consenti agli utenti di ridurre a icona o chiudere il widget durante una conversazione.
    • Indicatore di attività (widget.show_agent_status): mostra un indicatore visivo quando l’agente utilizza attivamente gli strumenti, con stati distinti per elaborazione, completamento ed errore. Abilitando questa impostazione, agent_tool_request e agent_tool_response vengono aggiunti automaticamente agli eventi client dell’agente.
    • Visualizzazione dell’ID conversazione (widget.show_conversation_id): mostra agli utenti l’ID della conversazione al termine di una chiamata. Il valore predefinito è true sia per gli agenti nuovi sia per quelli esistenti.
    • Visibilità dei tag audio (widget.strip_audio_tags): nascondi i tag audio dalle trascrizioni delle conversazioni. Il valore predefinito è true sia per gli agenti nuovi sia per quelli esistenti.
    • Tema per l’evidenziazione della sintassi (widget.syntax_highlight_theme): configura l’evidenziazione dei blocchi di codice nelle trascrizioni. Accetta null (Auto), light o dark.
  • Test degli agenti con supporto delle cartelle: L’endpoint Elenca test degli agenti ora supporta l’organizzazione dei test in cartelle. Sono stati aggiunti i parametri query parent_folder_id, include_folders e sort_mode per elenchi filtrati. Gli endpoint per la creazione e l’aggiornamento dei test accettano parent_folder_id per assegnare i test alle cartelle e i riepiloghi dei test ora includono il tipo di entità, il path della cartella principale e il numero di elementi figli.

  • **Nodo say nei workflow **: Aggiunto un nuovo tipo di nodo say ai workflow degli agenti (WorkflowSayNodeModel). Questo nodo supporta conversation_config, additional_prompt e override per strumenti e knowledge base. Il payload del messaggio del nodo utilizza un’unione discriminata con due varianti: literal (testo statico tramite text) e prompt (generato dall’LLM tramite prompt).

  • Configurazione dello strumento SMB: Formalizzato lo schema SMBToolConfig con un oggetto params discriminato e obbligatorio. I tipi di operazione supportati sono create, list, search, update e delete, ciascuno applicabile a categorie di entità SMB che includono clienti, personale, servizi, prodotti e risorse.

  • Lingua del riepilogo per gli agenti: Aggiunto il campo summary_language alla configurazione dell’agente per specificare la lingua dei riepiloghi post-conversazione.

  • Registrazione delle chiamate Twilio: Aggiunto il campo facoltativo call_recording_enabled al body della richiesta chiamata Twilio in uscita per abilitare la registrazione delle chiamate in uscita.

  • Flag per la messaggistica WhatsApp: Aggiunto il flag enable_messaging ai modelli di account WhatsApp e alle richieste di aggiornamento per controllare se la messaggistica è abilitata per un determinato numero di telefono.

Dizionari di pronuncia

  • Imposta tutte le regole in una volta: Il nuovo endpoint Imposta regole (POST /v1/pronunciation-dictionaries/{pronunciation_dictionary_id}/set-rules) sostituisce tutte le regole esistenti in un dizionario di pronuncia con una singola chiamata, come alternativa all’aggiunta o alla rimozione incrementale delle singole regole.

  • Opzioni di corrispondenza delle regole: Aggiunti i campi case_sensitive (booleano) e word_boundaries (booleano) alle definizioni delle regole dei dizionari di pronuncia per un controllo più preciso su come le regole corrispondono al testo.

Musica

  • Carica audio: Il nuovo endpoint Carica musica (POST /v1/music/upload) accetta una richiesta multipart/form-data con un file audio. Facoltativamente estrae un piano di composizione dall’audio caricato e restituisce un MusicUploadResponse con un song_id.

  • Supporto dei nomi fonetici: Aggiunto il parametro use_phonetic_names agli endpoint Genera musica, Genera musica dettagliata e Trasmetti musica in streaming.

  • ID brano nelle risposte: Le risposte per la generazione musicale ora espongono il campo song_id, rendendo più semplice fare riferimento ai brani generati nelle chiamate API successive.

Audio Native

  • Aggiorna il contenuto del progetto da un URL: Il nuovo endpoint Aggiorna contenuto (POST /v1/audio-native/content) consente di aggiornare un progetto AudioNative fornendo un URL. L’endpoint estrae il contenuto dall’URL e lo mette in coda per la conversione e la pubblicazione automatica.

Voci

  • Preferiti per le voci: Aggiunto il campo bookmarked alle richieste di aggiornamento delle voci e is_bookmarked agli oggetti di risposta delle voci, consentendo agli utenti di aggiungere le voci ai preferiti per accedervi facilmente.

Rilasci SDK

SDK JavaScript

  • v2.37.0 - Aggiunto il supporto per esporre song_id nelle risposte di generazione musicale. Aggiornato per includere le ultime modifiche allo schema API dalla rigenerazione di Fern.

SDK Python

  • v2.37.0 - Aggiunto il supporto per i nuovi parametri di generazione musicale e per esporre song_id nelle risposte di generazione musicale. Aggiornato per includere le ultime modifiche allo schema API dalla rigenerazione di Fern.

Pacchetti

  • @elevenlabs/convai-widget-core@0.10.0 - Propagato event_id tramite callback di trascrizione e streaming. Riorganizzato il monitoraggio dello stato degli strumenti, da basato su Map a voci di trascrizione inline con un’utilità display-transcript. Aggiunta l’opzione di configurazione show-conversation-id (booleano, valore predefinito true) per controllare la visibilità dell’ID conversazione nei messaggi di disconnessione.
  • @elevenlabs/convai-widget-embed@0.10.0 - Propagato event_id tramite callback di trascrizione e streaming. Riorganizzato il monitoraggio dello stato degli strumenti in voci di trascrizione inline.
  • @elevenlabs/types@0.6.0 - Propagato event_id tramite callback di trascrizione e streaming.

API

Nuovi endpoint

  • Imposta regole del dizionario di pronuncia - POST /v1/pronunciation-dictionaries/{pronunciation_dictionary_id}/set-rules - Sostituisce tutte le regole in un dizionario di pronuncia con una singola chiamata
  • Carica musica - POST /v1/music/upload - Carica un file audio per creare o fare riferimento a un brano, estraendo facoltativamente un piano di composizione
  • Aggiorna il contenuto di Audio Native da URL - POST /v1/audio-native/content - Aggiorna un progetto AudioNative estraendo il contenuto da un URL fornito e mettendolo in coda per la conversione

Endpoint aggiornati

ElevenAgents

  • Elenca test degli agenti

    • Aggiunto il parametro query parent_folder_id (stringa, facoltativo) per filtrare i test per cartella
    • Aggiunto il parametro query include_folders (booleano, facoltativo) per includere gli oggetti cartella nei risultati
    • Aggiunto il parametro query sort_mode (stringa, facoltativo) per controllare l’ordinamento dei risultati
    • La risposta ora include metadati delle cartelle: tipo di entità, path principale e numero di elementi figli in UnitTestSummaryResponseModel
  • Crea test dell’agente, Aggiorna test dell’agente

    • Aggiunto il campo parent_folder_id (stringa, facoltativo) per assegnare un test a una cartella
  • Crea agente, Aggiorna agente, Ottieni agente

    • Aggiunto il campo summary_language (stringa, facoltativo) alla configurazione dell’agente per la lingua del riepilogo post-conversazione
    • Aggiunto widget.dismissible (booleano) - consente agli utenti di comprimere o chiudere il widget
    • Aggiunto widget.show_agent_status (booleano) - visualizza nel widget l’indicatore dello stato di utilizzo degli strumenti
    • Aggiunto widget.show_conversation_id (booleano) - mostra l’ID conversazione al termine della chiamata; il valore predefinito è true
    • Aggiunto widget.strip_audio_tags (booleano) - nasconde i tag audio dalle trascrizioni; il valore predefinito è true
    • Aggiunto widget.syntax_highlight_theme (stringa, nullable) - tema di evidenziazione dei blocchi di codice (null, light o dark)
    • Aggiunto il nuovo tipo di nodo workflow say con schema WorkflowSayNodeModel, inclusi conversation_config, additional_prompt e override di strumenti/knowledge base; il payload del messaggio supporta le varianti discriminate literal e prompt
  • Chiamata Twilio in uscita

    • Aggiunto il campo call_recording_enabled (booleano, facoltativo) per abilitare la registrazione delle chiamate Twilio in uscita
  • Aggiorna account WhatsApp

    • Aggiunto il campo enable_messaging (booleano, facoltativo) per abilitare o disabilitare la messaggistica per l’account
  • Aggiorna webhook

    • Aggiunto il campo schema_overrides (oggetto, facoltativo) per personalizzare lo schema del payload webhook

Dizionari di pronuncia

Musica

Voci

Modifiche agli schemi

Nuovi schemi

  • WorkflowSayNodeModel - Nodo workflow per operazioni say degli agenti con configurazione della conversazione, prompt e override degli strumenti
  • WorkflowSayNodeMessageLiteral - Payload del messaggio letterale (testo statico) per i nodi say
  • WorkflowSayNodeMessagePrompt - Payload del messaggio basato su prompt (generato dall’LLM) per i nodi say
  • MusicUploadResponse - Modello di risposta per il caricamento musicale che include song_id
  • SMBToolConfigCreateClientParams, SMBToolConfigListClientsParams, SMBToolConfigSearchClientsParams, SMBToolConfigUpdateClientParams, SMBToolConfigDeleteClientParams - Tipi di parametri discriminati per le operazioni degli strumenti SMB

Schemi modificati

  • AgentConfig - Aggiunto il campo summary_language
  • WidgetConfigV2 - Aggiunti i campi dismissible, show_agent_status, show_conversation_id, strip_audio_tags e syntax_highlight_theme
  • SMBToolConfig - Il campo params è ora obbligatorio e utilizza un’unione discriminata
  • PronunciationDictionaryRule - Aggiunti i campi case_sensitive e word_boundaries
  • CustomGuardrailConfig - Il campo model è ora facoltativo con un valore predefinito
  • UnitTestSummaryResponseModel - Aggiunti i campi dei metadati delle cartelle: tipo di entità, path principale, numero di elementi figli