Vai alla navigazione

Scribe v2 Realtime

Scribe v2 Realtime, il nostro modello di riconoscimento vocale live più veloce e accurato, è stato lanciato ufficialmente. Offre un’accuratezza all’avanguardia in oltre 92 lingue con una latenza ultra-bassa di 150 ms. Leggi di più qui.

Piattaforma Agents

  • Feedback del widget a fine chiamata: I widget ora supportano la raccolta personalizzabile di feedback a fine chiamata, con campi facoltativi per valutazioni e commenti, per consentirti di raccogliere il feedback degli utenti direttamente nelle conversazioni con i tuoi agenti.
  • Configurazione del soft timeout: Aggiunte impostazioni complete per il soft timeout, per controllare come gli agenti gestiscono le pause nelle conversazioni, con prompt e comportamenti configurabili a livello di turno e conversazione.
  • Filtraggio avanzato delle conversazioni: L’endpoint delle conversazioni ora supporta il filtraggio per intervallo di durata della chiamata, parametri di valutazione, parametri di raccolta dati e nomi di strumenti specifici.
  • Feedback sulle conversazioni migliorato: Aggiornato il sistema di feedback sulle conversazioni con tipi di feedback strutturati, incluse valutazioni e commenti, per monitorare meglio l’esperienza degli utenti.

ElevenCreative Studio

  • Metadati dei progetti estesi: I progetti ora includono un tracciamento completo delle risorse, con miniature dei video, riferimenti ad audio esterno e informazioni sulle snapshot migliorate, inclusa la durata dell’audio.

Fatturazione

  • Dettagli delle fatture migliorati: Le risposte relative alle fatture ora includono informazioni dettagliate sugli sconti con un nuovo array discounts, che sostituisce i campi deprecati discount_percent_off e discount_amount_off. I campi subtotal_cents e tax_cents forniscono una suddivisione più chiara delle fatture.

API Music

  • Miglioramenti della latenza nella separazione delle stem: L’endpoint per la separazione delle stem è stato aggiornato per gestire meglio i file audio e offrire una latenza più prevedibile per le richieste di elaborazione.

Rilasci SDK

SDK JavaScript

  • v2.23.0 - Aggiornato l’endpoint Speech to Text (Scribe) a scribe_realtime ed esportati ulteriori tipi TypeScript per migliorare l’esperienza degli sviluppatori.
  • v2.22.0 - Aggiornato con le ultime modifiche allo schema API, tra cui il filtraggio delle conversazioni, la configurazione del soft timeout e le funzionalità di feedback dei widget.

SDK Python

  • v2.22.1 - Aggiornato l’endpoint Speech to Text (Scribe) a scribe_realtime e risolti problemi di importazione circolare per una maggiore stabilità.
  • v2.22.0 - Aggiornato con le ultime modifiche allo schema API, tra cui il filtraggio delle conversazioni, la configurazione del soft timeout e le funzionalità di feedback dei widget.

Pacchetti Agents

SDK Android

  • v0.5.0 - Aggiunte le funzioni setVolume e getVolume per il controllo programmatico dell’audio, con un’implementazione di esempio che include una barra di scorrimento del volume nell’app di esempio.

API

Endpoint aggiornati

Piattaforma Agents

Gestione delle conversazioni

  • Ottieni le conversazioni

    • Aggiunto il parametro query call_duration_min_secs (intero) per filtrare le conversazioni in base alla durata minima della chiamata
    • Aggiunto il parametro query call_duration_max_secs (intero) per filtrare le conversazioni in base alla durata massima della chiamata
    • Aggiunto il parametro query evaluation_params (array di stringhe) per filtrare in base ai criteri di valutazione
    • Aggiunto il parametro query data_collection_params (array di stringhe) per filtrare in base ai parametri di raccolta dati
    • Aggiunto il parametro query tool_names (array di stringhe) per filtrare le conversazioni che hanno utilizzato strumenti specifici
  • Invia feedback sulla conversazione

    • Ora utilizza ConversationFeedbackRequestModel con tipi di feedback strutturati
    • Aggiunto il campo type per specificare la categoria del feedback
    • Aggiunto il campo rating per il feedback numerico
    • Aggiunto il campo comment per il feedback testuale

Configurazione dell’agente

  • Ottieni il widget dell’agente
    • Aggiunto il campo end_feedback con WidgetEndFeedbackConfig per configurare la raccolta di feedback a fine chiamata
    • Supporta campi facoltativi per valutazioni e commenti nei moduli di feedback
  • Ottieni l’agente & Aggiorna l’agente
    • Schema della risposta aggiornato per includere nuove opzioni di configurazione della piattaforma
    • Schema della richiesta migliorato con campi di impostazione aggiuntivi

Configurazione dei turni e delle conversazioni

  • Crea agente, Simula conversazione, Simula stream di conversazione

    • Aggiunto il campo soft_timeout_config per controllare il comportamento durante le pause nelle conversazioni
    • Aggiunte sostituzioni della configurazione turn tramite TurnConfigOverride e TurnConfigOverrideConfig
    • Aggiunto initial_wait_time a TurnConfig per controllare la tempistica della risposta iniziale
    • Configurazione disponibile a livello di conversazione e di override del workflow

Test

  • Esegui test dell’agente

    • Schema della richiesta migliorato per supportare le espressioni del workflow
    • Schema della risposta aggiornato con campi aggiuntivi per i risultati dei test
  • Ottieni l’invocazione del test

    • La risposta include dati migliorati sui risultati dei test
    • Schema aggiornato per i risultati delle espressioni del workflow

ElevenCreative Studio

  • Ottieni il progetto

    • Aggiunto il campo assets (obbligatorio) contenente video e riferimenti ad audio esterno
    • Introdotto ProjectVideoResponseModel per i metadati delle risorse video
    • Introdotto ProjectExternalAudioResponseModel per il tracciamento dell’audio esterno
    • Introdotto ProjectVideoThumbnailSheetResponseModel per le miniature dei video
  • Ottieni la snapshot del progetto

    • Risposta ristrutturata con il nuovo ProjectSnapshotExtendedResponseModel
    • Aggiunto il campo audio_duration_secs (obbligatorio) ai dati della snapshot
    • Rimosso character_alignments da ProjectSnapshotResponseModel
    • Introdotto ProjectSnapshotsResponseModel per le raccolte di snapshot

Fatturazione

  • Ottieni l’abbonamento
    • Aggiunto l’array discounts (obbligatorio) con voci DiscountResponseModel
    • Deprecato il campo discount_percent_off (ancora disponibile, ma contrassegnato per la rimozione)
    • Deprecato il campo discount_amount_off (ancora disponibile, ma contrassegnato per la rimozione)
    • Aggiunto il campo subtotal_cents (intero, nullable) per i totali delle fatture al netto delle imposte
    • Aggiunto il campo tax_cents (intero, nullable) per gli importi delle imposte
    • Aggiornati gli esempi di fatture per includere i nuovi campi relativi a sconti e totali

Speech to Text

  • Trascrivi audio
    • Schema della risposta aggiornato con dati di trascrizione migliorati

Text to Speech

Gestione delle voci

Clonazione Vocale Professionale (PVC)

Preimpostazioni della lingua

  • I modelli di preimpostazione della lingua ora includono il campo soft_timeout_translation per messaggi di soft timeout localizzati

Trigger di integrazione API

  • Registrata una nuova raccolta API: convai_api_integration_trigger_connections

Deprecazioni

  • I campi delle fatture discount_percent_off e discount_amount_off sono deprecati; usa invece l’array discounts