Scribe v2 Realtime
Scribe v2 Realtime, il nostro modello di riconoscimento vocale live più veloce e accurato, è stato lanciato ufficialmente. Offre un’accuratezza all’avanguardia in oltre 92 lingue con una latenza ultra-bassa di 150 ms. Leggi di più qui.
Piattaforma Agents
- Feedback del widget a fine chiamata: I widget ora supportano la raccolta personalizzabile di feedback a fine chiamata, con campi facoltativi per valutazioni e commenti, per consentirti di raccogliere il feedback degli utenti direttamente nelle conversazioni con i tuoi agenti.
- Configurazione del soft timeout: Aggiunte impostazioni complete per il soft timeout, per controllare come gli agenti gestiscono le pause nelle conversazioni, con prompt e comportamenti configurabili a livello di turno e conversazione.
- Filtraggio avanzato delle conversazioni: L’endpoint delle conversazioni ora supporta il filtraggio per intervallo di durata della chiamata, parametri di valutazione, parametri di raccolta dati e nomi di strumenti specifici.
- Feedback sulle conversazioni migliorato: Aggiornato il sistema di feedback sulle conversazioni con tipi di feedback strutturati, incluse valutazioni e commenti, per monitorare meglio l’esperienza degli utenti.
ElevenCreative Studio
- Metadati dei progetti estesi: I progetti ora includono un tracciamento completo delle risorse, con miniature dei video, riferimenti ad audio esterno e informazioni sulle snapshot migliorate, inclusa la durata dell’audio.
Fatturazione
- Dettagli delle fatture migliorati: Le risposte relative alle fatture ora includono informazioni dettagliate sugli sconti con un nuovo array
discounts, che sostituisce i campi deprecatidiscount_percent_offediscount_amount_off. I campisubtotal_centsetax_centsforniscono una suddivisione più chiara delle fatture.
API Music
- Miglioramenti della latenza nella separazione delle stem: L’endpoint per la separazione delle stem è stato aggiornato per gestire meglio i file audio e offrire una latenza più prevedibile per le richieste di elaborazione.
Rilasci SDK
SDK JavaScript
- v2.23.0 - Aggiornato l’endpoint Speech to Text (Scribe) a
scribe_realtimeed esportati ulteriori tipi TypeScript per migliorare l’esperienza degli sviluppatori. - v2.22.0 - Aggiornato con le ultime modifiche allo schema API, tra cui il filtraggio delle conversazioni, la configurazione del soft timeout e le funzionalità di feedback dei widget.
SDK Python
- v2.22.1 - Aggiornato l’endpoint Speech to Text (Scribe) a
scribe_realtimee risolti problemi di importazione circolare per una maggiore stabilità. - v2.22.0 - Aggiornato con le ultime modifiche allo schema API, tra cui il filtraggio delle conversazioni, la configurazione del soft timeout e le funzionalità di feedback dei widget.
Pacchetti Agents
- @elevenlabs/client@0.10.0 - Aggiornata la configurazione dell’endpoint realtime e migliorata la documentazione.
- @elevenlabs/react@0.10.0 - Aggiornata la configurazione dell’endpoint realtime e migliorata la documentazione.
- @elevenlabs/types@0.2.0 - Aggiornate le definizioni dei tipi per adattarle alle ultime modifiche dello schema API.
- @elevenlabs/react@0.9.2 - Correzioni di bug minori e miglioramenti della stabilità.
- @elevenlabs/convai-widget-embed@0.5.1 - Aggiornata la funzionalità di incorporamento del widget con supporto per il feedback a fine chiamata.
- @elevenlabs/convai-widget-core@0.5.1 - Aggiunta la configurazione del feedback a fine chiamata al core del widget.
- @elevenlabs/convai-widget-embed@0.5.0 - Aggiunto il supporto per la raccolta personalizzabile di feedback a fine chiamata.
- @elevenlabs/convai-widget-core@0.5.0 - Introdotti
WidgetEndFeedbackConfigeWidgetEndFeedbackTypeper la gestione del feedback. - @elevenlabs/client@0.9.2 - Aggiornata la configurazione del client con le ultime modifiche API.
SDK Android
- v0.5.0 - Aggiunte le funzioni
setVolumeegetVolumeper il controllo programmatico dell’audio, con un’implementazione di esempio che include una barra di scorrimento del volume nell’app di esempio.
API
Visualizza le modifiche API
Endpoint aggiornati
Piattaforma Agents
Gestione delle conversazioni
-
- Aggiunto il parametro query
call_duration_min_secs(intero) per filtrare le conversazioni in base alla durata minima della chiamata - Aggiunto il parametro query
call_duration_max_secs(intero) per filtrare le conversazioni in base alla durata massima della chiamata - Aggiunto il parametro query
evaluation_params(array di stringhe) per filtrare in base ai criteri di valutazione - Aggiunto il parametro query
data_collection_params(array di stringhe) per filtrare in base ai parametri di raccolta dati - Aggiunto il parametro query
tool_names(array di stringhe) per filtrare le conversazioni che hanno utilizzato strumenti specifici
- Aggiunto il parametro query
-
Invia feedback sulla conversazione
- Ora utilizza
ConversationFeedbackRequestModelcon tipi di feedback strutturati - Aggiunto il campo
typeper specificare la categoria del feedback - Aggiunto il campo
ratingper il feedback numerico - Aggiunto il campo
commentper il feedback testuale
- Ora utilizza
Configurazione dell’agente
- Ottieni il widget dell’agente
- Aggiunto il campo
end_feedbackconWidgetEndFeedbackConfigper configurare la raccolta di feedback a fine chiamata - Supporta campi facoltativi per valutazioni e commenti nei moduli di feedback
- Aggiunto il campo
- Ottieni l’agente & Aggiorna l’agente
- Schema della risposta aggiornato per includere nuove opzioni di configurazione della piattaforma
- Schema della richiesta migliorato con campi di impostazione aggiuntivi
Configurazione dei turni e delle conversazioni
-
Crea agente, Simula conversazione, Simula stream di conversazione
- Aggiunto il campo
soft_timeout_configper controllare il comportamento durante le pause nelle conversazioni - Aggiunte sostituzioni della configurazione
turntramiteTurnConfigOverrideeTurnConfigOverrideConfig - Aggiunto
initial_wait_timeaTurnConfigper controllare la tempistica della risposta iniziale - Configurazione disponibile a livello di conversazione e di override del workflow
- Aggiunto il campo
Test
-
- Schema della richiesta migliorato per supportare le espressioni del workflow
- Schema della risposta aggiornato con campi aggiuntivi per i risultati dei test
-
Ottieni l’invocazione del test
- La risposta include dati migliorati sui risultati dei test
- Schema aggiornato per i risultati delle espressioni del workflow
ElevenCreative Studio
-
- Aggiunto il campo
assets(obbligatorio) contenente video e riferimenti ad audio esterno - Introdotto
ProjectVideoResponseModelper i metadati delle risorse video - Introdotto
ProjectExternalAudioResponseModelper il tracciamento dell’audio esterno - Introdotto
ProjectVideoThumbnailSheetResponseModelper le miniature dei video
- Aggiunto il campo
-
Ottieni la snapshot del progetto
- Risposta ristrutturata con il nuovo
ProjectSnapshotExtendedResponseModel - Aggiunto il campo
audio_duration_secs(obbligatorio) ai dati della snapshot - Rimosso
character_alignmentsdaProjectSnapshotResponseModel - Introdotto
ProjectSnapshotsResponseModelper le raccolte di snapshot
- Risposta ristrutturata con il nuovo
Fatturazione
- Ottieni l’abbonamento
- Aggiunto l’array
discounts(obbligatorio) con vociDiscountResponseModel - Deprecato il campo
discount_percent_off(ancora disponibile, ma contrassegnato per la rimozione) - Deprecato il campo
discount_amount_off(ancora disponibile, ma contrassegnato per la rimozione) - Aggiunto il campo
subtotal_cents(intero, nullable) per i totali delle fatture al netto delle imposte - Aggiunto il campo
tax_cents(intero, nullable) per gli importi delle imposte - Aggiornati gli esempi di fatture per includere i nuovi campi relativi a sconti e totali
- Aggiunto l’array
Speech to Text
- Trascrivi audio
- Schema della risposta aggiornato con dati di trascrizione migliorati
Text to Speech
-
Text to Speech con timestamp & Stream Text to Speech con timestamp
- Schema della risposta aggiornato con dati sui timestamp migliorati
-
Text to dialogue con timestamp & Stream Text to dialogue con timestamp
- Schema della risposta aggiornato con dati migliorati sui timestamp e sui segmenti vocali
Gestione delle voci
-
Ottieni la voce, Ottieni le impostazioni vocali, Ottieni le impostazioni vocali predefinite
- Schemi delle risposte aggiornati con nuovi metadati vocali e campi di configurazione
-
Modifica le impostazioni vocali
- Schema della richiesta aggiornato per la modifica delle impostazioni vocali
-
- Schema della risposta aggiornato con nuovi dati sulla generazione vocale
Clonazione Vocale Professionale (PVC)
- Ottieni l’audio campione PVC & Ottieni l’audio del parlante separato PVC
- Schemi delle risposte aggiornati per il recupero di campioni audio
Preimpostazioni della lingua
- I modelli di preimpostazione della lingua ora includono il campo
soft_timeout_translationper messaggi di soft timeout localizzati
Trigger di integrazione API
- Registrata una nuova raccolta API:
convai_api_integration_trigger_connections
Deprecazioni
- I campi delle fatture
discount_percent_offediscount_amount_offsono deprecati; usa invece l’arraydiscounts