Text to Voice
- Voice Design: Lanciato il nuovo Text to Voice Design con Eleven v3 per creare voci personalizzate da descrizioni testuali.
Speech to Text
- Diarizzazione migliorata: Aggiunto il parametro
diarization_thresholdall’endpoint Speech to Text. Regola con precisione l’equilibrio tra accuratezza dei parlanti e numero totale di parlanti impostando la soglia tra 0,1 e 0,4.
Clonazione Vocale Professionale
- Rimozione del rumore di fondo: Aggiunto
remove_background_noiseper pulire i campioni vocali usando modelli di isolamento audio e ottenere dati di addestramento di qualità migliore.
ElevenCreative Studio
- Rilevamento del supporto video: Aggiunta la proprietà
has_videoalle risposte dei capitoli per indicare se i capitoli contengono contenuti video.
Workspace
-
Gruppi di account di servizio: Ora puoi aggiungere gli account di servizio ai gruppi del workspace per una migliore gestione delle autorizzazioni e del controllo degli accessi.
-
Autenticazione del workspace: Aggiunto il supporto per le connessioni di autenticazione del workspace, consentendo integrazioni sicure degli strumenti webhook con servizi esterni.
SDK
- SDK Python: Rilasciata la v2.6.0 con il supporto per le API più recenti e correzioni di bug.
- SDK JavaScript: Rilasciata la v2.5.0 con il supporto per le API più recenti e correzioni di bug.
- SDK React della piattaforma Agents: Aggiunto il supporto WebRTC nella 0.2.0
API
Visualizza le modifiche API
Nuovi endpoint
- Aggiunti 2 nuovi endpoint:
- Progetta una voce - Crea anteprime vocali da descrizioni testuali
- Crea una voce dall’anteprima - Trasforma le anteprime vocali in voci permanenti
Endpoint aggiornati
Speech to Text
- Converti parlato in testo - Aggiunto il parametro
diarization_thresholdper regolare con precisione la separazione dei parlanti
Gestione delle voci
- Ottieni l’audio del campione vocale - Aggiunto il parametro query
remove_background_noisee spostato dal body della richiesta ai parametri query