Vai alla navigazione

Text to Speech

  • Supporto per il formato Opus: Aggiunto il supporto per il formato Opus con frequenza di campionamento di 48 kHz a più bitrate (32-192 kbps).
  • Gestione degli errori websocket migliorata: API websocket TTS aggiornata per restituire codici di errore più precisi (1011 per gli errori interni anziché 1008), migliorando l’identificazione degli errori e il monitoraggio degli SLA.

Piattaforma Agents

  • Chiamate in uscita Twilio: Aggiunta la possibilità di effettuare chiamate in uscita in modo nativo.
  • Override del webhook post-chiamata: Aggiunta la possibilità di sovrascrivere le impostazioni del webhook post-chiamata a livello di agente, per configurazioni più flessibili.
  • Visualizzazione di documenti di grandi dimensioni nella knowledge base: Interfaccia della knowledge base migliorata per consentire la visualizzazione dell’intero contenuto dei documenti RAG di grandi dimensioni.
  • Aggiunta variabile dinamica SID della chiamata: Aggiunto system__call_sid come variabile dinamica di sistema per consentire di fare riferimento all’ID della chiamata nei prompt e negli strumenti.

ElevenCreative Studio

  • Modalità Attore: Aggiunta la Modalità Attore in ElevenCreative Studio, che ti consente di usare le tue registrazioni vocali per definire il modo in cui deve suonare il parlato nei progetti di ElevenCreative Studio.
  • Scorciatoie da tastiera migliorate: Aggiornate le scorciatoie da tastiera per visualizzare le impostazioni e quelle dell’editor per evitare conflitti; inoltre, semplificate le scorciatoie per bloccare i paragrafi.

Doppiaggio

  • Duplicazione del doppiaggio: La funzionalità di duplicazione del doppiaggio è ora disponibile per tutti gli utenti.
  • Generazione in primo piano in modalità manuale: Aggiunta la possibilità di generare audio in primo piano quando usi la modalità manuale con un file e un CSV.

Voci

  • Raccolte di voci migliorate: Migliorate le raccolte di voci con aggiornamenti visivi, filtri in base alla lingua, breadcrumb di navigazione, immagini delle raccolte e trascinamento con il mouse per navigare nei caroselli.
  • Filtro per locale: Aggiunto il parametro locale all’endpoint delle voci condivise per un filtro delle voci più preciso.

API

Endpoint aggiornati

Text to Speech

Formato audio

Piattaforma Agents

Voci

  • Endpoint Voice aggiornati:

Doppiaggio

  • Endpoint Doppiaggio aggiornato:
    • Doppia un file video o audio - Per maggiore chiarezza, il parametro della funzionalità beta use_replacement_voices_from_library è stato rinominato in disable_voice_cloning