For AI agents: a documentation index is available at the root level at /llms.txt. Append /llms.txt to any URL for a page-level index, or .md for the markdown version of any page.
Supporto per il formato Opus: Aggiunto il supporto per il formato Opus con frequenza di campionamento di 48 kHz a più bitrate (32-192 kbps).
Gestione degli errori websocket migliorata: API websocket TTS aggiornata per restituire codici di errore più precisi (1011 per gli errori interni anziché 1008), migliorando l’identificazione degli errori e il monitoraggio degli SLA.
Piattaforma Agents
Chiamate in uscita Twilio: Aggiunta la possibilità di effettuare chiamate in uscita in modo nativo.
Override del webhook post-chiamata: Aggiunta la possibilità di sovrascrivere le impostazioni del webhook post-chiamata a livello di agente, per configurazioni più flessibili.
Visualizzazione di documenti di grandi dimensioni nella knowledge base: Interfaccia della knowledge base migliorata per consentire la visualizzazione dell’intero contenuto dei documenti RAG di grandi dimensioni.
Aggiunta variabile dinamica SID della chiamata: Aggiunto system__call_sid come variabile dinamica di sistema per consentire di fare riferimento all’ID della chiamata nei prompt e negli strumenti.
ElevenCreative Studio
Modalità Attore: Aggiunta la Modalità Attore in ElevenCreative Studio, che ti consente di usare le tue registrazioni vocali per definire il modo in cui deve suonare il parlato nei progetti di ElevenCreative Studio.
Scorciatoie da tastiera migliorate: Aggiornate le scorciatoie da tastiera per visualizzare le impostazioni e quelle dell’editor per evitare conflitti; inoltre, semplificate le scorciatoie per bloccare i paragrafi.
Doppiaggio
Duplicazione del doppiaggio: La funzionalità di duplicazione del doppiaggio è ora disponibile per tutti gli utenti.
Generazione in primo piano in modalità manuale: Aggiunta la possibilità di generare audio in primo piano quando usi la modalità manuale con un file e un CSV.
Voci
Raccolte di voci migliorate: Migliorate le raccolte di voci con aggiornamenti visivi, filtri in base alla lingua, breadcrumb di navigazione, immagini delle raccolte e trascinamento con il mouse per navigare nei caroselli.
Filtro per locale: Aggiunto il parametro locale all’endpoint delle voci condivise per un filtro delle voci più preciso.
API
Visualizza le modifiche alle API
Endpoint aggiornati
Text to Speech
Endpoint Text to Speech aggiornati:
Converti testo in parlato - Aggiunto il parametro apply_language_text_normalization per migliorare la pronuncia del testo nelle lingue supportate (attualmente il giapponese)
Ottieni voci condivise - Aggiunto il parametro locale per filtrare le voci in base alla regione linguistica
Doppiaggio
Endpoint Doppiaggio aggiornato:
Doppia un file video o audio - Per maggiore chiarezza, il parametro della funzionalità beta use_replacement_voices_from_library è stato rinominato in disable_voice_cloning