For AI agents: a documentation index is available at the root level at /llms.txt. Append /llms.txt to any URL for a page-level index, or .md for the markdown version of any page.
Chiamate parallele degli strumenti: La configurazione del prompt dell’agente ora include enable_parallel_tool_calls (booleano, predefinito true). Se abilitato, i modelli supportati possono eseguire più strumenti in un unico turno.
Modelli degli agenti: Aggiunto gpt-6-astra alle opzioni LLM dell’agente.
Avvisi: Gli avvisi degli agenti ora supportano i canali Slack insieme ai notificatori PagerDuty e webhook.
Ricerca dei numeri di telefono: Aggiunto un endpoint dei numeri di telefono con paginazione basata su cursore e filtri per provider, supporto in uscita, agente e ramo assegnati, etichetta e numero di telefono.
Immagini e video
Modelli GPT Image 2.5: La generazione di immagini ora supporta gpt-image-2.5-flare e gpt-image-2.5-sunburst. Entrambi i modelli accettano fino a 10 immagini di riferimento, livelli di qualità fino a max, 14 rapporti d’aspetto fissi più auto e output 1K, 2K o 4K.
Speech Engine
Timeout a cascata: Le richieste di creazione e aggiornamento di Speech Engine ora accettano cascade_timeout_seconds (numero, 2–15, predefinito 4) per controllare quanto tempo ElevenLabs attende un motore vocale upstream prima di riprovare.
Text to Speech
Confini di turno multi-contesto: Il marcatore is_final_audio_for_turn ora viene emesso dopo ogni byte nel buffer per quel turno, inclusi gli output MP3 e Opus. I client possono usare il marcatore come confine esatto del turno senza passare a PCM.
Rilasci SDK
SDK JavaScript
v2.69.0 - Aggiunto transcriptEdit al wrapper Speech to Text in tempo reale, con testo modificato fornito tramite eventi edited_transcript. Corretta la verifica JWT di Speech Engine per le chiavi API con suffissi di residenza dei dati. Aggiunti phoneNumbers.listV2 e metodi per i template Flows per elencare e ottenere template, nonché elencare, creare e ottenere esecuzioni. Rigenerati client e tipi per GPT Image 2.5, avvisi degli agenti su Slack, chiamate parallele degli strumenti, gpt-6-astra, limiti di concorrenza delle chiavi API degli account di servizio, conservazione zero per Music, filtri delle conversazioni e stati di approvazione degli strumenti MCP.
SDK Python
v2.69.0 - Aggiunto transcript_edit al wrapper Speech to Text in tempo reale, con testo modificato fornito tramite eventi edited_transcript. Corretta la verifica JWT di Speech Engine per le chiavi API con suffissi di residenza dei dati e fatto in modo che play generi un errore quando ffplay non riesce. Aggiunti phone_numbers.list_v2 e metodi per i template Flows per elencare e ottenere template, nonché elencare, creare e ottenere esecuzioni. Rigenerati client e tipi per GPT Image 2.5, avvisi degli agenti su Slack, chiamate parallele degli strumenti, gpt-6-astra, limiti di concorrenza delle chiavi API degli account di servizio, conservazione zero per Music, filtri delle conversazioni e stati di approvazione degli strumenti MCP.
CLI ElevenLabs
v1.3.2 - Aggiunti metadati facoltativi --intent per raccogliere feedback sull’uso della CLI. Aggiunto elevenlabs feedback missing-capability per segnalare workflow non supportati dalla CLI.
Aggiunti i parametri di paginazione page_size facoltativo (intero, 1–1.000, predefinito 100) e cursor (stringa nullable).
Aggiunti i filtri facoltativi search, label, phone_number, provider, supports_outbound, agent_id, branch_id, sort_by e sort_direction. sort_by accetta label o phone_number; sort_direction è predefinito su asc.
La risposta contiene phone_numbers obbligatorio (array), next_cursor facoltativo e nullable (stringa) e has_more (booleano, predefinito false).
La configurazione del prompt aggiunge enable_parallel_tool_calls (booleano, predefinito true). Gli override del workflow accettano un booleano nullable.
L’enum LLM aggiunge gpt-6-astra, inclusi gli override per l’avvio della conversazione.
I notificatori dell’integrazione di avvisi ora usano integration_type per selezionare pagerduty o slack. I notificatori Slack richiedono connection_id e channel_id (stringhe); channel_id accetta da 1 a 64 caratteri.
Aggiunto cascade_timeout_seconds (numero, 2–15). Le richieste di creazione sono predefinite su 4, quelle di aggiornamento accettano un valore nullable e le risposte richiedono il campo.
I messaggi WebSocket audio e final multi-contesto ora definiscono is_final_audio_for_turn come emesso dopo che tutti i byte nel buffer del turno sono stati forniti.