Vai alla navigazione

ElevenAgents

  • Chiamate parallele degli strumenti: La configurazione del prompt dell’agente ora include enable_parallel_tool_calls (booleano, predefinito true). Se abilitato, i modelli supportati possono eseguire più strumenti in un unico turno.
  • Modelli degli agenti: Aggiunto gpt-6-astra alle opzioni LLM dell’agente.
  • Avvisi: Gli avvisi degli agenti ora supportano i canali Slack insieme ai notificatori PagerDuty e webhook.
  • Ricerca dei numeri di telefono: Aggiunto un endpoint dei numeri di telefono con paginazione basata su cursore e filtri per provider, supporto in uscita, agente e ramo assegnati, etichetta e numero di telefono.

Immagini e video

  • Modelli GPT Image 2.5: La generazione di immagini ora supporta gpt-image-2.5-flare e gpt-image-2.5-sunburst. Entrambi i modelli accettano fino a 10 immagini di riferimento, livelli di qualità fino a max, 14 rapporti d’aspetto fissi più auto e output 1K, 2K o 4K.

Speech Engine

  • Timeout a cascata: Le richieste di creazione e aggiornamento di Speech Engine ora accettano cascade_timeout_seconds (numero, 2–15, predefinito 4) per controllare quanto tempo ElevenLabs attende un motore vocale upstream prima di riprovare.

Text to Speech

  • Confini di turno multi-contesto: Il marcatore is_final_audio_for_turn ora viene emesso dopo ogni byte nel buffer per quel turno, inclusi gli output MP3 e Opus. I client possono usare il marcatore come confine esatto del turno senza passare a PCM.

Rilasci SDK

SDK JavaScript

  • v2.69.0 - Aggiunto transcriptEdit al wrapper Speech to Text in tempo reale, con testo modificato fornito tramite eventi edited_transcript. Corretta la verifica JWT di Speech Engine per le chiavi API con suffissi di residenza dei dati. Aggiunti phoneNumbers.listV2 e metodi per i template Flows per elencare e ottenere template, nonché elencare, creare e ottenere esecuzioni. Rigenerati client e tipi per GPT Image 2.5, avvisi degli agenti su Slack, chiamate parallele degli strumenti, gpt-6-astra, limiti di concorrenza delle chiavi API degli account di servizio, conservazione zero per Music, filtri delle conversazioni e stati di approvazione degli strumenti MCP.

SDK Python

  • v2.69.0 - Aggiunto transcript_edit al wrapper Speech to Text in tempo reale, con testo modificato fornito tramite eventi edited_transcript. Corretta la verifica JWT di Speech Engine per le chiavi API con suffissi di residenza dei dati e fatto in modo che play generi un errore quando ffplay non riesce. Aggiunti phone_numbers.list_v2 e metodi per i template Flows per elencare e ottenere template, nonché elencare, creare e ottenere esecuzioni. Rigenerati client e tipi per GPT Image 2.5, avvisi degli agenti su Slack, chiamate parallele degli strumenti, gpt-6-astra, limiti di concorrenza delle chiavi API degli account di servizio, conservazione zero per Music, filtri delle conversazioni e stati di approvazione degli strumenti MCP.

CLI ElevenLabs

  • v1.3.2 - Aggiunti metadati facoltativi --intent per raccogliere feedback sull’uso della CLI. Aggiunto elevenlabs feedback missing-capability per segnalare workflow non supportati dalla CLI.

API

Nuovi endpoint

ElevenAgents

  • Elenca pagina dei numeri di telefono - GET /v1/convai/v2/phone-numbers
    • Aggiunti i parametri di paginazione page_size facoltativo (intero, 1–1.000, predefinito 100) e cursor (stringa nullable).
    • Aggiunti i filtri facoltativi search, label, phone_number, provider, supports_outbound, agent_id, branch_id, sort_by e sort_direction. sort_by accetta label o phone_number; sort_direction è predefinito su asc.
    • La risposta contiene phone_numbers obbligatorio (array), next_cursor facoltativo e nullable (stringa) e has_more (booleano, predefinito false).

Endpoint aggiornati

ElevenAgents

  • Crea agente, Ottieni agente e Aggiorna agente
    • La configurazione del prompt aggiunge enable_parallel_tool_calls (booleano, predefinito true). Gli override del workflow accettano un booleano nullable.
    • L’enum LLM aggiunge gpt-6-astra, inclusi gli override per l’avvio della conversazione.
    • I notificatori dell’integrazione di avvisi ora usano integration_type per selezionare pagerduty o slack. I notificatori Slack richiedono connection_id e channel_id (stringhe); channel_id accetta da 1 a 64 caratteri.
  • Elenca conversazioni e Risolvi riferimento conversazione
    • data_collection_params non accetta più l’operatore missing. Usa un valore vuoto per trovare le conversazioni in cui il campo non è stato raccolto.
    • Un valore vuoto in dynamic_variable_params trova le conversazioni in cui la variabile non è stata impostata.
  • Crea Speech Engine, Ottieni Speech Engine e Aggiorna Speech Engine
    • Aggiunto cascade_timeout_seconds (numero, 2–15). Le richieste di creazione sono predefinite su 4, quelle di aggiornamento accettano un valore nullable e le risposte richiedono il campo.

Immagini e video

  • Crea generazione di immagini - POST /v1/flows/image
    • Aggiunte varianti della richiesta per gpt-image-2.5-flare e gpt-image-2.5-sunburst.
    • Entrambe le varianti richiedono prompt e model_id, accettano fino a 10 images e aggiungono resolution (1K, 2K o 4K, predefinito 1K).
    • quality accetta low, medium, high, xhigh o max ed è predefinito su high. aspect_ratio accetta auto e 14 rapporti fissi ed è predefinito su 16:9.

Doppiaggio

Knowledge base

  • Crea job di crawling - POST /v1/convai/knowledge-base/crawl
    • Deprecato max_depth (intero, predefinito 3). Il campo ora non ha effetto e non presenta più vincoli minimi o massimi.
    • I metadati del job di crawling non richiedono più max_depth.

Utente

Modifiche allo schema

Text to Speech

  • I messaggi WebSocket audio e final multi-contesto ora definiscono is_final_audio_for_turn come emesso dopo che tutti i byte nel buffer del turno sono stati forniti.