Vai alla navigazione

Presentazione di Music v2

Music v2 è ora disponibile tramite l’API ElevenLabs. Imposta model_id su music_v2 in Genera musica, Trasmetti musica, Genera musica dettagliata e Carica musica per usare il nuovo modello. Music v2 introduce piani di composizione basati su chunk, creati da segmenti GenerationChunk e AudioRefChunk, offrendoti un controllo più preciso su struttura, ritmo e arrangiamento rispetto al flusso music_v1 basato su prompt.

Usa i piani di composizione music_v2 nelle richieste di generazione e caricamento, oppure genera prima un piano tramite l’endpoint dei piani di composizione. I body delle richieste e delle risposte accettano formati di piano v1 o v2, così puoi eseguire la migrazione endpoint per endpoint. MusicPrompt rimane disponibile solo per music_v1.

  • Timestamp di caricamento: Carica musica accetta with_timestamps facoltativo; le risposte possono includere words_timestamps.

ElevenAgents

  • Esegui valutazione della conversazione: aggiunto l’endpoint Esegui valutazione della conversazione (POST /v1/convai/conversations/{conversation_id}/analysis/evaluations/run) per rieseguire un singolo criterio di valutazione su una conversazione completata usando RunConversationEvaluationsRequest.
  • Comportamento di ingresso nel workflow: i nodi del workflow che sovrascrivono l’agente aggiungono entry_behavior facoltativo (generate_immediately, wait_for_user, auto) per controllare se il sottoagente parla per primo o attende l’input dell’utente.
  • Strumento di sistema per terminare la procedura: aggiunta la configurazione dello strumento di sistema end_procedure con stati di errore corrispondenti. Lo strumento start_procedure aggiunge already_active ai propri stati di errore.
  • Override TTS per trasferimento: AgentTransfer, i nodi agente autonomi del workflow e i risultati riusciti dello strumento transfer_to_agent aggiungono preserve_client_tts_overrides facoltativo (booleano) per mantenere gli override TTS lato client dopo un trasferimento.
  • Enum del budget di interazione: InteractionBudget rimuove async e aggiunge 5_minutes, 10_minutes e 1_hour. Aggiorna tutte le configurazioni o gli enum SDK che fanno ancora riferimento a async.
  • Selezione del modello di guardrail personalizzato: la configurazione dei guardrail personalizzati aggiunge model facoltativo con varianti Gemini, Claude e GPT. La configurazione dei guardrail aggiunge anche history_message_count facoltativo (intero).
  • Filtri dell’elenco di numeri telefonici: Elenca numeri telefonici aggiunge i parametri query facoltativi provider, agent_id e branch_id per filtrare i numeri importati.
  • Filtraggio degli account WhatsApp: Elenca account WhatsApp aggiunge il parametro query facoltativo agent_id per filtrare gli account in base all’agente assegnato.
  • Filtri per intervallo temporale degli argomenti: Ottieni argomenti delle conversazioni dell’agente aggiunge i parametri query facoltativi from_unix_secs e to_unix_secs per delimitare i risultati del rilevamento degli argomenti.
  • Configurazione dei codec SIP: i modelli di richiesta e risposta dei trunk SIP in uscita aggiungono enabled_codecs facoltativo (enum MediaCodec).
  • Tipi di strumenti per la memoria: aggiunti gli schemi LoadableMemoryEntry e LoadMemoryEntryToolErrorStatus per la gestione degli errori degli strumenti per la memoria.
  • Limiti per batch di test degli agenti: gli schemi delle richieste di collegamento, esecuzione e reinvio dei test degli agenti aumentano il massimo di test collegati da 1000 a 5000.
  • Supporto dei tag fonema: le impostazioni TTS degli agenti aggiungono enable_phoneme_tags facoltativo (booleano) per la gestione opzionale dei fonemi SSML V3.
  • Override di omissione dello schema degli array: le proprietà dello schema JSON degli array aggiungono is_omitted facoltativo (mutuamente esclusivo con altre origini di valore). ConstantSchemaOverride può usare valori costanti di tipo array.
  • Contesto degli errori di trasferimento: i payload di errore del trasferimento a un numero possono includere agent_message facoltativo (stringa).

Workspace

  • Aggiornamenti delle chiavi API degli account di servizio: Aggiorna chiave API dell’account di servizio non richiede più un body della richiesta. I campi modificabili supportano aggiornamenti parziali tramite no_update e name nullable, inclusi permissions e character_limit.
  • Raggruppamento per fuso orario dell’utilizzo: le richieste di utilizzo del workspace per prodotto nel tempo aggiungono time_zone facoltativo (stringa di fuso orario IANA) con regole chiarite per i bucket interval_seconds.
  • Filtro dell’origine della cronologia: i filtri source per l’elenco e i dettagli della cronologia aggiungono Flows.

ElevenCreative Studio

  • Riferimenti vocali del progetto: i modelli dei progetti, i nodi TTS dei capitoli, gli elenchi vocali e le statistiche vocali passano a project_voice_ref_id come campo vocale canonico. I precedenti campi voice_id restano nelle risposte come mirror di sola lettura deprecati per compatibilità.

Speech to Text

  • Diarizzazione della libreria di speaker: Converti parlato in testo aggiunge use_speaker_library facoltativo (booleano, valore predefinito false) per la diarizzazione delle trascrizioni batch.

Voci

  • Ordinamento delle voci condivise: il parametro query sort di Elenca voci condivise ottiene un enum esplicito, il valore predefinito created_date e una descrizione aggiornata.

Release SDK

SDK JavaScript

  • v2.53.0 - Rigenerato dallo schema OpenAPI più recente con supporto per la riesecuzione della valutazione delle conversazioni, union dei piani di composizione Music v2, entry_behavior del workflow, filtri per elenchi di numeri telefonici e WhatsApp, parametri per intervalli temporali degli argomenti, aggiornamenti dello schema di avviso, campi project_voice_ref_id di Studio e limiti ampliati per i batch di test degli agenti.

SDK Python

  • v2.53.0 - Rigenerato dallo schema OpenAPI più recente con supporto per la riesecuzione della valutazione delle conversazioni, piani di composizione Music v2, comportamento di ingresso del workflow e strumenti per terminare le procedure, parametri di filtro per la telefonia, modelli di aggiornamento parziale per avvisi e account di servizio e campi di riferimento vocale di Studio.

Pacchetti

SDK iOS

  • v3.2.1 - Aggiunto il supporto per la residenza dei dati a Singapore e abilitato singlePeerConnection per le sessioni WebRTC.

API

Nuovi endpoint

ElevenAgents

  • Esegui valutazione della conversazione - POST /v1/convai/conversations/{conversation_id}/analysis/evaluations/run
    • Il body della richiesta usa RunConversationEvaluationsRequest per rieseguire un singolo criterio di valutazione

Endpoint aggiornati

ElevenAgents

Musica

Speech to Text

  • Converti parlato in testo - POST /v1/speech-to-text
    • Aggiunto il parametro query facoltativo use_speaker_library (booleano, valore predefinito false)

Voci

  • Elenca voci condivise - GET /v1/shared-voices
    • Il parametro query sort ora usa un enum esplicito con valore predefinito created_date

Modifiche agli schemi

ElevenAgents

  • Nodi del workflow che sovrascrivono l’agente
    • Aggiunto enum entry_behavior facoltativo (generate_immediately, wait_for_user, auto)
  • Strumenti di sistema
    • Aggiunta configurazione dello strumento end_procedure e relativi stati di errore
  • Schemi di trasferimento e interazione
    • Aggiunto preserve_client_tts_overrides facoltativo nei trasferimenti e nei risultati degli strumenti di trasferimento
    • InteractionBudget rimuove async; aggiunge 5_minutes, 10_minutes, 1_hour
  • Guardrail e TTS
    • I guardrail personalizzati aggiungono model e history_message_count facoltativi
    • Le impostazioni TTS degli agenti aggiungono enable_phoneme_tags facoltativo
  • Telefonia
    • I modelli dei trunk SIP aggiungono enabled_codecs facoltativo (enum MediaCodec)
  • Strumenti per memoria e codice
    • Aggiunti LoadableMemoryEntry e LoadMemoryEntryToolErrorStatus
  • Test degli agenti
    • Aumentati i limiti dei test collegati da 1000 a 5000 nelle richieste di esecuzione e reinvio
  • Proprietà dello schema JSON degli strumenti
    • Le proprietà degli array aggiungono is_omitted facoltativo

Workspace

  • Account di servizio
    • PATCH della chiave API supporta aggiornamenti parziali con sentinelle no_update
  • Utilizzo e cronologia
    • L’utilizzo per prodotto nel tempo aggiunge time_zone facoltativo
    • I filtri source della cronologia aggiungono Flows

Musica

  • Piani di composizione
    • Aggiunti CompositionPlan, GenerationChunk e AudioRefChunk basati su chunk per music_v2
    • I body delle richieste e delle risposte accettano formati di piano v1 o v2 con anyOf

ElevenCreative Studio

  • Modelli vocali del progetto
    • Aggiunto project_voice_ref_id come riferimento vocale canonico
    • I mirror voice_id deprecati di sola lettura vengono mantenuti nelle risposte