Vai alla navigazione

Doppiaggio

  • Formato di trascrizione JSON: Aggiunto il supporto per trascrizioni in formato JSON nell’endpoint GET /v1/dubbing/{dubbing_id}/transcript/{language_code}, che restituisce dati dettagliati sulla tempistica a livello di parola e carattere tramite DubbingTranscriptResponseModel.

Piattaforma Agents

  • Supporto per GPT-5.1: Aggiunto il supporto per i modelli LLM gpt-5.1 e gpt-5.1-2025-11-13 nelle configurazioni degli agenti.
  • Controllo dello sforzo di ragionamento: Aggiunta l’opzione none a LLMReasoningEffort per un maggiore controllo sul comportamento di ragionamento del modello.
  • Eventi delle richieste di strumenti dell’agente: Aggiunto agent_tool_request a ClientEvent per un migliore tracciamento delle interazioni con gli strumenti nelle conversazioni in tempo reale.
  • DTMF fuori banda: Aggiunto il flag use_out_of_band_dtmf a PlayDTMFToolConfig per migliorare l’integrazione con la telefonia.
  • Aggiunte di modelli LLM: Esteso l’enum LLM con gemini-3-pro-preview per funzionalità di IA conversazionale migliorate.

Speech to Text

  • Eventi di quota Scribe superata: Aggiunti l’evento quota_exceeded negli SDK e il parametro include_timestamps per una migliore gestione delle quote e controllo dei timestamp.

ElevenCreative Studio

  • Tracciamento delle voci nei capitoli: Aggiunto il campo voice_ids ai modelli di risposta dei capitoli per una migliore gestione delle voci nei progetti multivoce.
  • Risorse immagine dei progetti: Introdotto ProjectImageResponseModel per supportare le risorse immagine, ora incluso in ProjectResponseModel.assets.
  • Campo delle voci di base: Aggiunto il campo base_voices a ProjectResponseModel per migliorare la gestione delle voci.

Text to Speech

  • Controllo della normalizzazione del testo: Aggiunti l’enum TextNormalisationType e il campo text_normalisation_type nelle impostazioni vocali TTS, per un controllo preciso dell’elaborazione del testo.
  • Token WebSocket TTS: Esteso SingleUseTokenType con tts_websocket per un’autenticazione WebSocket sicura.

Rilasci SDK

SDK JavaScript

  • v2.25.0 - Aggiornato con le ultime modifiche allo schema API, comprese le trascrizioni di doppiaggio JSON e il supporto per GPT-5.1
  • v2.24.1 - Aggiunto il parametro include_timestamps all’API Scribe per controllare i timestamp nelle trascrizioni

SDK Python

  • v2.24.0 - Aggiornato con le ultime modifiche allo schema API, comprese le trascrizioni di doppiaggio JSON e il supporto per GPT-5.1
  • v2.23.0 - Aggiunti il parametro include_timestamps e l’evento quota_exceeded all’API Scribe per una migliore gestione delle quote

Pacchetti

  • @elevenlabs/react@0.11.0 - Aggiunti l’evento quota_exceeded e il parametro include_timestamps per l’integrazione con Scribe
  • @elevenlabs/client@0.11.0 - Aggiunti l’evento quota_exceeded e il parametro include_timestamps per l’integrazione con Scribe

API

Endpoint aggiornati

Doppiaggio

  • GET /v1/dubbing/{dubbing_id}/transcript/{language_code}
    • Il parametro path language ora accetta il valore 'original'
    • Il parametro query format_type ora supporta 'json' (oltre a srt e webvtt)
    • La risposta 200 ora include il media type application/json, che restituisce DubbingTranscriptResponseModel con:
      • DubbingTranscriptUtterance - Dati a livello di enunciato
      • DubbingTranscriptWord - Tempistica a livello di parola
      • DubbingTranscriptCharacter - Tempistica a livello di carattere
  • Aggiunto l’enum DubbingModel con i valori dubbing_v2 e dubbing_v3

Piattaforma Agents

  • Invia chiamate batch
    • Schema del body della richiesta aggiornato (retrocompatibile)
    • Schema della risposta aggiornato (retrocompatibile)
  • Ottieni lo stato delle chiamate batch
    • Schema della risposta aggiornato (retrocompatibile)
  • Annulla chiamate batch
    • Schema della risposta aggiornato (retrocompatibile)
  • Riprova le chiamate batch
    • Schema della risposta aggiornato (retrocompatibile)
  • Ottieni le impostazioni dell’agente
    • Schema della risposta aggiornato (retrocompatibile)
  • Aggiorna le impostazioni dell’agente
    • Schemi della richiesta e della risposta aggiornati (retrocompatibili)
  • Crea agente
    • Schema della richiesta aggiornato con una struttura delle guardrail migliorata (modifica non retrocompatibile: guardrails semplificato in riferimento diretto, con rimozione di oneOf)
  • Ottieni l’agente
    • Schema della risposta aggiornato (modifica non retrocompatibile: rimossi i campi version_id e branch_id protetti da feature flag)
  • Aggiorna l’agente
    • Schema della risposta aggiornato (modifica non retrocompatibile: rimossi i campi version_id e branch_id protetti da feature flag)
  • Simula conversazione
    • Schema della richiesta aggiornato (retrocompatibile)
  • Simula stream di conversazione
    • Schema della richiesta aggiornato (retrocompatibile)
  • Ottieni la conversazione
    • Schema della risposta aggiornato (retrocompatibile)
  • Eventi client aggiornati:
    • Aggiunto il tipo di evento agent_tool_request
  • Configurazioni degli strumenti aggiornate:
    • Aggiunto use_out_of_band_dtmf a PlayDTMFToolConfig
    • Rimossi gli schemi ApiIntegrationWebhookToolConfigExternal-* e le relative mappature del discriminatore

Text to Speech

Gestione delle voci

ElevenCreative Studio

  • Ottieni il progetto
    • Schema della risposta aggiornato (retrocompatibile)
    • Aggiunto il campo assets con supporto per le immagini
    • Aggiunto il campo base_voices
  • Aggiungi capitolo
    • Schema della risposta aggiornato (retrocompatibile)
    • Aggiunto il campo voice_ids
  • Ottieni il capitolo
    • Schema della risposta aggiornato (retrocompatibile)
    • Aggiunto il campo voice_ids
  • Aggiorna il capitolo
    • Schema della risposta aggiornato (retrocompatibile)
    • Aggiunto il campo voice_ids

Musica

Altri aggiornamenti

Funzionalità rimosse

  • Rimosse le opzioni deprecate eleven_expressive e expressive dagli enum TTS