Doublage

  • Format de transcription JSON : ajout de la prise en charge des transcriptions au format JSON dans le point de terminaison GET /v1/dubbing/{dubbing_id}/transcript/{language_code}, qui renvoie des données détaillées de minutage au niveau des mots et des caractères via DubbingTranscriptResponseModel.

Plateforme Agents

  • Prise en charge de GPT-5.1 : ajout de la prise en charge des modèles LLM gpt-5.1 et gpt-5.1-2025-11-13 dans les configurations d’agents.
  • Contrôle de l’effort de raisonnement : ajout de l’option none à LLMReasoningEffort pour mieux contrôler le comportement de raisonnement du modèle.
  • Événements de requête d’outil d’agent : ajout de agent_tool_request à ClientEvent pour mieux suivre les interactions avec les outils dans les conversations en temps réel.
  • DTMF hors bande : ajout de l’indicateur use_out_of_band_dtmf à PlayDTMFToolConfig pour améliorer l’intégration téléphonique.
  • Ajouts de modèles LLM : extension de l’énumération LLM avec gemini-3-pro-preview afin d’améliorer les capacités d’IA conversationnelle.

Speech to Text

  • Événements de dépassement de quota Scribe : ajout de l’événement quota_exceeded dans les SDK et du paramètre include_timestamps pour mieux gérer les quotas et les horodatages.

ElevenCreative Studio

  • Suivi des voix par chapitre : ajout du champ voice_ids aux modèles de réponse de chapitre pour mieux gérer les voix dans les projets à plusieurs voix.
  • Ressources image des projets : introduction de ProjectImageResponseModel pour la prise en charge des ressources image, désormais incluses dans ProjectResponseModel.assets.
  • Champ de voix de base : ajout du champ base_voices à ProjectResponseModel pour améliorer la gestion des voix.

Text to Speech

  • Contrôle de la normalisation du texte : ajout de l’énumération TextNormalisationType et du champ text_normalisation_type dans les paramètres de voix TTS afin de contrôler finement le traitement du texte.
  • Jetons WebSocket TTS : extension de SingleUseTokenType avec tts_websocket pour une authentification WebSocket sécurisée.

Versions des SDK

SDK JavaScript

  • v2.25.0 - Mise à jour avec les dernières modifications du schéma d’API, notamment les transcriptions de doublage JSON et la prise en charge de GPT-5.1
  • v2.24.1 - Ajout du paramètre include_timestamps à l’API Scribe pour contrôler les horodatages dans les transcriptions

SDK Python

  • v2.24.0 - Mise à jour avec les dernières modifications du schéma d’API, notamment les transcriptions de doublage JSON et la prise en charge de GPT-5.1
  • v2.23.0 - Ajout du paramètre include_timestamps et de l’événement quota_exceeded à l’API Scribe pour mieux gérer les quotas

Packages

  • @elevenlabs/react@0.11.0 - Ajout de l’événement quota_exceeded et du paramètre include_timestamps pour l’intégration de Scribe
  • @elevenlabs/client@0.11.0 - Ajout de l’événement quota_exceeded et du paramètre include_timestamps pour l’intégration de Scribe

API

Points de terminaison mis à jour

Doublage

  • GET /v1/dubbing/{dubbing_id}/transcript/{language_code}
    • Le paramètre de chemin language accepte désormais la valeur 'original'
    • Le paramètre de requête format_type prend désormais en charge 'json' (en plus de srt et webvtt)
    • La réponse 200 inclut désormais le type de média application/json, renvoyant DubbingTranscriptResponseModel avec :
      • DubbingTranscriptUtterance - Données au niveau de l’énoncé
      • DubbingTranscriptWord - Minutage au niveau du mot
      • DubbingTranscriptCharacter - Minutage au niveau du caractère
  • Ajout de l’énumération DubbingModel avec les valeurs dubbing_v2 et dubbing_v3

Plateforme Agents

  • Envoyer des appels par lot
    • Schéma du corps de requête mis à jour (rétrocompatible)
    • Schéma de réponse mis à jour (rétrocompatible)
  • Obtenir le statut des appels par lot
    • Schéma de réponse mis à jour (rétrocompatible)
  • Annuler les appels par lot
    • Schéma de réponse mis à jour (rétrocompatible)
  • Relancer les appels par lot
    • Schéma de réponse mis à jour (rétrocompatible)
  • Obtenir les paramètres de l’agent
    • Schéma de réponse mis à jour (rétrocompatible)
  • Mettre à jour les paramètres de l’agent
    • Schémas de requête et de réponse mis à jour (rétrocompatibles)
  • Créer un agent
    • Schéma de requête mis à jour avec une structure de garde-fous améliorée (changement non rétrocompatible : simplification de guardrails en référence directe, suppression de oneOf)
  • Obtenir l’agent
    • Schéma de réponse mis à jour (changement non rétrocompatible : suppression des champs version_id et branch_id activés par indicateur de fonctionnalité)
  • Mettre à jour l’agent
    • Schéma de réponse mis à jour (changement non rétrocompatible : suppression des champs version_id et branch_id activés par indicateur de fonctionnalité)
  • Simuler une conversation
    • Schéma de requête mis à jour (rétrocompatible)
  • Simuler un flux de conversation
    • Schéma de requête mis à jour (rétrocompatible)
  • Obtenir une conversation
    • Schéma de réponse mis à jour (rétrocompatible)
  • Événements client mis à jour :
    • Ajout du type d’événement agent_tool_request
  • Configurations d’outils mises à jour :
    • Ajout de use_out_of_band_dtmf à PlayDTMFToolConfig
    • Suppression des schémas ApiIntegrationWebhookToolConfigExternal-* et de leurs mappages de discriminateurs

Text to Speech

Gestion des voix

ElevenCreative Studio

  • Obtenir un projet
    • Schéma de réponse mis à jour (rétrocompatible)
    • Ajout du champ assets avec prise en charge des images
    • Ajout du champ base_voices
  • Ajouter un chapitre
    • Schéma de réponse mis à jour (rétrocompatible)
    • Ajout du champ voice_ids
  • Obtenir un chapitre
    • Schéma de réponse mis à jour (rétrocompatible)
    • Ajout du champ voice_ids
  • Mettre à jour un chapitre
    • Schéma de réponse mis à jour (rétrocompatible)
    • Ajout du champ voice_ids

Musique

Autres mises à jour

Fonctionnalités supprimées

  • Suppression des options obsolètes eleven_expressive et expressive des énumérations TTS