Eleven v4 et Eleven v4 Turbo
Eleven v4 et Eleven v4 Turbo sont désormais disponibles. Eleven v4 offre une synthèse vocale de meilleure qualité et plus expressive, ainsi qu’un clonage de voix amélioré dans plus de 90 langues. Eleven v4 Turbo propose la même famille de modèles pour les applications en temps réel, avec une latence d’inférence médiane d’environ 100 ms.
Utilisez eleven_v4 via l’API Text to Dialogue pour la création de contenu et les contenus audio longs. Utilisez eleven_v4_turbo via le WebSocket Text to Dialogue pour les agents et les applications interactives.
Speech to Text
- Modification des transcriptions : la transcription par lot et en temps réel accepte désormais une instruction de modification en langage naturel pouvant contenir jusqu’à 2 000 caractères. Les réponses par lot renvoient le résultat dans
edited_transcript, tandis que les sessions en temps réel émettent un événementedited_transcript. Consultez les guides par lot et en temps réel pour connaître les incompatibilités, la gestion des réponses et la tarification.
ElevenAgents
- Modèles d’agent : ajout de
gpt-6-sol,gpt-6-luna,glm-52,deepseek-v41-flash,claude-opus-5etclaude-opus-5-5aux options de LLM d’agent prises en charge. - Utilisation des tests d’agent : les résumés d’invocation de test peuvent inclure le total de crédits et le prix en USD. Les exécutions de test individuelles peuvent inclure les crédits et le détail de la facturation.
Flows
- API de modèles : ajout de points de terminaison pour lister et récupérer les modèles Flows publiés, démarrer des exécutions de modèles et récupérer les résultats d’exécution. Les exécutions peuvent cibler une version publiée et envoyer leur résultat final à un webhook configuré.
Text to Dialogue
- Continuité de génération : les requêtes Text to Dialogue peuvent utiliser du texte précédent ou suivant et des identifiants de requête afin de maintenir la continuité entre les générations.
- Mode voix professionnelle : les requêtes Text to Dialogue peuvent utiliser la version Instant Voice Clone d’un Professional Voice Clone afin de réduire la latence ou d’améliorer l’expressivité.
Versions des SDK
SDK JavaScript
- v2.70.0 - Ajout des types de modification de transcription Speech to Text par lot et en temps réel, du filtrage
branchIdet des champs de coût pour les résumés d’invocation de test, de la découverte automatique de la base de connaissances, deusePvcAsIvcpour Text to Dialogue et du modèle d’agentdeepseek-v41-flash.
SDK Python
- v2.70.0 - Ajout des types de modification de transcription Speech to Text par lot et en temps réel, du filtrage
branch_idet des champs de coût pour les résumés d’invocation de test, de la découverte automatique de la base de connaissances, deuse_pvc_as_ivcpour Text to Dialogue et du modèle d’agentdeepseek-v41-flash.
CLI ElevenLabs
- v1.4.0 - Correction des requêtes utilisant une clé API explicite afin qu’elles n’envoient plus également les identifiants OAuth enregistrés, ce qui provoquait des échecs d’authentification. Ajout de descriptions pour le groupe de commandes de commentaires et d’instructions permettant de signaler les capacités manquantes aux compétences d’agent générées. Régénération du client API avec les points de terminaison de modèles Flows et les types de schéma actuels.
API
Voir les modifications de l’API
Nouveaux points de terminaison
Flows
- Lister les modèles -
GET /v1/flows/templates- Liste les modèles publiés et leurs versions exécutables. - Obtenir un modèle -
GET /v1/flows/templates/{template_id}- Récupère un modèle et ses versions exécutables. - Créer une exécution de modèle -
POST /v1/flows/templates/{template_id}/runs- Démarre une exécution de modèle avec des valeurs d’entrée, une version facultative et un webhook facultatif. - Lister les exécutions de modèles -
GET /v1/flows/templates/{template_id}/runs- Liste les exécutions de modèles avec pagination par curseur et filtrage facultatif par version. - Obtenir une exécution de modèle -
GET /v1/flows/templates/{template_id}/runs/{run_id}- Récupère une exécution de modèle et l’état de sa sortie.
Points de terminaison mis à jour
Speech to Text
- Convertir la parole en texte -
POST /v1/speech-to-text- Ajout de
transcript_editfacultatif et nullable (chaîne), qui accepte une instruction de modification en langage naturel pouvant contenir jusqu’à 2 000 caractères. - Les réponses ajoutent
edited_transcriptfacultatif et nullable. Une modification réussie contient les champs obligatoireskind: "transcript"ettext. Une modification échouée contient les champs obligatoireskind: "error",error_type: "edit_failed"etmessage.
- Ajout de
- Realtime Speech to Text accepte
transcript_edit(chaîne) et émet des événementsedited_transcriptavec les champs obligatoirestextetedited_text.
ElevenAgents
- Créer un agent, Obtenir un agent et Mettre à jour un agent
- Ajout de
gpt-6-sol,gpt-6-luna,glm-52,deepseek-v41-flash,claude-opus-5etclaude-opus-5-5à l’énumérationLLM. - Les moniteurs d’alerte ajoutent
enabledfacultatif et nullable (booléen) afin de contrôler si un moniteur peut envoyer des notifications.
- Ajout de
- Lister les conversations et Recherche textuelle
data_collection_paramsetdynamic_variable_paramsajoutent les opérateursneqetin. Les valeurs deinutilisent un séparateur de type barre verticale.evaluation_paramsacceptesuccess,failureouunknowncomme valeur de résultat.
- Recherche intelligente -
GET /v1/convai/conversations/messages/smart-search- Ajout de
branch_idfacultatif et nullable (chaîne).
- Ajout de
- Lister les invocations de test -
GET /v1/convai/test-invocations- Ajout de
branch_idfacultatif et nullable (chaîne). - Les résumés d’invocation de test ajoutent
credits_usedfacultatif et nullable (entier) ettotal_price(nombre).
- Ajout de
- Obtenir une invocation de test -
GET /v1/convai/test-invocations/{test_invocation_id}- Les exécutions de test individuelles ajoutent
credits_usedfacultatif et nullable (entier) etcharging(ConversationChargingCommonModel).
- Les exécutions de test individuelles ajoutent
- Simuler une conversation et Diffuser une simulation de conversation
- Modification de la valeur par défaut facultative de
new_turns_limit, de10,000à100, et définition de sa valeur maximale à100.
- Modification de la valeur par défaut facultative de
- Créer une tâche d’exploration et Obtenir une tâche d’exploration
- Ajout de
auto_discoverfacultatif (booléen, valeur par défautfalse) pour suivre les liens et ajouter les nouvelles pages découvertes lors de la synchronisation automatique. Nécessiteenable_auto_sync: true.
- Ajout de
- Actualiser un document de la base de connaissances -
POST /v1/convai/knowledge-base/{documentation_id}/refreshAutoSyncInfoajouteauto_discoverfacultatif (booléen, valeur par défautfalse) afin d’indiquer si les actualisations explorent et ajoutent les nouvelles pages découvertes.
- Lister les outils du serveur MCP -
GET /v1/convai/mcp-servers/{mcp_server_id}/tools- Les réponses ajoutent
tool_approval_statusesfacultatif (tableau). Chaque élément contienttool_idobligatoire (chaîne) etstate(up_to_date,needs_reviewounot_approved), avec des champs facultatifs de politique d’approbation et de définition approuvée.
- Les réponses ajoutent
Text to Dialogue
- Convertir du texte en dialogue, Diffuser du texte en dialogue, Convertir avec horodatages et Diffuser avec horodatages
- Ajout de
use_pvc_as_ivcfacultatif (booléen, valeur par défautfalse) pour utiliser la version Instant Voice Clone d’un Professional Voice Clone. - Ajout de
previous_textetfuture_textfacultatifs et nullables (chaînes, maximum 100 caractères), ainsi que deprevious_request_idsetnext_request_ids(tableaux de chaînes, maximum 3 identifiants) pour assurer la continuité de génération. - L’objet
settingsfacultatif ajoutesimilaritynullable (nombre, 0–1, valeur par défaut0.75).
- Ajout de
Text to Speech
- Convertir du texte en parole, Diffuser du texte en parole, Convertir avec horodatages et Diffuser avec horodatages
- Le champ
use_pvc_as_ivcexistant n’est plus obsolète.
- Le champ
Flows
- Créer une génération d’image, Créer une génération vidéo et Créer une exécution de modèle
- Les cibles de webhook nécessitent désormais un discriminateur
typeexplicite (allouids). Les valeurs par défaut précédentes ont été supprimées.
- Les cibles de webhook nécessitent désormais un discriminateur
Voice Design
- Créer une voix à partir d’un aperçu, Créer des aperçus de voix, Concevoir une voix et Remixer une voix
- Ajout d’une réponse
409lorsqu’une génération pour l’aperçu est déjà en cours. Réessayez la requête après avoir reçu cette réponse.
- Ajout d’une réponse
Workspaces
- Créer une clé API de compte de service -
POST /v1/service-accounts/{service_account_user_id}/api-keys- Ajout de
tts_concurrency_limit,music_concurrency_limitetdubbing_concurrency_limitfacultatifs et nullables (entiers) pour les clés API de compte de service Enterprise.
- Ajout de
- Mettre à jour une clé API de compte de service -
PATCH /v1/service-accounts/{service_account_user_id}/api-keys/{api_key_id}- Ajout de
tts_concurrency_limit,music_concurrency_limitetdubbing_concurrency_limitfacultatifs. Chaque champ accepte un entier,clear,no_updateounull, et utiliseno_updatepar défaut.
- Ajout de
Modèles
- Lister les modèles -
GET /v1/models- Dépréciation de
max_characters_request_free_useretmax_characters_request_subscribed_user, auparavant obligatoires. Ces champs ne sont pas appliqués, utilisez plutôtmaximum_text_length_per_request.
- Dépréciation de