Eleven v4 et Eleven v4 Turbo

Eleven v4 et Eleven v4 Turbo sont désormais disponibles. Eleven v4 offre une synthèse vocale de meilleure qualité et plus expressive, ainsi qu’un clonage de voix amélioré dans plus de 90 langues. Eleven v4 Turbo propose la même famille de modèles pour les applications en temps réel, avec une latence d’inférence médiane d’environ 100 ms.

Utilisez eleven_v4 via l’API Text to Dialogue pour la création de contenu et les contenus audio longs. Utilisez eleven_v4_turbo via le WebSocket Text to Dialogue pour les agents et les applications interactives.

Speech to Text

  • Modification des transcriptions : la transcription par lot et en temps réel accepte désormais une instruction de modification en langage naturel pouvant contenir jusqu’à 2 000 caractères. Les réponses par lot renvoient le résultat dans edited_transcript, tandis que les sessions en temps réel émettent un événement edited_transcript. Consultez les guides par lot et en temps réel pour connaître les incompatibilités, la gestion des réponses et la tarification.

ElevenAgents

  • Modèles d’agent : ajout de gpt-6-sol, gpt-6-luna, glm-52, deepseek-v41-flash, claude-opus-5 et claude-opus-5-5 aux options de LLM d’agent prises en charge.
  • Utilisation des tests d’agent : les résumés d’invocation de test peuvent inclure le total de crédits et le prix en USD. Les exécutions de test individuelles peuvent inclure les crédits et le détail de la facturation.

Flows

  • API de modèles : ajout de points de terminaison pour lister et récupérer les modèles Flows publiés, démarrer des exécutions de modèles et récupérer les résultats d’exécution. Les exécutions peuvent cibler une version publiée et envoyer leur résultat final à un webhook configuré.

Text to Dialogue

  • Continuité de génération : les requêtes Text to Dialogue peuvent utiliser du texte précédent ou suivant et des identifiants de requête afin de maintenir la continuité entre les générations.
  • Mode voix professionnelle : les requêtes Text to Dialogue peuvent utiliser la version Instant Voice Clone d’un Professional Voice Clone afin de réduire la latence ou d’améliorer l’expressivité.

Versions des SDK

SDK JavaScript

  • v2.70.0 - Ajout des types de modification de transcription Speech to Text par lot et en temps réel, du filtrage branchId et des champs de coût pour les résumés d’invocation de test, de la découverte automatique de la base de connaissances, de usePvcAsIvc pour Text to Dialogue et du modèle d’agent deepseek-v41-flash.

SDK Python

  • v2.70.0 - Ajout des types de modification de transcription Speech to Text par lot et en temps réel, du filtrage branch_id et des champs de coût pour les résumés d’invocation de test, de la découverte automatique de la base de connaissances, de use_pvc_as_ivc pour Text to Dialogue et du modèle d’agent deepseek-v41-flash.

CLI ElevenLabs

  • v1.4.0 - Correction des requêtes utilisant une clé API explicite afin qu’elles n’envoient plus également les identifiants OAuth enregistrés, ce qui provoquait des échecs d’authentification. Ajout de descriptions pour le groupe de commandes de commentaires et d’instructions permettant de signaler les capacités manquantes aux compétences d’agent générées. Régénération du client API avec les points de terminaison de modèles Flows et les types de schéma actuels.

API

Nouveaux points de terminaison

Flows

  • Lister les modèles - GET /v1/flows/templates - Liste les modèles publiés et leurs versions exécutables.
  • Obtenir un modèle - GET /v1/flows/templates/{template_id} - Récupère un modèle et ses versions exécutables.
  • Créer une exécution de modèle - POST /v1/flows/templates/{template_id}/runs - Démarre une exécution de modèle avec des valeurs d’entrée, une version facultative et un webhook facultatif.
  • Lister les exécutions de modèles - GET /v1/flows/templates/{template_id}/runs - Liste les exécutions de modèles avec pagination par curseur et filtrage facultatif par version.
  • Obtenir une exécution de modèle - GET /v1/flows/templates/{template_id}/runs/{run_id} - Récupère une exécution de modèle et l’état de sa sortie.

Points de terminaison mis à jour

Speech to Text

  • Convertir la parole en texte - POST /v1/speech-to-text
    • Ajout de transcript_edit facultatif et nullable (chaîne), qui accepte une instruction de modification en langage naturel pouvant contenir jusqu’à 2 000 caractères.
    • Les réponses ajoutent edited_transcript facultatif et nullable. Une modification réussie contient les champs obligatoires kind: "transcript" et text. Une modification échouée contient les champs obligatoires kind: "error", error_type: "edit_failed" et message.
  • Realtime Speech to Text accepte transcript_edit (chaîne) et émet des événements edited_transcript avec les champs obligatoires text et edited_text.

ElevenAgents

  • Créer un agent, Obtenir un agent et Mettre à jour un agent
    • Ajout de gpt-6-sol, gpt-6-luna, glm-52, deepseek-v41-flash, claude-opus-5 et claude-opus-5-5 à l’énumération LLM.
    • Les moniteurs d’alerte ajoutent enabled facultatif et nullable (booléen) afin de contrôler si un moniteur peut envoyer des notifications.
  • Lister les conversations et Recherche textuelle
    • data_collection_params et dynamic_variable_params ajoutent les opérateurs neq et in. Les valeurs de in utilisent un séparateur de type barre verticale.
    • evaluation_params accepte success, failure ou unknown comme valeur de résultat.
  • Recherche intelligente - GET /v1/convai/conversations/messages/smart-search
    • Ajout de branch_id facultatif et nullable (chaîne).
  • Lister les invocations de test - GET /v1/convai/test-invocations
    • Ajout de branch_id facultatif et nullable (chaîne).
    • Les résumés d’invocation de test ajoutent credits_used facultatif et nullable (entier) et total_price (nombre).
  • Obtenir une invocation de test - GET /v1/convai/test-invocations/{test_invocation_id}
    • Les exécutions de test individuelles ajoutent credits_used facultatif et nullable (entier) et charging (ConversationChargingCommonModel).
  • Simuler une conversation et Diffuser une simulation de conversation
    • Modification de la valeur par défaut facultative de new_turns_limit, de 10,000 à 100, et définition de sa valeur maximale à 100.
  • Créer une tâche d’exploration et Obtenir une tâche d’exploration
    • Ajout de auto_discover facultatif (booléen, valeur par défaut false) pour suivre les liens et ajouter les nouvelles pages découvertes lors de la synchronisation automatique. Nécessite enable_auto_sync: true.
  • Actualiser un document de la base de connaissances - POST /v1/convai/knowledge-base/{documentation_id}/refresh
    • AutoSyncInfo ajoute auto_discover facultatif (booléen, valeur par défaut false) afin d’indiquer si les actualisations explorent et ajoutent les nouvelles pages découvertes.
  • Lister les outils du serveur MCP - GET /v1/convai/mcp-servers/{mcp_server_id}/tools
    • Les réponses ajoutent tool_approval_statuses facultatif (tableau). Chaque élément contient tool_id obligatoire (chaîne) et state (up_to_date, needs_review ou not_approved), avec des champs facultatifs de politique d’approbation et de définition approuvée.

Text to Dialogue

  • Convertir du texte en dialogue, Diffuser du texte en dialogue, Convertir avec horodatages et Diffuser avec horodatages
    • Ajout de use_pvc_as_ivc facultatif (booléen, valeur par défaut false) pour utiliser la version Instant Voice Clone d’un Professional Voice Clone.
    • Ajout de previous_text et future_text facultatifs et nullables (chaînes, maximum 100 caractères), ainsi que de previous_request_ids et next_request_ids (tableaux de chaînes, maximum 3 identifiants) pour assurer la continuité de génération.
    • L’objet settings facultatif ajoute similarity nullable (nombre, 0–1, valeur par défaut 0.75).

Text to Speech

Flows

Voice Design

Workspaces

  • Créer une clé API de compte de service - POST /v1/service-accounts/{service_account_user_id}/api-keys
    • Ajout de tts_concurrency_limit, music_concurrency_limit et dubbing_concurrency_limit facultatifs et nullables (entiers) pour les clés API de compte de service Enterprise.
  • Mettre à jour une clé API de compte de service - PATCH /v1/service-accounts/{service_account_user_id}/api-keys/{api_key_id}
    • Ajout de tts_concurrency_limit, music_concurrency_limit et dubbing_concurrency_limit facultatifs. Chaque champ accepte un entier, clear, no_update ou null, et utilise no_update par défaut.

Modèles

  • Lister les modèles - GET /v1/models
    • Dépréciation de max_characters_request_free_user et max_characters_request_subscribed_user, auparavant obligatoires. Ces champs ne sont pas appliqués, utilisez plutôt maximum_text_length_per_request.