ElevenAgents

  • Appels d’outils parallèles : la configuration des prompts de l’agent inclut désormais enable_parallel_tool_calls (booléen, valeur par défaut true). Lorsqu’il est activé, les modèles compatibles peuvent exécuter plusieurs outils au cours d’un même tour.
  • Modèles d’agent : ajout de gpt-6-astra aux options LLM des agents.
  • Alertes : les alertes d’agent prennent désormais en charge les canaux Slack en plus des notifications PagerDuty et webhook.
  • Recherche de numéros de téléphone : ajout d’un point de terminaison de numéros de téléphone paginé par curseur, avec des filtres pour le fournisseur, la prise en charge des appels sortants, l’agent et la branche attribués, le libellé et le numéro de téléphone.

Image et vidéo

  • Modèles GPT Image 2.5 : la génération d’images prend désormais en charge gpt-image-2.5-flare et gpt-image-2.5-sunburst. Les deux modèles acceptent jusqu’à 10 images de référence, des niveaux de qualité jusqu’à max, 14 formats d’image fixes ainsi que auto, et une sortie en 1K, 2K ou 4K.

Speech Engine

  • Délai d’expiration en cascade : les requêtes de création et de mise à jour de Speech Engine acceptent désormais cascade_timeout_seconds (nombre, 2–15, valeur par défaut 4) afin de contrôler le temps pendant lequel ElevenLabs attend un moteur de synthèse vocale en amont avant de réessayer.

Text to Speech

  • Limites de tours multi-contexte : le marqueur is_final_audio_for_turn est désormais émis après chaque octet mis en mémoire tampon pour ce tour, y compris pour les sorties MP3 et Opus. Les clients peuvent utiliser ce marqueur comme limite de tour exacte sans passer au PCM.

Versions des SDK

SDK JavaScript

  • v2.69.0 - Ajout de transcriptEdit au wrapper Speech to Text en temps réel, avec du texte modifié transmis via les événements edited_transcript. Correction de la vérification JWT de Speech Engine pour les clés API avec suffixes de résidence des données. Ajout de phoneNumbers.listV2 et de méthodes de modèles Flows pour lister et obtenir des modèles, ainsi que lister, créer et obtenir des exécutions. Clients et types régénérés pour GPT Image 2.5, les alertes d’agent Slack, les appels d’outils parallèles, gpt-6-astra, les limites de requêtes simultanées des clés API de comptes de service, le mode zéro rétention de Music, les filtres de conversation et les statuts d’approbation des outils MCP.

SDK Python

  • v2.69.0 - Ajout de transcript_edit au wrapper Speech to Text en temps réel, avec du texte modifié transmis via les événements edited_transcript. Correction de la vérification JWT de Speech Engine pour les clés API avec suffixes de résidence des données, et modification de play afin de générer une erreur en cas d’échec de ffplay. Ajout de phone_numbers.list_v2 et de méthodes de modèles Flows pour lister et obtenir des modèles, ainsi que lister, créer et obtenir des exécutions. Clients et types régénérés pour GPT Image 2.5, les alertes d’agent Slack, les appels d’outils parallèles, gpt-6-astra, les limites de requêtes simultanées des clés API de comptes de service, le mode zéro rétention de Music, les filtres de conversation et les statuts d’approbation des outils MCP.

CLI ElevenLabs

  • v1.3.2 - Ajout de métadonnées facultatives --intent pour recueillir des retours sur l’utilisation de la CLI. Ajout de elevenlabs feedback missing-capability pour signaler les workflows que la CLI ne prend pas en charge.

API

Nouveaux points de terminaison

ElevenAgents

  • Lister une page de numéros de téléphone - GET /v1/convai/v2/phone-numbers
    • Ajout des paramètres de pagination facultatifs page_size (entier, 1–1 000, valeur par défaut 100) et cursor (chaîne pouvant être nulle).
    • Ajout des filtres facultatifs search, label, phone_number, provider, supports_outbound, agent_id, branch_id, sort_by et sort_direction. sort_by accepte label ou phone_number ; sort_direction utilise asc par défaut.
    • La réponse contient phone_numbers (tableau) obligatoire, next_cursor (chaîne) facultatif et pouvant être nul, ainsi que has_more (booléen, valeur par défaut false).

Points de terminaison mis à jour

ElevenAgents

  • Créer un agent, Obtenir un agent et Mettre à jour un agent
    • La configuration des prompts ajoute enable_parallel_tool_calls (booléen, valeur par défaut true). Les remplacements de workflow acceptent un booléen pouvant être nul.
    • L’énumération LLM ajoute gpt-6-astra, y compris pour les remplacements d’initialisation de conversation.
    • Les notifications d’intégration d’alertes utilisent désormais integration_type pour sélectionner pagerduty ou slack. Les notifications Slack requièrent connection_id et channel_id (chaînes) ; channel_id accepte 1 à 64 caractères.
  • Lister les conversations et Résoudre une référence de conversation
    • data_collection_params n’accepte plus l’opérateur missing. Utilisez une valeur vide pour trouver les conversations dans lesquelles le champ n’a pas été collecté.
    • Une valeur vide dans dynamic_variable_params correspond aux conversations dans lesquelles la variable n’a pas été définie.
  • Créer un Speech Engine, Obtenir un Speech Engine et Mettre à jour un Speech Engine
    • Ajout de cascade_timeout_seconds (nombre, 2–15). Les requêtes de création utilisent 4 par défaut, les requêtes de mise à jour acceptent une valeur pouvant être nulle et les réponses requièrent ce champ.

Image et vidéo

  • Créer une génération d’image - POST /v1/flows/image
    • Ajout de variantes de requête pour gpt-image-2.5-flare et gpt-image-2.5-sunburst.
    • Les deux variantes requièrent prompt et model_id, acceptent jusqu’à 10 images et ajoutent resolution (1K, 2K ou 4K, valeur par défaut 1K).
    • quality accepte low, medium, high, xhigh ou max et utilise high par défaut. aspect_ratio accepte auto et 14 ratios fixes, et utilise 16:9 par défaut.

Doublage

Base de connaissances

  • Créer une tâche d’exploration - POST /v1/convai/knowledge-base/crawl
    • Dépréciation de max_depth (entier, valeur par défaut 3). Ce champ n’a désormais aucun effet et n’est plus soumis à des contraintes minimales ou maximales.
    • Les métadonnées des tâches d’exploration ne requièrent plus max_depth.

Utilisateur

Modifications du schéma

Text to Speech

  • Les messages WebSocket audio et final multi-contexte définissent désormais is_final_audio_for_turn comme intervenant après la livraison de tous les octets mis en mémoire tampon pour le tour.