ElevenAgents

  • Równoległe wywołania narzędzi: Konfiguracja promptu agenta zawiera teraz enable_parallel_tool_calls (boolean, domyślnie true). Gdy jest włączona, obsługiwane modele mogą wykonać wiele narzędzi w jednej turze.
  • Modele agentów: Dodano gpt-6-astra do opcji LLM agenta.
  • Alerty: Alerty agenta obsługują teraz kanały Slack obok powiadomień PagerDuty i webhooków.
  • Wyszukiwanie numerów telefonów: Dodano endpoint numerów telefonów z paginacją opartą na kursorze i filtrami dostawcy, obsługi połączeń wychodzących, przypisanego agenta i gałęzi, etykiety oraz numeru telefonu.

Obrazy i wideo

  • Modele GPT Image 2.5: Generowanie obrazów obsługuje teraz gpt-image-2.5-flare i gpt-image-2.5-sunburst. Oba modele przyjmują do 10 obrazów referencyjnych, poziomy jakości do max, 14 stałych proporcji obrazu oraz auto, a także wynik 1K, 2K lub 4K.

Speech Engine

  • Limit czasu kaskady: Żądania tworzenia i aktualizacji Speech Engine przyjmują teraz cascade_timeout_seconds (number, 2–15, domyślnie 4), aby określić, jak długo ElevenLabs czeka na nadrzędny Speech Engine przed ponowną próbą.

Text to Speech

  • Granice tur z wieloma kontekstami: Znacznik is_final_audio_for_turn jest teraz wysyłany po każdym zbuforowanym bajcie dla danej tury, w tym w formatach MP3 i Opus. Klienci mogą używać znacznika jako dokładnej granicy tury bez przechodzenia na PCM.

Wydania SDK

JavaScript SDK

  • v2.69.0 - Dodano transcriptEdit do wrappera Speech to Text w czasie rzeczywistym, z edytowanym tekstem dostarczanym przez zdarzenia edited_transcript. Naprawiono weryfikację JWT Speech Engine dla kluczy API z sufiksami rezydencji danych. Dodano phoneNumbers.listV2 i metody szablonów Flows do wyświetlania i pobierania szablonów oraz wyświetlania, tworzenia i pobierania uruchomień. Wygenerowano ponownie klientów i typy dla GPT Image 2.5, alertów agentów Slack, równoległych wywołań narzędzi, gpt-6-astra, limitów równoczesności kluczy API kont usługowych, zerowej retencji Music, filtrów rozmów i statusów zatwierdzania narzędzi MCP.

Python SDK

  • v2.69.0 - Dodano transcript_edit do wrappera Speech to Text w czasie rzeczywistym, z edytowanym tekstem dostarczanym przez zdarzenia edited_transcript. Naprawiono weryfikację JWT Speech Engine dla kluczy API z sufiksami rezydencji danych oraz sprawiono, że play zgłasza błąd, gdy ffplay zawiedzie. Dodano phone_numbers.list_v2 i metody szablonów Flows do wyświetlania i pobierania szablonów oraz wyświetlania, tworzenia i pobierania uruchomień. Wygenerowano ponownie klientów i typy dla GPT Image 2.5, alertów agentów Slack, równoległych wywołań narzędzi, gpt-6-astra, limitów równoczesności kluczy API kont usługowych, zerowej retencji Music, filtrów rozmów i statusów zatwierdzania narzędzi MCP.

ElevenLabs CLI

  • v1.3.2 - Dodano opcjonalne metadane --intent do zbierania opinii o użyciu CLI. Dodano elevenlabs feedback missing-capability do zgłaszania workflow, których CLI nie obsługuje.

API

Nowe endpointy

ElevenAgents

  • Wyświetl stronę numerów telefonów - GET /v1/convai/v2/phone-numbers
    • Dodano opcjonalne parametry paginacji page_size (integer, 1–1000, domyślnie 100) i cursor (nullable string).
    • Dodano opcjonalne filtry search, label, phone_number, provider, supports_outbound, agent_id, branch_id, sort_by i sort_direction. sort_by przyjmuje label lub phone_number; sort_direction domyślnie ma wartość asc.
    • Odpowiedź zawiera wymagane phone_numbers (array), opcjonalne nullable next_cursor (string) i has_more (boolean, domyślnie false).

Zaktualizowane endpointy

ElevenAgents

  • Utwórz agenta, Pobierz agenta i Zaktualizuj agenta
    • Konfiguracja promptu dodaje enable_parallel_tool_calls (boolean, domyślnie true). Nadpisania workflow przyjmują nullable boolean.
    • Enum LLM dodaje gpt-6-astra, w tym nadpisania inicjowania rozmowy.
    • Powiadomienia integracji alertów używają teraz integration_type do wyboru pagerduty lub slack. Powiadomienia Slack wymagają connection_id i channel_id (string); channel_id przyjmuje 1–64 znaki.
  • Wyświetl rozmowy i Rozwiąż odwołanie do rozmowy
    • data_collection_params nie przyjmuje już operatora missing. Użyj pustej wartości, aby dopasować rozmowy, w których pole nie zostało zebrane.
    • Pusta wartość w dynamic_variable_params dopasowuje rozmowy, w których zmienna nie została ustawiona.
  • Utwórz Speech Engine, Pobierz Speech Engine i Zaktualizuj Speech Engine
    • Dodano cascade_timeout_seconds (number, 2–15). Żądania tworzenia domyślnie używają 4, żądania aktualizacji przyjmują wartość nullable, a odpowiedzi wymagają tego pola.

Obrazy i wideo

  • Utwórz generowanie obrazu - POST /v1/flows/image
    • Dodano warianty żądań dla gpt-image-2.5-flare i gpt-image-2.5-sunburst.
    • Oba warianty wymagają prompt i model_id, przyjmują do 10 images oraz dodają resolution (1K, 2K lub 4K, domyślnie 1K).
    • quality przyjmuje low, medium, high, xhigh lub max i domyślnie ma wartość high. aspect_ratio przyjmuje auto oraz 14 stałych proporcji i domyślnie ma wartość 16:9.

Dubbing

Baza wiedzy

  • Utwórz zadanie indeksowania - POST /v1/convai/knowledge-base/crawl
    • Wycofano max_depth (integer, domyślnie 3). Pole nie ma już działania i nie ma minimalnych ani maksymalnych ograniczeń.
    • Metadane zadania indeksowania nie wymagają już max_depth.

Użytkownik

Zmiany w schemacie

Text to Speech

  • Wiadomości WebSocket audio i final z wieloma kontekstami definiują teraz is_final_audio_for_turn jako występujące po dostarczeniu wszystkich zbuforowanych bajtów dla tury.