For AI agents: a documentation index is available at the root level at /llms.txt. Append /llms.txt to any URL for a page-level index, or .md for the markdown version of any page.
LogoLogo
Połącz
BlogCentrum pomocyCennik APIZarejestruj się
PrzeglądElevenCreativeElevenAgentsElevenAPIReception.aiDokumentacja APIChangelogCentrum pomocy
Zaloguj się
PrzeglądElevenCreativeElevenAgentsElevenAPIReception.aiDokumentacja APIChangelogCentrum pomocy
Połącz
BlogCentrum pomocyCennik APIZarejestruj się
Na tej stronie
  • 28 września 2026
  • Eleven v4 i Eleven v4 Turbo
  • Speech to Text
  • ElevenAgents
  • Flows
  • Text to Dialogue
  • Wydania SDK
  • API
  • Nowe endpointy
  • Zaktualizowane endpointy
  • 23 września 2026
  • Obrazy i wideo
  • 21 września 2026
  • ElevenAgents
  • Obrazy i wideo
  • Speech Engine
  • Text to Speech
  • Wydania SDK
  • API
  • Nowe endpointy
  • Zaktualizowane endpointy
  • Zmiany w schemacie
  • 14 września 2026
  • ElevenAgents
  • Muzyka
  • Wydania SDK
  • API
  • Nowe endpointy
  • Zaktualizowane endpointy
  • Zmiany w schemacie
  • 11 września 2026
  • Scribe v2 Medical
  • 7 września 2026
  • ElevenAgents
  • Workspace
  • Wydania SDK
  • API
  • Nowe endpointy
  • Zaktualizowane endpointy
  • Zmiany w schematach
  • 31 sierpnia 2026
  • ElevenAgents
  • Muzyka
  • Dubbing
  • Wydania SDK
  • API
  • Zaktualizowane endpointy
  • Zmiany w schematach
  • 24 sierpnia 2026
  • ElevenLabs CLI
  • Procedury
  • ElevenAgents
  • Wydania SDK
  • API
  • Nowe endpointy
  • Zaktualizowane endpointy
  • Zmiany schematów
  • 22 sierpnia 2026
  • Serwer MCP
  • 17 sierpnia 2026
  • ElevenCreative
  • ElevenAgents
  • Wydania SDK
  • API
  • Nowe endpointy
  • Zaktualizowane endpointy
  • Zmiany schematu

Changelog

September 28, 2026
September 28, 2026

September 23, 2026
September 23, 2026

September 21, 2026
September 21, 2026

September 14, 2026
September 14, 2026

September 11, 2026
September 11, 2026

September 7, 2026
September 7, 2026

August 31, 2026
August 31, 2026

August 24, 2026
August 24, 2026

August 22, 2026
August 22, 2026

August 17, 2026
August 17, 2026
Starsze posty
Następny
Zbudowano z
Zaloguj się

Eleven v4 i Eleven v4 Turbo

Eleven v4 i Eleven v4 Turbo są już dostępne. Eleven v4 zapewnia wyższą jakość, bardziej ekspresyjną mowę i lepsze klonowanie głosu w ponad 90 językach. Eleven v4 Turbo oferuje tę samą rodzinę modeli do aplikacji działających w czasie rzeczywistym, ze średnim opóźnieniem inferencji około 100 ms.

Używaj eleven_v4 przez API Text to Dialogue do tworzenia treści i długich nagrań audio. Używaj eleven_v4_turbo przez WebSocket Text to Dialogue dla agentów i aplikacji interaktywnych.

Omówienie Eleven v4

Porównaj dwa warianty modelu, działanie klonowania głosu, ustawienia i obsługiwane języki.

API Text to Dialogue

Generuj wysokiej jakości dialogi z Eleven v4.

Streaming w czasie rzeczywistym

Streamuj dialogi Eleven v4 Turbo przez połączenie WebSocket.

Speech to Text

  • Edycja transkrypcji: Transkrypcja wsadowa i w czasie rzeczywistym obsługuje teraz instrukcję edycji w języku naturalnym o długości do 2000 znaków. Odpowiedzi wsadowe zwracają wynik w edited_transcript, a sesje w czasie rzeczywistym wysyłają zdarzenie edited_transcript. Zobacz przewodniki dla trybu wsadowego i w czasie rzeczywistym, aby poznać niezgodności, obsługę odpowiedzi i ceny.

ElevenAgents

  • Modele agentów: Dodano gpt-6-sol, gpt-6-luna, glm-52, deepseek-v41-flash, claude-opus-5 i claude-opus-5-5 do obsługiwanych opcji LLM agentów.
  • Zużycie w testach agentów: Podsumowania wywołań testowych mogą zawierać łączną liczbę kredytów i cenę w USD. Poszczególne uruchomienia testów mogą zawierać liczbę kredytów i rozbicie opłat.

Flows

  • API szablonów: Dodano endpointy do wyświetlania i pobierania opublikowanych szablonów Flows, uruchamiania szablonów i pobierania wyników. Uruchomienia mogą wskazywać opublikowaną wersję i wysyłać końcowy wynik do skonfigurowanego webhooka.

Text to Dialogue

  • Ciągłość generowania: Żądania Text to Dialogue mogą używać poprzedzającego lub następnego tekstu oraz identyfikatorów żądań, by zachować ciągłość między generowaniami.
  • Tryb głosu Professional: Żądania Text to Dialogue mogą używać wersji Instant Voice Clone głosu Professional Voice Clone, aby zmniejszyć opóźnienie lub zwiększyć ekspresję.

Wydania SDK

JavaScript SDK

  • v2.70.0 - Dodano typy edycji transkrypcji Speech to Text dla trybu wsadowego i czasu rzeczywistego, filtrowanie branchId oraz pola kosztów dla podsumowań wywołań testowych, automatyczne wykrywanie bazy wiedzy, usePvcAsIvc dla Text to Dialogue i model agenta deepseek-v41-flash.

Python SDK

  • v2.70.0 - Dodano typy edycji transkrypcji Speech to Text dla trybu wsadowego i czasu rzeczywistego, filtrowanie branch_id oraz pola kosztów dla podsumowań wywołań testowych, automatyczne wykrywanie bazy wiedzy, use_pvc_as_ivc dla Text to Dialogue i model agenta deepseek-v41-flash.

ElevenLabs CLI

  • v1.4.0 - Naprawiono żądania z podanym kluczem API, aby nie wysyłały też zapisanych danych OAuth, co powodowało błędy uwierzytelniania. Dodano opisy grupy poleceń opinii oraz instrukcje zgłaszania brakujących funkcji do wygenerowanych umiejętności agentów. Wygenerowano ponownie klienta API z endpointami szablonów Flows i aktualnymi typami schematów.

API

Zobacz zmiany w API

Nowe endpointy

Flows

  • Lista szablonów - GET /v1/flows/templates - Wyświetl opublikowane szablony i ich uruchamialne wersje.
  • Pobierz szablon - GET /v1/flows/templates/{template_id} - Pobierz szablon i jego uruchamialne wersje.
  • Utwórz uruchomienie szablonu - POST /v1/flows/templates/{template_id}/runs - Uruchom szablon z wartościami wejściowymi, opcjonalną wersją i opcjonalnym webhookiem.
  • Lista uruchomień szablonu - GET /v1/flows/templates/{template_id}/runs - Wyświetl uruchomienia szablonu z paginacją kursora i opcjonalnym filtrowaniem wersji.
  • Pobierz uruchomienie szablonu - GET /v1/flows/templates/{template_id}/runs/{run_id} - Pobierz uruchomienie szablonu i stan jego danych wyjściowych.

Zaktualizowane endpointy

Speech to Text

  • Konwertuj mowę na tekst - POST /v1/speech-to-text
    • Dodano opcjonalne dopuszczające null transcript_edit (ciąg znaków), które przyjmuje instrukcję edycji w języku naturalnym o długości do 2000 znaków.
    • Odpowiedzi dodają opcjonalne dopuszczające null edited_transcript. Udana edycja zawiera wymagane pola kind: "transcript" i text. Nieudana edycja zawiera wymagane pola kind: "error", error_type: "edit_failed" i message.
  • Speech to Text w czasie rzeczywistym przyjmuje transcript_edit (ciąg znaków) i wysyła zdarzenia edited_transcript z wymaganymi polami text i edited_text.

ElevenAgents

  • Utwórz agenta, Pobierz agenta i Zaktualizuj agenta
    • Dodano gpt-6-sol, gpt-6-luna, glm-52, deepseek-v41-flash, claude-opus-5 i claude-opus-5-5 do enuma LLM.
    • Monitory alertów dodają opcjonalne dopuszczające null enabled (wartość logiczna), aby określić, czy monitor może wysyłać powiadomienia.
  • Lista rozmów i Wyszukiwanie tekstowe
    • data_collection_params i dynamic_variable_params dodają operatory neq i in. Wartości dla in używają separatora pionowej kreski.
    • evaluation_params przyjmuje success, failure lub unknown jako wartość wyniku.
  • Inteligentne wyszukiwanie - GET /v1/convai/conversations/messages/smart-search
    • Dodano opcjonalne dopuszczające null branch_id (ciąg znaków).
  • Lista wywołań testowych - GET /v1/convai/test-invocations
    • Dodano opcjonalne dopuszczające null branch_id (ciąg znaków).
    • Podsumowania wywołań testowych dodają opcjonalne dopuszczające null credits_used (liczba całkowita) i total_price (liczba).
  • Pobierz wywołanie testowe - GET /v1/convai/test-invocations/{test_invocation_id}
    • Poszczególne uruchomienia testów dodają opcjonalne dopuszczające null credits_used (liczba całkowita) i charging (ConversationChargingCommonModel).
  • Symuluj rozmowę i Streamuj symulację rozmowy
    • Zmieniono domyślną wartość opcjonalnego new_turns_limit z 10,000 na 100 i ustawiono maksymalną wartość na 100.
  • Utwórz zadanie crawlowania i Pobierz zadanie crawlowania
    • Dodano opcjonalne auto_discover (wartość logiczna, domyślnie false), aby podążać za linkami i dodawać nowo wykryte strony podczas automatycznej synchronizacji. Wymaga to enable_auto_sync: true.
  • Odśwież dokument bazy wiedzy - POST /v1/convai/knowledge-base/{documentation_id}/refresh
    • AutoSyncInfo dodaje opcjonalne auto_discover (wartość logiczna, domyślnie false), które wskazuje, czy odświeżanie crawluje i dodaje nowo wykryte strony.
  • Lista narzędzi serwera MCP - GET /v1/convai/mcp-servers/{mcp_server_id}/tools
    • Odpowiedzi dodają opcjonalne tool_approval_statuses (tablica). Każdy element zawiera wymagane tool_id (ciąg znaków) i state (up_to_date, needs_review lub not_approved) oraz opcjonalne pola zasad zatwierdzania i zatwierdzonej definicji.

Text to Dialogue

  • Konwertuj tekst na dialog, Streamuj tekst na dialog, Konwertuj ze znacznikami czasu i Streamuj ze znacznikami czasu
    • Dodano opcjonalne use_pvc_as_ivc (wartość logiczna, domyślnie false), aby używać wersji Instant Voice Clone głosu Professional Voice Clone.
    • Dodano opcjonalne dopuszczające null previous_text i future_text (ciągi znaków, maksymalnie 100 znaków) oraz previous_request_ids i next_request_ids (tablice ciągów znaków, maksymalnie 3 identyfikatory) dla ciągłości generowania.
    • Opcjonalny obiekt settings dodaje dopuszczające null similarity (liczba, 0–1, domyślnie 0.75).

Text to Speech

  • Konwertuj tekst na mowę, Streamuj tekst na mowę, Konwertuj ze znacznikami czasu i Streamuj ze znacznikami czasu
    • Istniejące pole use_pvc_as_ivc nie jest już przestarzałe.

Flows

  • Utwórz generowanie obrazu, Utwórz generowanie wideo i Utwórz uruchomienie szablonu
    • Cele webhooków wymagają teraz jawnego dyskryminatora type (all lub ids). Poprzednie wartości domyślne zostały usunięte.

Voice Design

  • Utwórz głos z podglądu, Utwórz podglądy głosu, Zaprojektuj głos i Zremiksuj głos
    • Dodano odpowiedź 409, gdy generowanie dla podglądu jest już w toku. Ponów żądanie po otrzymaniu tej odpowiedzi.

Obszary robocze

  • Utwórz klucz API konta usługi - POST /v1/service-accounts/{service_account_user_id}/api-keys
    • Dodano opcjonalne dopuszczające null tts_concurrency_limit, music_concurrency_limit i dubbing_concurrency_limit (liczby całkowite) dla kluczy API kont usług Enterprise.
  • Zaktualizuj klucz API konta usługi - PATCH /v1/service-accounts/{service_account_user_id}/api-keys/{api_key_id}
    • Dodano opcjonalne tts_concurrency_limit, music_concurrency_limit i dubbing_concurrency_limit. Każde pole przyjmuje liczbę całkowitą, clear, no_update lub null, a domyślnie ma wartość no_update.

Modele

  • Lista modeli - GET /v1/models
    • Wycofano wymagane max_characters_request_free_user i max_characters_request_subscribed_user. Te pola nie są egzekwowane; zamiast nich użyj maximum_text_length_per_request.

Obrazy i wideo

  • Wycofanie Sora 2 i Sora 2 Pro: OpenAI kończy działanie API Sora 24 września 2026 r. Oba modele zostały usunięte z selektora modeli Obrazy i wideo i przestaną generować tego dnia. Istniejące generacje pozostaną dostępne w historii. Flows i szablony korzystające z węzła Sora trzeba przełączyć na inny model wideo, np. Gemini Omni 1.1 Flash, zanim będzie można uruchomić je ponownie.
  • Wycofanie Seedance 1.5 Pro: ByteDance wycofuje Seedance 1.5 Pro 11 listopada 2026 r. Model nie jest już dostępny dla nowych generacji i przestanie działać tego dnia. Zamiast niego użyj modelu Seedance 2.0.

ElevenAgents

  • Równoległe wywołania narzędzi: Konfiguracja promptu agenta zawiera teraz enable_parallel_tool_calls (boolean, domyślnie true). Gdy jest włączona, obsługiwane modele mogą wykonać wiele narzędzi w jednej turze.
  • Modele agentów: Dodano gpt-6-astra do opcji LLM agenta.
  • Alerty: Alerty agenta obsługują teraz kanały Slack obok powiadomień PagerDuty i webhooków.
  • Wyszukiwanie numerów telefonów: Dodano endpoint numerów telefonów z paginacją opartą na kursorze i filtrami dostawcy, obsługi połączeń wychodzących, przypisanego agenta i gałęzi, etykiety oraz numeru telefonu.

Obrazy i wideo

  • Modele GPT Image 2.5: Generowanie obrazów obsługuje teraz gpt-image-2.5-flare i gpt-image-2.5-sunburst. Oba modele przyjmują do 10 obrazów referencyjnych, poziomy jakości do max, 14 stałych proporcji obrazu oraz auto, a także wynik 1K, 2K lub 4K.

Speech Engine

  • Limit czasu kaskady: Żądania tworzenia i aktualizacji Speech Engine przyjmują teraz cascade_timeout_seconds (number, 2–15, domyślnie 4), aby określić, jak długo ElevenLabs czeka na nadrzędny Speech Engine przed ponowną próbą.

Text to Speech

  • Granice tur z wieloma kontekstami: Znacznik is_final_audio_for_turn jest teraz wysyłany po każdym zbuforowanym bajcie dla danej tury, w tym w formatach MP3 i Opus. Klienci mogą używać znacznika jako dokładnej granicy tury bez przechodzenia na PCM.

Wydania SDK

JavaScript SDK

  • v2.69.0 - Dodano transcriptEdit do wrappera Speech to Text w czasie rzeczywistym, z edytowanym tekstem dostarczanym przez zdarzenia edited_transcript. Naprawiono weryfikację JWT Speech Engine dla kluczy API z sufiksami rezydencji danych. Dodano phoneNumbers.listV2 i metody szablonów Flows do wyświetlania i pobierania szablonów oraz wyświetlania, tworzenia i pobierania uruchomień. Wygenerowano ponownie klientów i typy dla GPT Image 2.5, alertów agentów Slack, równoległych wywołań narzędzi, gpt-6-astra, limitów równoczesności kluczy API kont usługowych, zerowej retencji Music, filtrów rozmów i statusów zatwierdzania narzędzi MCP.

Python SDK

  • v2.69.0 - Dodano transcript_edit do wrappera Speech to Text w czasie rzeczywistym, z edytowanym tekstem dostarczanym przez zdarzenia edited_transcript. Naprawiono weryfikację JWT Speech Engine dla kluczy API z sufiksami rezydencji danych oraz sprawiono, że play zgłasza błąd, gdy ffplay zawiedzie. Dodano phone_numbers.list_v2 i metody szablonów Flows do wyświetlania i pobierania szablonów oraz wyświetlania, tworzenia i pobierania uruchomień. Wygenerowano ponownie klientów i typy dla GPT Image 2.5, alertów agentów Slack, równoległych wywołań narzędzi, gpt-6-astra, limitów równoczesności kluczy API kont usługowych, zerowej retencji Music, filtrów rozmów i statusów zatwierdzania narzędzi MCP.

ElevenLabs CLI

  • v1.3.2 - Dodano opcjonalne metadane --intent do zbierania opinii o użyciu CLI. Dodano elevenlabs feedback missing-capability do zgłaszania workflow, których CLI nie obsługuje.

API

Zobacz zmiany w API

Nowe endpointy

ElevenAgents

  • Wyświetl stronę numerów telefonów - GET /v1/convai/v2/phone-numbers
    • Dodano opcjonalne parametry paginacji page_size (integer, 1–1000, domyślnie 100) i cursor (nullable string).
    • Dodano opcjonalne filtry search, label, phone_number, provider, supports_outbound, agent_id, branch_id, sort_by i sort_direction. sort_by przyjmuje label lub phone_number; sort_direction domyślnie ma wartość asc.
    • Odpowiedź zawiera wymagane phone_numbers (array), opcjonalne nullable next_cursor (string) i has_more (boolean, domyślnie false).

Zaktualizowane endpointy

ElevenAgents

  • Utwórz agenta, Pobierz agenta i Zaktualizuj agenta
    • Konfiguracja promptu dodaje enable_parallel_tool_calls (boolean, domyślnie true). Nadpisania workflow przyjmują nullable boolean.
    • Enum LLM dodaje gpt-6-astra, w tym nadpisania inicjowania rozmowy.
    • Powiadomienia integracji alertów używają teraz integration_type do wyboru pagerduty lub slack. Powiadomienia Slack wymagają connection_id i channel_id (string); channel_id przyjmuje 1–64 znaki.
  • Wyświetl rozmowy i Rozwiąż odwołanie do rozmowy
    • data_collection_params nie przyjmuje już operatora missing. Użyj pustej wartości, aby dopasować rozmowy, w których pole nie zostało zebrane.
    • Pusta wartość w dynamic_variable_params dopasowuje rozmowy, w których zmienna nie została ustawiona.
  • Utwórz Speech Engine, Pobierz Speech Engine i Zaktualizuj Speech Engine
    • Dodano cascade_timeout_seconds (number, 2–15). Żądania tworzenia domyślnie używają 4, żądania aktualizacji przyjmują wartość nullable, a odpowiedzi wymagają tego pola.

Obrazy i wideo

  • Utwórz generowanie obrazu - POST /v1/flows/image
    • Dodano warianty żądań dla gpt-image-2.5-flare i gpt-image-2.5-sunburst.
    • Oba warianty wymagają prompt i model_id, przyjmują do 10 images oraz dodają resolution (1K, 2K lub 4K, domyślnie 1K).
    • quality przyjmuje low, medium, high, xhigh lub max i domyślnie ma wartość high. aspect_ratio przyjmuje auto oraz 14 stałych proporcji i domyślnie ma wartość 16:9.

Dubbing

  • Utwórz projekt dubbingowy - POST /v1/dubbing/project
    • Multipart keyterms przyjmuje powtarzane pola lub pojedynczą tablicę JSON.
    • Multipart webhook_ids przyjmuje powtarzane pola, pojedynczą tablicę JSON lub ciąg wartości rozdzielonych przecinkami.
  • Pobierz zasób obszaru roboczego, Udostępnij zasób obszaru roboczego i Cofnij udostępnienie zasobu obszaru roboczego
    • WorkspaceResourceType dodaje dubbing_project.

Baza wiedzy

  • Utwórz zadanie indeksowania - POST /v1/convai/knowledge-base/crawl
    • Wycofano max_depth (integer, domyślnie 3). Pole nie ma już działania i nie ma minimalnych ani maksymalnych ograniczeń.
    • Metadane zadania indeksowania nie wymagają już max_depth.

Użytkownik

  • Pobierz użytkownika i Pobierz subskrypcję
    • Enumy walut dodają gbp.

Zmiany w schemacie

Text to Speech

  • Wiadomości WebSocket audio i final z wieloma kontekstami definiują teraz is_final_audio_for_turn jako występujące po dostarczeniu wszystkich zbuforowanych bajtów dla tury.

ElevenAgents

  • Kolejkowanie połączeń i dźwięk oczekiwania: Dodaliśmy kolejkowanie połączeń dla agentów, którzy osiągnęli limit równoczesnych połączeń. Osoby w kolejce słyszą dźwięk oczekiwania i otrzymują zdarzenia queue_status, dopóki nie zostaną przyjęte lub nie minie limit czasu. Nowe metody API pozwalają przesyłać lub usuwać własny dźwięk oczekiwania.
  • Metadane wersji testowej: Wyniki testów agenta wskazują teraz wersję agenta, na której je uruchomiono, oraz to, czy obejmowały zmiany w wersji roboczej. Podsumowania wywołań pokazują też, kiedy częściowe ponowne przesłania uruchomiono na innych wersjach.
  • Metadane modelu i konta: Konfiguracja LLM agenta obsługuje teraz gemini-3.8-flash. Odpowiedzi kont WhatsApp wskazują, czy konto korzysta z Cloud API, czy z procesu rejestracji współistniejącej.

Muzyka

  • Obsługa API Music v2.5: Endpointy Music i SDK obsługują teraz music_v2_5. Fragmenty generowania planu kompozycji obsługują do 6132 znaków, maksymalnie 30 wierszy po 200 znaków.

Wydania SDK

JavaScript SDK

  • v2.68.0 - Dodano metody przesyłania i usuwania dźwięku oczekiwania agenta. Wygenerowano ponownie typy dla kolejkowania połączeń, odwołań do procedur, tworzenia gałęzi wersji roboczej, limitów zapytań RAG, metadanych wersji testowej, gemini-3.8-flash i music_v2_5.

Python SDK

  • v2.68.0 - Dodano synchroniczne i asynchroniczne metody przesyłania oraz usuwania dźwięku oczekiwania agenta. Wygenerowano ponownie typy dla kolejkowania połączeń, procedur, tworzenia gałęzi wersji roboczej, limitów zapytań RAG, metadanych wersji testowej, gemini-3.8-flash i music_v2_5. Wrapper compose_detailed obsługuje teraz każdy wygenerowany identyfikator modelu muzycznego oraz plany kompozycji oparte na promptach i fragmentach.

iOS SDK

  • v3.3.1 - Uzgadnia wiadomości agenta według response_id zamiast event_id, zachowując wiele odpowiedzi wokół wywołań narzędzi i zapobiegając przypinaniu przesyłanych części lub poprawek do niewłaściwej wiadomości.

ElevenLabs CLI

  • v1.3.0 - Dodano opcjonalne metadane --intent do generowanych poleceń API. Dodano elevenlabs feedback missing-capability do zgłaszania workflow, których CLI nie obsługuje.

Pakiety

  • @elevenlabs/convai-widget-core@0.18.2 i @elevenlabs/convai-widget-embed@0.18.2 - Naprawiono zduplikowane odpowiedzi agenta po wywołaniach narzędzi i procedur. Przesyłane odpowiedzi tekstowe zachowują formatowanie Markdown, a rozmowy głosowe nie renderują już niewypowiedzianych przesyłanych części czatu. Pakiet embed ogranicza też zdarzenia user_activity do jednego na sekundę i usuwa limit po zakończeniu sesji.

API

Zobacz zmiany w API

Nowe endpointy

ElevenAgents

  • Prześlij dźwięk oczekiwania agenta - POST /v1/convai/agents/{agent_id}/hold-audio
    • Przyjmuje wymagany hold_audio_file (binarny) jako dane formularza multipart. Plik musi być w formacie MP3 lub WAV, mieć maksymalnie 40 MB i 180 sekund.
    • Zwraca wymagane agent_id (string) i hold_audio (AgentHoldAudioConfig). Obiekt dźwięku oczekiwania wymaga audio_path, audio_url, original_filename (string), duration_secs (number) i size_bytes (integer).
  • Usuń dźwięk oczekiwania agenta - DELETE /v1/convai/agents/{agent_id}/hold-audio
    • Usuwa własny klip, aby osoby w kolejce słyszały domyślny ton oczekiwania.
    • Zwraca wymagane agent_id (string).

Zaktualizowane endpointy

ElevenAgents

  • Utwórz agenta, Pobierz agenta i Zaktualizuj agenta
    • Dodano opcjonalne platform_settings.queueing_config (AgentQueueingConfig) z enabled (boolean, domyślnie false) i wait_timeout_seconds (integer, 1–1800, domyślnie 180).
    • Odpowiedzi konfiguracji kolejki zawierają tylko do odczytu nullable hold_audio (AgentHoldAudioConfig). Odpowiedzi agenta zawierają też opcjonalne default_hold_audio_url (string).
  • Pobierz rozmowę - GET /v1/convai/conversations/{conversation_id}
    • Metadane dodają opcjonalne nullable queue_wait_secs (number). Czas w kolejce nie jest uwzględniany w call_duration_secs ani rozliczanym czasie.
  • Utwórz gałąź agenta - POST /v1/convai/agents/{agent_id}/branches
    • Dodano opcjonalne include_draft (boolean, domyślnie false). Gdy ma wartość true, gałąź utworzona z końca gałęzi obejmuje zestaw procedur z wersji roboczej wywołującego.
  • Wyświetl procedury oraz endpointy tworzenia, pobierania i wersji roboczej procedur
    • Elementy listy dodają opcjonalne referenced_tool_ids, referenced_kb_ids, referenced_procedure_ids i referenced_dynamic_variables (tablice stringów).
    • Odpowiedzi agenta i podglądu scalania dodają opcjonalne procedures, mapę z kluczem będącym identyfikatorem procedury.
  • Wyświetl wywołania testowe - GET /v1/convai/test-invocations
    • Dodano opcjonalne nullable search (string) do filtrowania testów i folderów według nazwy.
  • Uruchom testy agenta i Pobierz wywołanie testowe
    • Odpowiedzi wywołania zestawu testów i uruchomienia testu jednostkowego dodają opcjonalne nullable version_id (string) oraz opcjonalne ran_against_draft (boolean, domyślnie false).
    • Podsumowania wywołań dodają też opcjonalne runs_diverged_from_version (boolean, domyślnie false).
  • POST /v1/convai/agents/{agent_id}/knowledge-base/rag-query
    • Treść żądania dodaje opcjonalne nullable nadpisania specyficzne dla zapytania: max_documents_length (integer, 1–50 000) i max_retrieved_rag_chunks_count (integer, 1–20).
  • Pobierz konto WhatsApp - GET /v1/convai/whatsapp-accounts/{phone_number_id}
    • Dodano opcjonalne account_type (WhatsAppAccountType, domyślnie cloud_api). Wartości to cloud_api i coexistence.
  • Oblicz oczekiwane użycie LLM - POST /v1/convai/agent/{agent_id}/llm-usage/calculate
    • LLMUsageCalculatorLLMResponseModel dodaje wymagane price_per_message (number).

Muzyka

  • MusicModelID dodaje music_v2_5 dla POST /v1/music/video-to-music, POST /v1/music/plan, Twórz muzykę, POST /v1/music/detailed, POST /v1/music/detailed/stream, POST /v1/music/stream, POST /v1/music/upload i POST /v1/music/finetunes.
  • GenerationChunk.text zwiększa maxLength z 6000 do 6132 znaków dla POST /v1/music/plan, POST /v1/music, POST /v1/music/detailed, POST /v1/music/detailed/stream, POST /v1/music/stream i POST /v1/music/upload. Nazwy sekcji mogą zawierać 1–100 znaków, a fragmenty do 30 wierszy po 200 znaków.

Zmiany w schemacie

ElevenAgents

  • Zdarzenia serwera w czasie rzeczywistym dodają queue_status. Wymagane queue_status_event.status przyjmuje waiting, admitted lub timed_out; timed_out poprzedza kod zamknięcia WebSocket 4300. Dźwięk oczekiwania nadal jest dostarczany jako zwykłe zdarzenia audio.
  • Enum LLM dodaje gemini-3.8-flash, w tym nadpisania inicjowania rozmowy.
  • Unie wyników narzędzi systemowych rozmowy dodają start_procedure_success, start_procedure_error, end_procedure_success i end_procedure_error.
  • FeaturesUsageCommonModel dodaje opcjonalne statusy funkcji freeform_procedure i structured_procedure.

Scribe v2 Medical

Scribe v2 Medical jest teraz ogólnie dostępny. To model wsadowego rozpoznawania mowy wyspecjalizowany w nagraniach medycznych i klinicznych, rozliczany w tej samej stawce co Scribe v2.

Przekaż scribe_v2_medical jako model_id w Utwórz transkrypcję. Podpowiedzi słów kluczowych, wykrywanie encji, diarizacja mówców i tryb bez dosłownej transkrypcji działają tak samo jak w Scribe v2.

Modele

ID modelu, funkcje i informacje, kiedy używać Scribe v2 Medical.

Utwórz transkrypcję

Transkrybuj audio z model_id ustawionym na scribe_v2_medical.

ElevenAgents

  • Zgłoszenia rozmów dla całego workspace: Dodano Listę zgłoszeń workspace, aby pobierać zgłoszenia triage rozmów ze wszystkich dostępnych agentów. Filtruj według statusu lub przypisanej osoby i używaj paginacji kursorem, aby pobrać do 100 zgłoszeń na stronę.
  • Filtry rozmów według zmiennych dynamicznych: Lista rozmów i Wyszukiwanie tekstowe wiadomości rozmów przyjmują teraz powtarzalne filtry dynamic_variable_params. Użyj name:op:value z eq, gt, gte, lt lub lte; operatory porównania wymagają wartości numerycznych.
  • Wykrywanie automatycznej sekretarki Twilio: Konfiguracje telefonii wychodzącej i połączeń wsadowych obsługują teraz opcjonalne twilio_machine_detection. Wybierz enable, aby wcześnie określić, czy odebrał człowiek czy automat, albo detect_message_end, aby zaczekać na koniec powitania poczty głosowej. Wyniki są przekazywane przez nowe zdarzenie webhooka answering_machine_detection.
  • Ograniczenia wartości zbieranych danych: Właściwości zbierania danych mogą teraz używać allowed_values, aby wskazać zmienną dynamiczną zawierającą dozwolone wartości. Poprzednie pole allowed_values_dynamic_variable jest przestarzałe.
  • Metadane agenta: Odpowiedzi Lista gałęzi agenta wskazują teraz, kiedy utworzono szkic i czy poprzedza on szczyt gałęzi. Podsumowania agenta i Speech Engine wymagają teraz voice_id.
  • Źródłowe URL-e bazy wiedzy: Fragmenty zapytań RAG agenta zawierają teraz wymagane nullable source_url, z monitorowanym URL-em dokumentów URL.
  • Załączniki w odpowiedziach agenta: Zdarzenia WebSocket agent_response zawierają teraz opcjonalne attachments. Każdy załącznik wymaga url i name, a może zawierać mime_type.

Workspace

  • Limity platformy dla kluczy API: Odpowiedzi dla kluczy API kont usług mogą teraz zawierać firmowe platform_limits dla kredytów, Professional Voice Clones oraz współbieżności TTS, Dubbing i Music.

Wydania SDK

JavaScript SDK

  • v2.67.0 - Dodano dynamicVariableParams do żądań listowania rozmów i wyszukiwania tekstowego. Wygenerowano ponownie typy dla wykrywania automatycznej sekretarki Twilio, ograniczeń wartości zbieranych danych, limitów platformy kluczy API, metadanych szkicu gałęzi agenta i źródłowych URL-i bazy wiedzy.

Python SDK

  • v2.67.0 - Dodano dynamic_variable_params do synchronicznych i asynchronicznych metod listowania rozmów i wyszukiwania tekstowego. Wygenerowano ponownie typy dla wykrywania automatycznej sekretarki Twilio, ograniczeń wartości zbieranych danych, limitów platformy kluczy API, metadanych szkicu gałęzi agenta i źródłowych URL-i bazy wiedzy. Klient zamiany tekstu na mowę w czasie rzeczywistym nie przekazuje już wewnętrznego znacznika pominięcia do połączenia.

ElevenLabs CLI

  • v1.2.0 - Dodano polecenie elevenlabs say i jego umiejętność agenta, wygenerowano ponownie powiązania poleceń API oraz ustawiono eleven_v3 jako domyślny model TTS.

Pakiety

  • @elevenlabs/client@1.25.0, @elevenlabs/react@1.15.2, @elevenlabs/react-native@1.2.27, @elevenlabs/convai-widget-core@0.18.1 i @elevenlabs/convai-widget-embed@0.18.1 - Ponownie wyeksportowano MessageAttachment z @elevenlabs/client, aby użytkownicy mogli importować ten typ bezpośrednio.
  • @elevenlabs/client@1.24.0, @elevenlabs/types@0.23.0, @elevenlabs/react@1.15.1, @elevenlabs/react-native@1.2.26, @elevenlabs/convai-widget-core@0.18.0 i @elevenlabs/convai-widget-embed@0.18.0 - Przekazano załączniki plików z odpowiedzi agenta do onMessage i dodano opcjonalne ustawienie sesji webRtc.singlePeerConnection. Widget lokalizuje też przyciski powitania i naprawia pomijane lub zduplikowane odpowiedzi czatu tekstowego.

API

Zobacz zmiany w API

Nowe endpointy

ElevenAgents

  • Lista zgłoszeń workspace - GET /v1/convai/triage-tickets
    • Zwraca zgłoszenia triage rozmów ze wszystkich agentów, do których wywołujący ma dostęp, posortowane od najnowszych.
    • Dodano opcjonalne parametry zapytania page_size (liczba całkowita, 1–100, domyślnie 100), status (AgentConversationTicketStatus), assignee_user_id (string lub unassigned) i cursor (string).
    • Zwraca GetAgentConversationTicketsPageResponseModel.

Zaktualizowane endpointy

ElevenAgents

  • Lista rozmów - GET /v1/convai/conversations
    • Dodano opcjonalne nullable dynamic_variable_params (powtarzalna tablica stringów). Każda wartość używa formatu name:op:value, gdzie op to eq, gt, gte, lt lub lte.
  • Wyszukiwanie tekstowe wiadomości rozmów - GET /v1/convai/conversations/messages/text-search
    • Dodano opcjonalne nullable dynamic_variable_params (powtarzalna tablica stringów) z tą samą składnią.
  • Połączenie wychodzące Twilio, Połączenie wychodzące SIP trunk, Połączenie wychodzące Exotel i Wyślij połączenia wsadowe
    • telephony_call_config używa teraz osobnych schematów wejścia i wyjścia.
    • Dodano opcjonalne nullable twilio_machine_detection (TwilioMachineDetectionConfig). Jego mode akceptuje enable lub detect_message_end i domyślnie ma wartość enable. Ustawienie jest ignorowane przez dostawców innych niż Twilio oraz w połączeniach przychodzących.
  • Importuj numer telefonu - POST /v1/convai/phone-numbers
    • Dodano opcjonalne nullable account_auth_token (string) dla importów kluczy API Twilio do weryfikacji podpisów webhooków przychodzących.

Zmiany w schematach

ElevenAgents

  • WebhookEventType zyskuje answering_machine_detection.
  • AgentBranchSummary zyskuje opcjonalne nullable draft_created_at (liczba całkowita) oraz opcjonalne draft_is_behind_tip (wartość logiczna, domyślnie false).
  • AgentKnowledgeBaseRagChunkResponseModel zyskuje wymagane nullable source_url (string).
  • AgentSummaryResponseModel i SpeechEngineSummaryResponse zyskują wymagane voice_id (string).
  • AnalysisProperty zyskuje opcjonalne nullable name (string) i allowed_values (AllowedValues). LiteralJsonSchemaProperty także zyskuje allowed_values. Oba oznaczają allowed_values_dynamic_variable jako przestarzałe.
  • DataCollectionResultCommonModel zyskuje opcjonalne nullable name (string).
  • WorkspaceApiKeyResponseModel zyskuje opcjonalne nullable platform_limits (PlatformLimits).
  • Narzędzie MCP Icon zyskuje opcjonalne nullable theme (light lub dark).
  • SMBToolConfig zyskuje warianty parametrów send_custom_email, create_service_quote_request i create_product_quote_request.
  • Schematy parametrów zapytań webhooków i konfiguracja połączeń telefonicznych używają teraz osobnych modeli wejścia i wyjścia.
  • Zdarzenia WebSocket agent_response zyskują opcjonalne attachments (tablica). Każdy element wymaga url i name (stringi) oraz przyjmuje opcjonalne mime_type (string).

ElevenCreative

  • ReferenceVideo.studio_clip używa teraz StudioClipLocator zamiast StudioClipReference. Pola i format przesyłania pozostają bez zmian.

ElevenAgents

  • Wprowadzanie danych z klawiatury telefonu: Konfiguracja rozmowy agenta obsługuje teraz opcjonalne dtmf_input_settings dla wprowadzania DTMF. Ustaw czas oczekiwania na cyfrę, użyj # jako znaku końca i ukryj wpisy z klawiatury w transkrypcjach, logach i analizie.
  • Historia załączników w rozmowie: Wpisy transkrypcji w Pobierz rozmowę zawierają teraz file_inputs — tablicę z ID, nazwą, typem MIME i URL-em każdego załączonego pliku.
  • Filtrowanie po tagach agenta: Lista agentów przyjmuje teraz opcjonalny parametr zapytania tags. Powtórz parametr, aby dopasować agentów z dowolnym z podanych tagów.
  • Kontekst kampanii wsadowej: Pobierz rozmowę identyfikuje teraz połączenia wsadowe za pomocą opcjonalnych metadanych campaign, zawierających wymagane campaign_id i campaign_lead_id.

Muzyka

  • Dane wizualne przebiegu fali: Szczegółowe generowanie muzyki, Strumieniowanie muzyki ze szczegółami i Prześlij muzykę przyjmują teraz opcjonalne with_waveform_visual (wartość logiczna, domyślnie false). Odpowiedzi z tą opcją zawierają tablicę liczb całkowitych waveform_visual o niskiej rozdzielczości, z czterema próbkami na sekundę.

Dubbing

  • Paginacja projektów: Lista projektów Dubbing i Lista języków docelowych ograniczają teraz page_size do zakresu 1–100. Filtrowanie statusu projektu obejmuje queued, a oba endpointy opisują użycie next_cursor do pobrania następnej strony.

Wydania SDK

JavaScript SDK

  • v2.66.0 - Dodano fileIds do sendMultimodalMessage, dzięki czemu jedna wiadomość może zawierać wiele załączników.

Python SDK

  • v2.66.0 - Dodano file_ids do send_multimodal_message, dzięki czemu jedna wiadomość może zawierać wiele załączników.

Android SDK

  • v0.12.2 - Zachowano callback onUnhandledClientToolCall podczas podłączania zdarzeń sesji. Nieobsłużone wywołania narzędzi klienta, które oczekują odpowiedzi, otrzymują teraz automatyczną odpowiedź z błędem zamiast pozostawać nierozwiązane.

ElevenLabs CLI

  • v1.1.0 - Wygenerowano ponownie powiązania poleceń API i dodano atrybucję żądań dla poleceń w workflow ElevenAgents. Polecenia dodają cmd/<command> do User-Agent CLI, dzięki czemu można rozróżnić żądania z workflow, takich jak agents push i agents create.

Pakiety

  • @elevenlabs/client@1.23.0, @elevenlabs/react@1.15.0, @elevenlabs/types@0.22.1, @elevenlabs/react-native@1.2.25, @elevenlabs/convai-widget-core@0.17.1 i @elevenlabs/convai-widget-embed@0.17.1 - Dodano fileIds do sendMultimodalMessage. Klient wysyła pola file i files dla zgodności, a React udostępnia zaktualizowane API klienta.

API

Zobacz zmiany w API

Zaktualizowane endpointy

ElevenAgents

  • Lista agentów - GET /v1/convai/agents
    • Dodano opcjonalne nullable tags (tablica stringów). Powtórz parametr zapytania, aby dopasować dowolny podany tag.
  • Utwórz agenta, Pobierz agenta i Zaktualizuj agenta
    • Dodano opcjonalne nullable conversation_config.conversation.dtmf_input_settings (DTMFInputConfig). Obsługuje dtmf_input_timeout (liczba, 0,5–10 sekund, domyślnie 2), hash_terminator (wartość logiczna, domyślnie true) i redact_input (wartość logiczna, domyślnie false).
    • Dodano opcjonalne sip_refer_play_dialtone (wartość logiczna, domyślnie true) do konfiguracji przekierowania numeru telefonu. Ustaw false, aby oryginalne połączenie pozostało ciche podczas wykonywania przekierowania SIP REFER.
    • Narzędzia systemowe procedur rozpoczęcia i zakończenia przyjmują teraz ProcedureVersionRef lub ProcedureDraftRef. Odwołania do szkiców wymagają procedure_id (string) i ustawiają version_id na null.
  • Pobierz rozmowę - GET /v1/convai/conversations/{conversation_id}
    • Dodano file_inputs (tablica ConversationHistoryTranscriptFileInputResponseModel) do wpisów transkrypcji. Każdy element wymaga file_id, original_filename, mime_type i file_url (stringi).
    • Dodano opcjonalne nullable campaign (BatchCallingCampaignInformation) do metadanych połączeń wsadowych. Obiekt wymaga campaign_id i campaign_lead_id (stringi).
    • Dodano dtmf do ChatSourceMedium.
  • Typy problemów zgłoszeń triage rozmów zyskują incorrect_information, documentation_gap, platform_bug i wrong_action.

Muzyka

  • Szczegółowe generowanie muzyki (POST /v1/music/detailed) i Strumieniowanie muzyki ze szczegółami (POST /v1/music/detailed/stream)
    • Dodano opcjonalne with_waveform_visual (wartość logiczna, domyślnie false).
    • Szczegółowe odpowiedzi zyskują nullable waveform_visual (tablica liczb całkowitych), próbkowane cztery razy na sekundę w zakresie od -1000 do 1000.
  • Prześlij muzykę - POST /v1/music/upload
    • Dodano opcjonalne with_waveform_visual (wartość logiczna, domyślnie false) oraz nullable waveform_visual (tablica liczb całkowitych) w odpowiedzi.

ElevenCreative

  • Utwórz projekt Studio i Utwórz podcast
    • quality_preset akceptuje teraz null, a domyślna wartość standard została usunięta ze schematu.

Dubbing

  • Lista projektów Dubbing - GET /v1/dubbing/project
    • page_size pozostaje opcjonalną liczbą całkowitą z domyślną wartością 20, ale wartości są teraz ograniczane do 1–100 zamiast odrzucane.
    • Filtr status dokumentuje teraz queued, preparing, ready i failed.
    • Przekaż next_cursor z poprzedniej odpowiedzi w cursor; pomiń go dla pierwszej strony.
  • Lista języków docelowych - GET /v1/dubbing/project/{project_id}/language
    • page_size pozostaje opcjonalną liczbą całkowitą z domyślną wartością 20, ale wartości są teraz ograniczane do 1–100 zamiast odrzucane.
    • Filtr status obsługuje queued, processing, completed, stale i failed.
    • Przekaż next_cursor z poprzedniej odpowiedzi w cursor; pomiń go dla pierwszej strony.

Zmiany w schematach

Workspace

  • PendingSubscriptionSwitchResponseModel.next_tier zyskuje grant.

ElevenLabs CLI

ElevenLabs CLI v1.0.0 jest już dostępne. Każda operacja ElevenLabs API jest dostępna jako podkomenda, z wynikami w formatach JSON, tabeli, YAML i CSV, automatyczną paginacją oraz uzupełnianiem poleceń w powłoce.

CLI oferuje też lokalne workflow konfiguracji dla ElevenAgents. Zapisuj konfiguracje agentów, narzędzi i testów jako pliki, synchronizuj je poleceniami push i pull, zarządzaj gałęziami, uruchamiaj testy, instaluj komponenty interfejsu ElevenLabs i wybieraj region rezydencji danych.

Dokumentacja CLI

Zainstaluj CLI, uwierzytelnij się i zarządzaj agentami jak kodem.

Procedury

Procedury są teraz ogólnie dostępne w ElevenAgents. Procedura zawiera instrukcje dotyczące konkretnego zadania oraz wyzwalacz, który określa, kiedy mają zastosowanie. W trakcie rozmowy agent ładuje odpowiednią procedurę, dzięki czemu jeden agent może obsługiwać różne zadania bez umieszczania wszystkich instrukcji w promcie systemowym.

Używaj procedur swobodnych, gdy agent może dostosować sformułowania lub kolejność instrukcji. Używaj procedur strukturyzowanych, gdy kroki muszą być wykonywane w określonej kolejności. Obu typów można używać wraz z workflow w tym samym agencie.

Przegląd procedur

Dowiedz się, kiedy używać procedur i czym różnią się od promptów oraz workflow.

Procedury swobodne

Twórz instrukcje w języku naturalnym, które agent może dostosować do rozmowy.

Procedury strukturyzowane

Określ typowane kroki, które agent wykonuje w stałej kolejności.

ElevenAgents

  • Tickety oceny rozmów: Dodaliśmy API do tworzenia ticketów dotyczących działania agentów, tworzenia ręcznych ticketów do dalszej obsługi, wyświetlania ticketów, przypisywania członków obszaru roboczego, aktualizacji statusu i osoby przypisanej oraz dodawania komentarzy do ticketu lub konkretnej tury.
  • Obserwowalność rozmów: Klienci realtime mogą otrzymywać zdarzenie context_usage po każdej zakończonej turze agenta. Zdarzenie podaje model, liczbę tokenów promptu i limit kontekstu modelu.

Wydania SDK

JavaScript SDK

  • v2.65.0 - Dodano klientów i typy dla ticketów oceny rozmów oraz zwięzłych podsumowań rozmów. API rozmów zyskują filtry procedury, nieprawidłowego wywołania narzędzia i sortowania; API procedur zyskują wybór wersji agenta; API tematów zyskują ustawienia szczegółów oceny i sortowanie według frustracji. Wydanie dodaje też pola częstotliwości odświeżania bazy wiedzy, środowiska testowego i integracji alertów oraz typy wiadomości realtime dla Dubbing.

Python SDK

  • v2.65.0 - Dodano klientów i typy dla ticketów oceny rozmów oraz zwięzłych podsumowań rozmów. API rozmów zyskują filtry procedury, nieprawidłowego wywołania narzędzia i sortowania; API procedur zyskują wybór wersji agenta; API tematów zyskują ustawienia szczegółów oceny i sortowanie według frustracji. Wydanie dodaje też pola częstotliwości odświeżania bazy wiedzy, środowiska testowego i integracji alertów, a także zachowuje powtarzające się pola multipart dla keyterms w Speech to Text i webhook_ids w Dubbing.

Swift SDK

  • v3.3.0 - Dodano typowane parsowanie błędów klienta, obsługę expects_response i bezpieczne typowo wyniki narzędzi. Uruchamianie WebRTC jest teraz gotowe, gdy agent dołącza, zamiast czekać na subskrypcję ścieżki audio. Wydanie wzmacnia też obsługę URL-i, wycisza szum nieznanych zdarzeń i usuwa alokację wątku realtime z obsługi programowego wyciszania.

Pakiety

  • @elevenlabs/client@1.19.1, @elevenlabs/react@1.12.3, @elevenlabs/react-native@1.2.21, @elevenlabs/convai-widget-core@0.16.2 i @elevenlabs/convai-widget-embed@0.16.2 - Przechwytywanie wyjścia WebRTC korzysta teraz ze ścieżek AudioWorklet hostowanych samodzielnie przy restrykcyjnych zasadach bezpieczeństwa treści. Buforowanie workletów uwzględnia żądane źródło, dzięki czemu wcześniejszy wbudowany URL nie zastąpi ścieżki hostowanej samodzielnie. Błędy konfiguracji React Native wskazują teraz na @elevenlabs/react-native.
  • @elevenlabs/client@1.20.0, @elevenlabs/react@1.12.4, @elevenlabs/react-native@1.2.22, @elevenlabs/convai-widget-core@0.16.3 i @elevenlabs/convai-widget-embed@0.16.3 - Dodano opcjonalne webRtc.iceTransportPolicy. Ustaw je na relay, aby ograniczyć kandydatów WebRTC ICE do przekaźników TURN w sieciach blokujących bezpośredni ruch UDP.
  • @elevenlabs/client@1.21.0, @elevenlabs/react@1.13.0, @elevenlabs/types@0.21.1, @elevenlabs/react-native@1.2.23, @elevenlabs/convai-widget-core@0.16.4 i @elevenlabs/convai-widget-embed@0.16.4 - Dodano callback onContextUsage i typ ContextUsageEvent. React udostępnia callback przez useConversation. React Native rozwiązuje teraz moduły przez warunek eksportu pakietu zamiast wykrywania globalnego obiektu przeglądarki.
  • @elevenlabs/client@1.22.0, @elevenlabs/react@1.14.0, @elevenlabs/types@0.22.0, @elevenlabs/react-native@1.2.24, @elevenlabs/convai-widget-core@0.17.0 i @elevenlabs/convai-widget-embed@0.17.0 - Dodano rozbudowaną treść pierwszej wiadomości z odpowiedziami przycisków z atrybucją, onExternalAgentDisconnected i onMCPToolApprovalRequest. WebRTC używa teraz wybranego urządzenia wejściowego, zachowuje stan wyciszenia przy zmianie mikrofonu i przerywa konfigurację, jeśli nie można wysłać danych inicjujących. Widget dodaje status kolejki współbieżności, opcjonalny wybór języka na zwiniętym wyzwalaczu oraz renderowanie pierwszej wiadomości dla agentów obsługujących tekst i głos.

API

Zobacz zmiany w API

Nowe endpointy

ElevenAgents

  • Dodano dziewięć endpointów ticketów oceny rozmów:
    • Utwórz ticket rozmowy - POST /v1/convai/triage-tickets. Żądanie wymaga conversation_id (string) i akceptuje qa_comment (nullable string, 1–10 000 znaków) oraz do 200 komentarzy do tur.
    • Lista ticketów - GET /v1/convai/agents/{agent_id}/triage-tickets, z paginacją kursorową.
    • Utwórz ręczny ticket - POST /v1/convai/agents/{agent_id}/triage-tickets. Żądanie wymaga qa_comment (string, 1–10 000 znaków).
    • Lista użytkowników, którym można przypisać ticket - GET /v1/convai/agents/{agent_id}/triage-tickets/assignable-users. Odpowiedź zawiera członków obszaru roboczego, którzy nie są kontami usługowymi, oraz informację, czy każdy z nich ma dostęp do agenta.
    • Pobierz ticket - GET /v1/convai/triage-tickets/{agentqa_ticket_id}.
    • Zaktualizuj ticket - PATCH /v1/convai/triage-tickets/{agentqa_ticket_id}. Żądanie akceptuje opcjonalne status i nullable assignee_user_id.
    • Usuń ticket - DELETE /v1/convai/triage-tickets/{agentqa_ticket_id}.
    • Dodaj komentarz - POST /v1/convai/triage-tickets/{agentqa_ticket_id}/comments. Żądanie wymaga comment (string, 1–10 000 znaków).
    • Dodaj komentarz do tury - POST /v1/convai/triage-tickets/{agentqa_ticket_id}/turn-comments. Żądanie wymaga indeksu turn_index od zera (integer) oraz comment (string, 1–10 000 znaków).

Zaktualizowane endpointy

ElevenAgents

  • Pobierz podpisany URL - GET /v1/convai/conversation/get-signed-url
    • Dodano opcjonalne debug_events_request (boolean, domyślnie false). Zdarzenia debugowania wymagają dostępu edytora do agenta.
  • Pobierz token WebRTC - GET /v1/convai/conversation/token
    • Dodano opcjonalne debug_events_request (boolean, domyślnie false). Starsza ścieżka GET /v1/convai/conversation/get_signed_url akceptuje ten sam parametr.
  • Lista rozmów - GET /v1/convai/conversations
    • Dodano opcjonalne triggered_procedure_ids (nullable string array, maksymalnie 50), aby dopasować rozmowy, w których uruchomiono dowolną wskazaną procedurę.
    • Dodano opcjonalne include_invalid_tool_calls (boolean, domyślnie false), aby uwzględniać wywołania narzędzi, które się nie uruchomiły.
    • Dodano opcjonalne sort_direction (asc lub desc, domyślnie desc) dla czasu rozpoczęcia połączenia.
  • Wyszukaj tekstowo wiadomości w rozmowach - GET /v1/convai/conversations/messages/text-search
    • Dodano opcjonalne triggered_procedure_ids (nullable string array, maksymalnie 50).
    • Dodano opcjonalne include_invalid_tool_calls (boolean, domyślnie false).
  • Pobierz tematy rozmów agenta - GET /v1/convai/agents/{agent_id}/topics
    • Dodano opcjonalne include_evaluation_criteria (boolean, domyślnie true).
    • Dodano frustration do sort_by.
    • Odpowiedzi tematów zyskują nullable success_rate (number), a cała odpowiedź zyskuje aggregated_run_count (integer, domyślnie 0).
    • from_unix_secs jest zaokrąglane w dół do początku dnia UTC. Ograniczony zakres agreguje ukończone dzienne uruchomienia wykrywania; pominięcie obu granic zwraca najnowsze uruchomienie.
  • Lista procedur (GET /v1/convai/agents/{agent_id}/branches/{branch_id}/procedures) i Pobierz procedurę (GET /v1/convai/agents/{agent_id}/branches/{branch_id}/procedures/{procedure_id})
    • Dodano opcjonalne nullable agent_version_id (string), aby pobierać procedury z konkretnej wersji agenta.
  • Utwórz test i Zaktualizuj test
    • Dodano opcjonalne nullable environment (string) do schematów testów jednostkowych odpowiedzi, symulacji i wywołań narzędzi. Wartość wybiera adresy URL, nagłówki i połączenia autoryzacji dla danego środowiska; domyślnie jest to production.
  • Utwórz dokument z URL, Utwórz zadanie crawlowania i Utwórz folder
    • Dodano opcjonalne nullable minimum_frequency_days (integer, 1–180) dla automatycznej synchronizacji. Wartość domyślna to 7, a częstotliwość bardziej restrykcyjnego folderu nadrzędnego ma pierwszeństwo.

Music

  • Lista Music Finetunes - GET /v1/music/finetunes
    • Zwiększono maksymalne page_size ze 100 do 150. Wartość domyślna nadal wynosi 50.

Zmiany schematów

ElevenAgents

  • Żądania aktualizacji agenta zyskują opcjonalne nullable procedures (object<string, ProcedureVersionRef>). Każda wartość wymaga procedure_id i version_id (stringi). Pusty obiekt usuwa wszystkie procedury.
  • Konfiguracja inicjowania rozmowy zyskuje enable_procedure_ids_from_client (boolean, domyślnie false). Dane inicjujące zyskują opcjonalne nullable procedure_ids (string array); pusta tablica wyłącza wszystkie procedury dla agenta rozpoczynającego rozmowę.
  • ClientEvent zyskuje context_usage.
  • Zastąpienia soft timeout zyskują opcjonalne nullable additional_soft_timeout_messages (string array).
  • Stałe wartości w modelach analizy i zastępowania schematu akceptują teraz null.
  • Domyślne wartości konfiguracji widgetu dla mic_muting_enabled i transcript_enabled zmieniły się z false na true. Ustaw je jawnie na false, aby zachować wcześniejsze działanie.

Obszar roboczy

  • Odpowiedzi Pobierz użytkownika usunęły xi_api_key z UserResponseModel.
  • ResourceMetadataResponseModel.role_to_group_ids akceptuje teraz niestandardowe identyfikatory ról jako klucze zamiast ograniczać je do admin, editor, commenter i viewer.
  • Odpowiedzi bezpośredniego publikowania zyskują opcjonalne nullable restricted_to_user_email_domains (string array).
  • Odpowiedzi oczekującej zmiany subskrypcji dodają go do next_tier.

Serwer MCP

  • Lokalny serwer MCP wycofany: Lokalny serwer MCP ElevenLabs i odtwarzacz MCP zostały wycofane na rzecz hostowanego serwera MCP. Oba repozytoria są zarchiwizowane i nie będą już aktualizowane. Hostowany serwer jest dostępny pod adresem https://api.elevenlabs.io/v1/mcp, umożliwia logowanie na konto ElevenLabs przez OAuth i nie wymaga lokalnej instalacji ani klucza API. Instrukcje konfiguracji dla Claude, Cursor i innych klientów MCP znajdziesz w dokumentacji hostowanego serwera MCP.

ElevenCreative

  • API generowania obrazów, wideo i mowy: Nowe asynchroniczne API Flows tworzą, wyświetlają i pobierają generacje wideo, obrazów i mowy. Odpowiedzi generowania udostępniają stany pending, generating, completed i failed, a żądania mogą zawierać docelowy webhook dla zdarzeń ukończenia.
  • Media do ponownego użycia: Nowe API zasobów przesyłają, wyświetlają, pobierają i usuwają media workspace’u. Odwołania do obrazów, wideo i audio mogą używać przesłanego zasobu, wcześniejszej generacji lub danych base64 w treści, co pozwala łączyć zadania generowania w łańcuchy. Zobacz Odwołania i zasoby.

ElevenAgents

  • Lekkie podsumowania rozmów: Pobierz podsumowanie rozmowy zwraca wygenerowany tytuł, podsumowanie transkrypcji, wynik rozmowy oraz zwykłe wiadomości użytkownika lub agenta bez ładowania pełnej transkrypcji. Opcjonalny parametr zapytania max_messages jest liczbą całkowitą od 1 do 200 (domyślnie 40); w dłuższych rozmowach messages_omitted ma wartość true. Przydatne dla agentów, którzy muszą zachować kontekst.
  • Stronicowanie i sortowanie tematów rozmów: Pobierz tematy rozmów agenta dodaje opcjonalne stronicowanie kursorem i sortowanie. Użyj page_size (integer, 1–100), cursor (string), sort_by (conversations, sentiment lub success_rate) oraz sort_direction (asc lub desc). Odpowiedzi dodają has_more i nullable next_cursor.
  • Kolejki oczekiwania na współbieżność: Ustawienia platformy agenta dodają opcjonalne queueing (AgentQueueingConfig). Ustaw enabled na true, aby zatrzymać dzwoniących, gdy agent osiągnie limit współbieżności; wait_timeout_seconds to liczba całkowita do 1 800 (domyślnie 180).
  • Kontrola tur i workflow: Konfiguracja tury dodaje merge_with_default_ignore_terms (boolean, domyślnie false), aby łączyć własne terminy przerywania z wybranymi domyślnymi. Limity miękkie dodają disable_until_first_user_message (boolean, domyślnie false), a lokalizatory narzędzi workflow opcjonalne schema_overrides do nadpisywania parametrów dla poszczególnych węzłów.
  • Domyślne audio w tle: BackgroundSoundConfig.volume ma teraz domyślnie wartość 0.15 zamiast 0.6, a crossfade_loop — true zamiast false. Ustaw te pola jawnie, aby zachować wcześniejsze działanie.

Wydania SDK

JavaScript SDK

  • v2.64.0 - Dodano client.assets do przesyłania, wyświetlania, pobierania i usuwania zasobów oraz client.flows do asynchronicznego generowania wideo, obrazów i mowy. Konfiguracja tury dodaje mergeWithDefaultIgnoreTerms. Usunięto CustomToolApiSchemaConfig i scimExternalId z WorkspaceGroupResponseModel.

Python SDK

  • v2.64.0 - Dodano klientów zasobów i Flows do asynchronicznego generowania wideo, obrazów i mowy oraz merge_with_default_ignore_terms w konfiguracji tury. Konfiguracja sesji on-prem dodaje extra_setup_config do przekazywania dodatkowych pól wiadomości konfiguracyjnej.

Pakiety

  • @elevenlabs/client@1.18.0, @elevenlabs/react@1.12.1, @elevenlabs/types@0.20.0, @elevenlabs/react-native@1.2.19, @elevenlabs/convai-widget-core@0.16.0 i @elevenlabs/convai-widget-embed@0.16.0 - Dodano eksperymentalne sesje orkiestratora hostowanego samodzielnie i zdarzenia treści rozszerzonej. Worklety audio Scribe można teraz hostować samodzielnie na potrzeby rygorystycznych zasad bezpieczeństwa treści. Obsługa rozłączeń konsekwentnie osiąga teraz stan disconnected i zapobiega czyszczeniu nowszej sesji przez opóźnione callbacki. Widget renderuje szybkie odpowiedzi i linki w tekście, przywraca Markdown w transkrypcjach głosowych oraz naprawia pozycję menu języka w układach z container queries.
  • @elevenlabs/client@1.19.0, @elevenlabs/react@1.12.2, @elevenlabs/types@0.21.0, @elevenlabs/react-native@1.2.20 i @elevenlabs/convai-widget-core@0.16.1 - Dodano opcje Speech to Text w czasie rzeczywistym dla dodatkowych języków, wykrywania encji i filtrowania dźwięku w tle. Dodano zdarzenia końcowej transkrypcji, wykrytej encji i nieprawidłowego żądania; ujednolicono typy słów ze znacznikami czasu ze schematem na żywo; naprawiono też błędy uprawnień mikrofonu uniemożliwiające ponowne połączenie useScribe.

API

Zobacz zmiany w API

Nowe endpointy

ElevenCreative

  • Utwórz generację wideo - POST /v1/flows/video
  • Wyświetl generacje wideo - GET /v1/flows/video
  • Pobierz generację wideo - GET /v1/flows/video/{generation_id}
  • Utwórz generację obrazu - POST /v1/flows/image
  • Wyświetl generacje obrazów - GET /v1/flows/image
  • Pobierz generację obrazu - GET /v1/flows/image/{generation_id}
  • Utwórz generację mowy - POST /v1/flows/text-to-speech
  • Wyświetl generacje mowy - GET /v1/flows/text-to-speech
  • Pobierz generację mowy - GET /v1/flows/text-to-speech/{generation_id}
  • Prześlij zasób - POST /v1/assets
  • Wyświetl zasoby - GET /v1/assets
  • Pobierz zasób - GET /v1/assets/{asset_id}
  • Usuń zasób - DELETE /v1/assets/{asset_id}

ElevenAgents

  • Pobierz podsumowanie rozmowy - GET /v1/convai/conversations/{conversation_id}/summary
    • Akceptuje opcjonalne max_messages (integer, 1–200, domyślnie 40)
    • Zwraca GetConversationSummaryResponseModel z wymaganymi conversation_id, agent_id, status, message_count i note
    • Zwykłe messages zawierają tylko role (user lub agent) i message; rozmowy powyżej limitu zwracają messages_omitted: true

Zaktualizowane endpointy

ElevenAgents

  • Pobierz liczbę aktywnych - GET /v1/convai/analytics/live-count
    • Dodano opcjonalne agent_ids (tablica stringów, maksymalnie 25), które ma pierwszeństwo przed agent_id
  • Pobierz tematy rozmów agenta - GET /v1/convai/agents/{agent_id}/topics
    • Dodano opcjonalne page_size (integer, 1–100), cursor (string), sort_by (conversations, sentiment lub success_rate) i sort_direction (asc lub desc)
    • Odpowiedzi dodają has_more (boolean, domyślnie false) i nullable next_cursor (string)

Zmiany schematu

ElevenAgents

  • Dodano opcjonalne queueing (AgentQueueingConfig) do ustawień platformy agenta. Zawiera enabled (boolean, domyślnie false) i wait_timeout_seconds (integer większy od 0 i nie większy niż 1 800, domyślnie 180)
  • Dodano opcjonalne schema_overrides do WorkflowToolLocator; nadpisania stałe, zmiennych dynamicznych, LLM lub pominięcia dla poszczególnych węzłów mają pierwszeństwo przed nadpisaniami na poziomie narzędzia
  • Dodano merge_with_default_ignore_terms (boolean, domyślnie false) do konfiguracji tury i powiązanych schematów nadpisywania
  • Dodano disable_until_first_user_message (boolean, domyślnie false) do konfiguracji limitu miękkiego i powiązanych schematów nadpisywania
  • Dodano wymagane tylko do odczytu status (success, error, blocked lub skipped) do zdarzeń odpowiedzi narzędzia agenta w czasie rzeczywistym
  • Dodano avaya do źródeł inicjacji rozmów i avaya_api_key do metod autoryzacji
  • Dodano gemini-3.6-flash i gemini-3.7-flash do obsługiwanych wartości LLM agenta
  • Zmieniono wartość domyślną BackgroundSoundConfig.volume z 0.6 na 0.15, a crossfade_loop z false na true
  • Usunięto CustomToolApiSchemaConfig; użytkownicy wygenerowanych SDK importujący ten typ muszą usunąć import
  • Usunięto scim_external_id z WorkspaceGroupResponseModel