ElevenAgents
-
Zakres narzędzi MCP w workflow agentów: Węzły workflow agentów mogą teraz ograniczać, które narzędzia MCP subagent może wywoływać. Gdy dziedziczenie narzędzi jest wyłączone dla węzła, dla tego subagenta ładowane są tylko wyraźnie wybrane narzędzia MCP, co daje zespołom precyzyjną kontrolę nad dostępem do narzędzi na każdym etapie workflow.
-
Przesyłanie plików w rozmowach: Endpointy create agent i update agent obsługują teraz pole
file_inputwConversationConfig. Po włączeniu użytkownicy końcowi mogą dodawać do czatu obrazy lub pliki PDF (wymaga LLM z obsługą wejścia multimodalnego). Konfiguracja za pomocąenabled(boolean) imax_files_per_conversation(integer). -
Ponowne uruchamianie analizy rozmowy: Nowy endpoint run conversation analysis (
POST /v1/convai/conversations/{conversation_id}/analysis/run) ponownie ocenia zakończoną rozmowę według aktualnych kryteriów oceny i ustawień zbierania danych agenta, bez potrzeby wykonywania nowego połączenia. -
Mockowanie odpowiedzi narzędzi w testach: Testy symulacji agentów i uruchomienia zestawów testów obsługują teraz pole
tool_mock_config, które pozwala określić obsługę wywołań narzędzi podczas testowania. UżyjMockingStrategy(all,selected,none), aby wybrać mockowane narzędzia, orazMockNoMatchBehavior(call_real_tool,raise_error), aby ustawić zachowanie awaryjne, gdy żaden mock nie pasuje. -
Kolejność sortowania wyszukiwania tekstowego: Endpoint text search conversations przyjmuje teraz parametr zapytania
sort_byz wartościamisearch_score(domyślna) lubcreated_at, dzięki czemu możesz określić, czy wyniki są sortowane według trafności, czy daty. -
Połączenia uwierzytelniane mTLS: Połączenia uwierzytelniania agentów obsługują teraz wzajemny TLS (
mtls) jakoauth_type, obok istniejących opcji. Nowe schematyCreateMTLSAuthRequestiMTLSAuthResponsesą dostępne do tworzenia i pobierania połączeń uwierzytelnianych przez mTLS. -
Komunikat o maksymalnym czasie trwania: Dodano pole
max_conversation_duration_messagedo konfiguracji agenta. Gdy jest ustawione na niepusty ciąg znaków, agent wyśle użytkownikowi tę wiadomość po osiągnięciu maksymalnego czasu rozmowy. -
Gałąź i środowisko przy inicjowaniu rozmowy: Dodano opcjonalne pola
branch_idienvironmentdo danych klienta inicjujących rozmowę (ConversationInitiationClientDataRequest) oraz treści żądania submit batch call, co umożliwia kierowanie do konkretnych gałęzi i środowisk agentów.
Muzyka
- Wideo na muzykę: Nowy endpoint
POST /v1/music/video-to-musicgeneruje muzykę w tle z jednego lub kilku plików wideo. Filmy są łączone kolejno. Przyjmuje opcjonalnedescription(do 1000 znaków) itags(do 10 tagów stylu, takich jakupbeatlubcinematic), które wpływają na wygenerowany utwór.
Zamiana mowy na tekst
- Transkrypcja z URL: Endpoint convert speech to text przyjmuje teraz parametr
source_url(string, opcjonalny) do transkrypcji audio lub wideo z hostowanego adresu URL, w tym filmów z YouTube, TikToka i innych usług hostingu wideo. Może być używany zamiast bezpośredniego przesyłania pliku.
Głosy
- Łączna liczba na liście udostępnionych głosów: Odpowiedź list shared voices zawiera teraz pole
total_count, co ułatwia wdrożenie paginacji i wyświetlanie liczby wyników.
Wydania SDK
JavaScript SDK
- v2.41.0 - Dodano obsługę typu zdarzenia WebSocket
multimodal_messagew rozmowach ElevenAgents w czasie rzeczywistym. Zawiera regenerację Fern dla najnowszych aktualizacji schematu API. - v2.41.1 - Regeneracja Fern zgodna ze schematem API z 1 kwietnia 2026 r.
Python SDK
- v2.41.0 - Poprawiono opcjonalność
audio_interfacew trybie rozmowy tylko tekstowej, rozwiązując błąd w czasie działania przy rozpoczynaniu sesji bez audio. Zawiera regenerację Fern dla najnowszego schematu API.
Pakiety
To wydanie zawiera nowe wersje 1.0.0 Agent SDK po stronie klienta. Wprowadzają one ważne niekompatybilne zmiany w @elevenlabs/client, @elevenlabs/react i @elevenlabs/react-native. Przed aktualizacją zapoznaj się z poniższymi wskazówkami dotyczącymi migracji.
Aby ułatwić aktualizację, wydaliśmy Skill, który pomoże twoim agentom przeprowadzić ją za ciebie. Zainstaluj go poleceniem
Więcej o wydaniu v1 i jego ulepszeniach przeczytasz na naszym blogu dla deweloperów.
-
@elevenlabs/client@1.0.0 — Niekompatybilne zmiany:
- Klasy
InputiOutputnie są już eksportowane. Zamiast nich użyj interfejsówInputControlleriOutputControllerz@elevenlabs/client. Conversationnie jest już klasą — jest teraz obiektem przestrzeni nazw i aliasem typu dlaTextConversation | VoiceConversation. Usuń wszelkie sprawdzeniainstanceof Conversationi podklasy.- Domyślny
connectionTypejest teraz wywnioskowany z trybu rozmowy: rozmowy głosowe domyślnie używają"webrtc", a rozmowy tylko tekstowe —"websocket". Aby zachować wcześniejsze zachowanie dla głosu, przekaż jawnieconnectionType: "websocket". VoiceConversation.wakeLockjest teraz prywatne. PrzekażuseWakeLock: falsew opcjach sesji, aby wyłączyć zarządzanie blokadą wybudzenia.changeInputDevice()ichangeOutputDevice()zwracają terazPromise<void>zamiastPromise<Input>lubPromise<Output>.- Zastąp
conversation.input.analyser.getByteFrequencyData(data)przezconversation.getInputByteFrequencyData(). - Zastąp
conversation.input.setMuted(v)przezconversation.setMicMuted(v). - Zastąp
conversation.output.gain.gain.value = vprzezconversation.setVolume({ volume: v }). getInputVolume(),getOutputVolume(),getInputByteFrequencyData()igetOutputByteFrequencyData()zwracają teraz0lub pustą wartośćUint8Arrayzamiast zgłaszać błąd, gdy żadna rozmowa nie jest aktywna.
- Klasy
-
@elevenlabs/react@1.0.0 — Niekompatybilne zmiany:
useConversationwymaga teraz nadrzędnegoConversationProvider. Owiń drzewo komponentów w<ConversationProvider>i przenieś opcje do providera lub hooka.- Eksporty
DeviceFormatConfigiDeviceInputConfigzostały usunięte. Zamiast nich użyjFormatConfigiInputDeviceConfigz@elevenlabs/client. - Nowe szczegółowe hooki zastępują monolityczny
useConversation, aby poprawić wydajność renderowania:useConversationControls(),useConversationStatus(),useConversationInput(),useConversationMode(),useConversationFeedback()iuseRawConversation(). Każdy hook subskrybuje tylko potrzebny mu stan, zapobiegając niepotrzebnym ponownym renderowaniom. - Nowy hook
useConversationClientTool(name, handler)do rejestrowania narzędzi klienta, które mogą wywoływać agenci, z automatycznym czyszczeniem przy odmontowaniu. - Dodano obsługę kontrolowanego wyciszenia przez propsy
isMutedionMutedChangewConversationProvider.
-
@elevenlabs/react-native@1.0.0 — Niekompatybilne zmiany:
- Poprzednie API
ElevenLabsProvideriuseConversationzostało usunięte i zastąpione reeksportami z@elevenlabs/react. ZastąpElevenLabsProviderprzezConversationProvider, auseConversationprzez szczegółowe hooki (useConversationControls,useConversationStatusitd.). - W React Native pakiet przy imporcie dodaje polyfill globalnych obiektów WebRTC, konfiguruje natywny
AudioSessioni rejestruje specyficzną dla platformy strategię sesji głosowej.
- Poprzednie API
-
@elevenlabs/types@0.8.0 - Eksportuje tablicę środowiska uruchomieniowego
CALLBACK_KEYS, zawierającą wszystkie klucze z interfejsuCallbacks, używaną wewnętrznie przez React SDK do łączenia callbacków. -
@elevenlabs/client@0.16.0 - Dodano zdarzenie WebSocket serwer-klient
guardrail_triggeredoraz callbackonGuardrailTriggered, wywoływany, gdy serwer wykryje naruszenie zabezpieczeń podczas rozmowy. Dodano też dyskryminatory typu doTextConversationiVoiceConversation, aby umożliwić zawężanie unii dyskryminowanej, oraz przeciążeniastartSession, które zawężają typ zwracany zależnie od opcjitextOnly. -
@elevenlabs/react-native@0.6.0 - Dodano zdarzenie WebSocket
guardrail_triggeredi callbackonGuardrailTriggered, zgodne z@elevenlabs/client@0.16.0. -
@elevenlabs/client@1.1.0 - Dodano po stronie klienta obsługę mockowania odpowiedzi narzędzi w rozmowach agentów, umożliwiając scenariusze testowe symulujące wyniki wywołań narzędzi bez uruchamiania prawdziwych narzędzi.
-
@elevenlabs/types@0.9.0 - Dodano definicje typów do mockowania odpowiedzi narzędzi w rozmowach agentów.
-
@elevenlabs/react@1.0.1 - Zaktualizowano zależność do
@elevenlabs/client@1.1.0. -
@elevenlabs/react-native@1.0.1 - Zaktualizowano zależności do
@elevenlabs/client@1.1.0i@elevenlabs/react@1.0.1.
API
Wyświetl zmiany w API
Nowe endpointy
-
Uruchom analizę rozmowy -
POST /v1/convai/conversations/{conversation_id}/analysis/run- Ponownie uruchamia analizę zakończonej rozmowy według aktualnych kryteriów oceny i ustawień zbierania danych agenta. -
POST /v1/music/video-to-music- Generuje muzykę w tle z jednego lub kilku plików wideo przesłanych jako dane formularza multipart.
Zaktualizowane endpointy
ElevenAgents
-
Utwórz agenta, Zaktualizuj agenta
- Dodano pole
file_input(FileInputConfig, opcjonalne) doConversationConfig, umożliwiające przesyłanie plików (obrazów, PDF-ów) w rozmowach na czacie, gdy LLM obsługuje wejście multimodalne - Dodano pole
max_conversation_duration_message(string, opcjonalne) do konfiguracji agenta — agent wysyła tę wiadomość po osiągnięciu limitu czasu sesji
- Dodano pole
-
- Dodano pole
tool_mock_config(object, opcjonalne) — mapę nazw narzędzi do wpisówToolResponseMockConfig, umożliwiającą kontrolę mockowania narzędzi podczas symulacji
- Dodano pole
-
- Dodano parametr zapytania
sort_by(string, opcjonalny) — przyjmujesearch_score(domyślna) lubcreated_at
- Dodano parametr zapytania
-
- Dodano pole
branch_id(string, opcjonalne), aby wskazać konkretną gałąź agenta - Dodano pole
environment(string, opcjonalne), aby określić docelowe środowisko
- Dodano pole
-
Wychodzące połączenie Twilio, Wychodzące połączenie SIP trunk
- Dane klienta inicjującego rozmowę przyjmują teraz opcjonalne pola
branch_idienvironment
- Dane klienta inicjującego rozmowę przyjmują teraz opcjonalne pola
Zamiana mowy na tekst
-
- Dodano parametr
source_url(string, opcjonalny) — przyjmuje URL do pliku audio lub wideo, filmu z YouTube, TikToka albo innych hostowanych multimediów jako alternatywę dla przesyłania pliku
- Dodano parametr
Głosy
-
- Dodano pole
total_count(integer) do modelu odpowiedzi
- Dodano pole
Wymuszone wyrównanie
-
- Usunięto parametr
enabled_spooled_filez treści żądania danych formularza multipart
- Usunięto parametr