ElevenAgents

  • Zdarzenie WebSocket agent_response_complete: Nowe zdarzenie klienckie agent_response_complete uruchamia się dokładnie raz, gdy odpowiedź agenta zostanie w pełni dostarczona — po zakończeniu generowania przez LLM, wszystkich łańcuchów wywołań narzędzi i odtwarzania audio. Po tym zdarzeniu agent wygeneruje kolejne odpowiedzi tylko wtedy, gdy użytkownik poda nowe dane wejściowe lub limit czasu tury uruchomi nową turę. Zdarzenie pozwala klientom niezawodnie wykryć koniec tury, np. do grupowania wiadomości, aktywacji hasłem wybudzającym czy aktualizacji interfejsu po turze. Dodano nową wartość AGENT_RESPONSE_COMPLETE do enuma ClientEvent oraz odpowiadający jej model odpowiedzi AgentResponseCompleteClientEvent.

  • Tryb mowy przed użyciem narzędzia: Dodano nowe pole pre_tool_speech (enum PreToolSpeechMode, domyślnie auto) w konfiguracji serwera MCP i nadpisaniach dla poszczególnych narzędzi. Zastępuje wycofywany boolean force_pre_tool_speech. Wartości: auto decyduje, czy agent mówi przed wywołaniem narzędzia na podstawie ostatnich opóźnień narzędzi, force zawsze prosi agenta o wypowiedź, a off całkowicie wyłącza tę funkcję.

  • Wysyłanie narzędzi uwzględnia tryb wykonania: Węzły wysyłania narzędzi w workflow poprawnie uwzględniają teraz execution_mode każdego zagnieżdżonego narzędzia. Jeśli dowolne narzędzie w węźle wysyłania używa POST_TOOL_SPEECH, workflow czeka, aż audio bieżącej tury zostanie w pełni udostępnione, zanim wykona wysłanie.

  • Limit czasu odpowiedzi MCP: Dodano pole response_timeout_secs (liczba całkowita, domyślnie 30, min. 5, maks. 120) w konfiguracji serwera MCP i nadpisaniach dla poszczególnych narzędzi. Określa maksymalny czas oczekiwania na zakończenie każdego wywołania narzędzia MCP.

  • Kontekst zaufania agenta: Dodano pole trust_context w ustawieniach platformy agenta (enum AgentTrustContext: unknown | low | high, domyślnie unknown). low jest przeznaczone dla agentów obsługujących niezaufanych uczestników zewnętrznych, gdzie odpowiedzi powinny być weryfikowane, a dostęp do narzędzi ograniczony; high — dla agentów obsługujących właściciela, gdzie pełny dostęp do narzędzi jest odpowiedni; unknown obejmuje agentów utworzonych przed wprowadzeniem tej funkcji.

  • Przełącznik przypisania źródeł: Dodano boolean source_attribution (domyślnie false) w konfiguracji rozmowy. Gdy jest włączony i dostępna jest treść bazy wiedzy, LLM otrzymuje instrukcję, by podawać użyte źródła.

  • Filtr trybu udostępniania testów: Endpoint listy testów akceptuje teraz parametr zapytania sharing_mode (all | shared_with_me, domyślnie all), który filtruje testy i foldery tylko do tych udostępnionych bieżącemu użytkownikowi, których nie utworzył.

  • Ikony narzędzi i metadane wykonania: Dodano pola icons (tablica Icon) i execution (ToolExecution) do schematu Tool. Icon zawiera src, mimeType i sizes do wyświetlania w interfejsie, a ToolExecution.taskSupport (forbidden | optional | required) określa, jak narzędzie uczestniczy w zadaniach.

  • Domyślna wartość kompilatora procedur: Domyślna wartość ProcedureCompilerMode zmieniła się z deterministic na append, a wartość llm została usunięta. Nie wpływa to na istniejących agentów, którzy jawnie ustawiają deterministic.

  • Metadane przypisania RAG i bazy wiedzy: Dodano used_static_kb_document_ids (tablica ciągów) w ConversationHistoryTranscriptCommonModel i ConversationHistoryTranscriptResponseModel oraz used_chunk_ids w RagRetrievalInfo. Pokazują one dokładnie, które dokumenty bazy wiedzy i fragmenty RAG wpłynęły na każdą turę transkrypcji.

  • Refaktoryzacja zmiennych dynamicznych: dynamic_variables i dynamic_variable_placeholders odwołują się teraz do ujednoliconych schematów DynamicVariableValueType-Input / DynamicVariableValueType-Output (zamiast wcześniejszych schematów DynamicVariableContainerValueType-*), z szerszą obsługą wartości zagnieżdżonych i list. DynamicVariableAssignment zyskał pole preserve_native_type, które zachowuje typowane wartości zamiast wymuszać konwersję na ciągi.

Izolacja audio

  • Endpointy historii: Dwa nowe endpointy udostępniają historię izolacji audio.
    • Lista historii izolacji audio (GET /v1/audio-isolation/history) zwraca stronicowaną listę wszystkich wygenerowanych izolacji audio. Obsługuje parametry zapytania page_size, page i search.
    • Usuń element historii izolacji audio (DELETE /v1/audio-isolation/history/{history_item_id}) usuwa konkretny element i powiązane z nim pliki multimedialne.

Mowa na tekst

  • Keyterms w czasie rzeczywistym i tryb dosłowny: WebSocket Scribe w czasie rzeczywistym akceptuje teraz parametr keyterms (tablica ciągów, maks. 50 pozycji po maks. 20 znaków), aby ukierunkować model na określone terminy, oraz boolean no_verbatim, który usuwa z transkrypcji słowa wypełniające, fałszywe początki i niepłynności. Oba parametry są zwracane w zdarzeniu session_started. Dostępne w SDK JavaScript, SDK Python oraz klienckim SDK @elevenlabs/client dla przeglądarki/Node.

Wydania SDK

SDK Python

  • v2.45.0 - Ponowne wygenerowanie Fern dla schematu API z 27 kwietnia 2026 r., obejmujące endpointy historii izolacji audio, wykonania narzędzi, MCP pre_tool_speech i response_timeout_secs oraz zdarzenie klienckie agent_response_complete. Zawiera też poprawkę wskazówki dotyczącej instalacji w notebooku w README.
  • v2.44.0 - Ponowne wygenerowanie Fern dla schematu API z 21 kwietnia 2026 r., obejmujące pole trust_context, tryb pre_tool_speech, obsługę transkrypcji zasobów i konfigurację limitu czasu odpowiedzi MCP.

SDK JavaScript

  • v2.45.0 - Dodano opcje keyterms (tablica ciągów, maks. 50 keyterms po maks. 20 znaków) i noVerbatim (boolean) w kliencie Scribe w czasie rzeczywistym. keyterms są wysyłane jako powtarzane parametry zapytania w adresie URL WebSocket, aby ukierunkować transkrypcję, a noVerbatim usuwa słowa wypełniające i niepłynności. Oba pola dodano też do typowanego interfejsu Config dla echa session_started. Zawiera również ponowne wygenerowanie Fern z 27 kwietnia 2026 r. (#376).
  • v2.44.0 - Ponowne wygenerowanie Fern dla schematu API z 21 kwietnia 2026 r., obejmujące pole trust_context, tryb pre_tool_speech i konfigurację limitu czasu odpowiedzi MCP.

SDK Swift

  • v3.1.4 - Naprawiono problem, przez który lokalny mikrofon nadal przesyłał dane po rozłączeniu agenta (limit ciszy lub narzędzie end_call). onAgentDisconnected rozłącza teraz pokój LiveKit i czyści stan rozmowy, a onDisconnect wywołuje powód .agent. ConnectionManaging.onAgentDisconnected jest teraz async. Usunięto nieużywany wrapper ConversationConnectionManager.

Pakiety

API

Nowe endpointy

Zaktualizowane endpointy

ElevenAgents

  • Utwórz agenta, Pobierz agenta, Zaktualizuj agenta

    • Dodano pole trust_context (enum AgentTrustContext: unknown | low | high, domyślnie unknown) w AgentPlatformSettingsRequestModel
    • Dodano pole source_attribution (boolean, domyślnie false) w ConversationConfig
  • Zaktualizuj konfigurację serwera MCP, Utwórz serwer MCP

    • Dodano pole pre_tool_speech (enum PreToolSpeechMode: auto | force | off, domyślnie auto)
    • Dodano pole response_timeout_secs (liczba całkowita, domyślnie 30, min. 5, maks. 120)
  • Utwórz nadpisanie konfiguracji, Zaktualizuj nadpisanie konfiguracji

    • Dodano pole pre_tool_speech (enum PreToolSpeechMode, dopuszcza null, opcjonalne)
    • Dodano pole response_timeout_secs (liczba całkowita, dopuszcza null, opcjonalne)
    • Dodano pole response_mocks w MCPToolConfigOverride-Input / MCPToolConfigOverride-Output
    • Oznaczono force_pre_tool_speech jako wycofywane; używaj zamiast niego pre_tool_speech
  • Lista testów

    • Dodano opcjonalny parametr zapytania sharing_mode (enum TestSharingMode: all | shared_with_me, domyślnie all)
  • Symuluj rozmowę, Strumieniuj symulację rozmowy

    • Zrefaktoryzowano payloady dynamic_variables i dynamic_variable_placeholders, aby odwoływały się do ujednoliconych schematów DynamicVariableValueType-Input / DynamicVariableValueType-Output z szerszą obsługą wartości zagnieżdżonych i list
  • Schemat Tool

    • Dodano pole icons (tablica Icon, dopuszcza null) do wyświetlania w interfejsie
    • Dodano pole execution (ToolExecution, dopuszcza null), w tym taskSupport (forbidden | optional | required)
  • Enum ClientEvent

    • Dodano wartość agent_response_complete z nowym modelem odpowiedzi AgentResponseCompleteClientEvent
  • Enum ProcedureCompilerMode

    • Domyślna wartość zmieniła się z deterministic na append
    • Usunięto wartość llm
  • ConversationHistoryTranscriptCommonModel, ConversationHistoryTranscriptResponseModel

    • Dodano pole used_static_kb_document_ids (tablica ciągów)
  • RagRetrievalInfo

    • Dodano pole used_chunk_ids (tablica ciągów)
  • DynamicVariableAssignment

    • Dodano pole preserve_native_type (boolean) do zachowywania typowanych wartości zamiast wymuszania konwersji na ciągi
  • Węzły workflow

    • Dodano pole auto_advance_after_first_response w odpowiednich schematach węzłów workflow
  • Dokumentacja konfiguracji narzędzi

    • Dodano pole response_body_schema do dokumentowania oczekiwanego formatu odpowiedzi

Obszary robocze

  • GetUserSubscriptionResponseModel

    • Dodano pole max_credit_limit_extension
  • Pobierz użycie obszaru roboczego według produktu w czasie

    • Zaostrzono walidację żądania: minimalne wartości start_time i end_time podniesiono do 2020-01-01, a do obu pól dodano opisy. Podsumowanie endpointu zmieniono na Get Workspace Usage.

Inne

  • Nowy współdzielony enum Currency z wartościami eur, inr, usd, zastępujący w kilku schematach wbudowane ciągi walut.
  • Nowe schematy AssetTranscription i AssetTranscriptionData rozszerzają modele zasobów o obsługę transkrypcji.
  • Nowe PendingBlocksMetadataModel i PendingExternalAudiosMetadataModel zapewniają bogatsze metadane oczekujących zadań.
  • Dodano nową wartość InVPC do enumów związanych ze źródłami.
  • keyterms transkrypcji mają teraz w specyfikacji jawne ograniczenia długości.
  • Dodano nowe schematy MemoryEntrySearchResult, ConversationSource i ManualSource.