ElevenAgents

  • Mocki narzędzi dla konkretnych testów: Symulacje agentów i testy jednostkowe mogą teraz definiować tool_mock_overrides, z kluczem będącym ID narzędzia, aby zastępować współdzielone mocki w jednym teście. ToolResponseMockConfig dodaje też opcjonalne is_error (wartość logiczna, domyślnie false), dzięki czemu mock może testować ścieżki błędów narzędzia.
  • Przetłumaczone wiadomości workflow: Dosłowne wiadomości węzła Say dodają text_translations, mapę kluczy językowych do obiektów TranslatedString. Pole jest opcjonalne na wejściu i wymagane na wyjściu, więc ścisłe walidatory odpowiedzi muszą je akceptować.
  • Filtry wersji rozmowy: Lista rozmów i Wyszukiwanie tekstowe w wiadomościach rozmów dodają opcjonalny parametr zapytania version_id (ciąg znaków), aby filtrować wyniki według wersji agenta.
  • Narzędzie systemowe bazy wiedzy: Konfiguracja agenta dodaje narzędzie systemowe knowledge_base z konfigurowalnym enabled_strategies (SearchStrategy[]). Zapytania RAG bazy wiedzy agenta dodają opcjonalne use_agent_defaults (wartość logiczna, domyślnie true); ustaw false, aby używać neutralnych ustawień pobierania przy zachowaniu modelu osadzania agenta.
  • Wykrywanie aktywności głosowej agenta: Schematy tworzenia, aktualizacji, odpowiedzi i nadpisywania workflow agenta dodają konfigurację vad. VADConfig obecnie obsługuje background_voice_detection (wartość logiczna, domyślnie false).
  • Niestandardowe LLM przez WebSocket: CustomLLMAPIType dodaje websocket.
  • Kontrola pamięci plików: Konfiguracja wejścia plików widżetu dodaje max_files_in_memory (liczba całkowita, 1–30, domyślnie 10). Pliki ponad limit są podsumowywane i zwalniane z pamięci; max_files_per_conversation musi wynosić -1 lub co najmniej limit pamięci.
  • Redagowanie danych wejściowych DTMF: DTMFInputConfig dodaje opcjonalne redact_input (wartość logiczna, domyślnie false), aby zastępować cyfry klawiatury dzwoniącego w transkrypcjach, logach rozmów i analizie. Cyfry powtarzane przez agenta lub przekazywane do narzędzi pozostają bez zmian.

Mowa na tekst

  • Wykrywanie encji w czasie rzeczywistym: Scribe v2 Realtime dodaje opcję zapytania entity_detection. Akceptuje all, jeden typ lub kategorię encji albo tablicę typów i kategorii, a wykryte encje emituje w zdarzeniach committed_transcript_entities. Obsługiwane kategorie znajdziesz w przewodniku po wykrywaniu encji.

Głosy

  • Replikacja głosów między lokalizacjami danych: Dodaliśmy POST /v1/voices/{voice_id}/replicate-to-isolated-environment do kopiowania głosu Instant Voice Clone lub Voice Design do obszaru roboczego w tej samej skonsolidowanej grupie rozliczeniowej. Żądania wymagają target_workspace_id (ciąg znaków) i akceptują preserve_voice_id (wartość logiczna, domyślnie true); odpowiedzi zwracają docelowe voice_id.
  • Metadane postaci: Odpowiedzi postaci dodają recommended_voice_ids (tablica ciągów znaków, domyślnie []), metadane dodają role (CharacterRole) dopuszczające null, a CharacterAge zastępuje middle-aged przez middle_aged.

Wydania SDK

Pakiety

Serwer MCP

  • v0.12.1 - Zawiera aktualizacje narzędzi v0.11 i odświeżenie zależności, które rozwiązuje 44 alerty bezpieczeństwa.
  • v0.11.0 - Dodano simulate_conversation z konfigurowalnym zachowaniem symulowanego użytkownika, kryteriami oceny, wyjściem transkrypcji i analizą zaliczenia/niezaliczenia. Narzędzie speech_to_text używa teraz domyślnie scribe_v2, a voice_clone wysyła teraz zawartość plików audio zamiast ciągów ścieżek.

API

Nowe endpointy

Głosy

  • POST /v1/voices/{voice_id}/replicate-to-isolated-environment
    • Powiela głos Instant Voice Clone lub Voice Design w izolowanym środowisku innego obszaru roboczego
    • Wymaga target_workspace_id (ciąg znaków)
    • Akceptuje opcjonalne preserve_voice_id (wartość logiczna, domyślnie true)
    • Zwraca wymagane voice_id (ciąg znaków)

Zaktualizowane endpointy

ElevenAgents

  • Lista rozmów - GET /v1/convai/conversations
    • Dodano opcjonalny parametr zapytania version_id (ciąg znaków)
  • Wyszukiwanie tekstowe w wiadomościach rozmów - GET /v1/convai/conversations/messages/text-search
    • Dodano opcjonalny parametr zapytania version_id (ciąg znaków)
  • POST /v1/convai/agents/{agent_id}/knowledge-base/rag-query
    • Dodano opcjonalne pole żądania use_agent_defaults (wartość logiczna, domyślnie true)

Zmiany schematu

ElevenAgents

  • Dane symulacji i testów jednostkowych dodają opcjonalne mapy tool_mock_overrides; ToolResponseMockConfig dodaje opcjonalne is_error (wartość logiczna, domyślnie false)
  • SayNodeLiteralMessage dodaje text_translations (mapa TranslatedString); pole jest opcjonalne na wejściu i wymagane na wyjściu
  • Konfiguracja agenta dodaje knowledge_base (KnowledgeBaseToolConfig) i vad (VADConfig)
  • CustomLLMAPIType dodaje websocket
  • FileInputConfig dodaje max_files_in_memory (liczba całkowita, 1–30, domyślnie 10)
  • DTMFInputConfig dodaje opcjonalne redact_input (wartość logiczna, domyślnie false)
  • Konfiguracja agenta czasu rzeczywistego używa teraz domyślnie eleven_realtime_v1_mini

Głosy

  • Odpowiedzi postaci dodają recommended_voice_ids (tablica ciągów znaków, domyślnie [])
  • Metadane postaci dodają role (CharacterRole) dopuszczające null
  • Niekompatybilna zmiana: CharacterAge zastępuje middle-aged przez middle_aged; klienci wysyłający starą wartość muszą przejść migrację

Text to Speech

  • Niekompatybilna zmiana: usunięto AudioFilterId i audio_filter ze schematów konfiguracji Text to Speech dla ElevenAgents