For AI agents: a documentation index is available at the root level at /llms.txt. Append /llms.txt to any URL for a page-level index, or .md for the markdown version of any page.
Mocki narzędzi dla konkretnych testów: Symulacje agentów i testy jednostkowe mogą teraz definiować tool_mock_overrides, z kluczem będącym ID narzędzia, aby zastępować współdzielone mocki w jednym teście. ToolResponseMockConfig dodaje też opcjonalne is_error (wartość logiczna, domyślnie false), dzięki czemu mock może testować ścieżki błędów narzędzia.
Przetłumaczone wiadomości workflow: Dosłowne wiadomości węzła Say dodają text_translations, mapę kluczy językowych do obiektów TranslatedString. Pole jest opcjonalne na wejściu i wymagane na wyjściu, więc ścisłe walidatory odpowiedzi muszą je akceptować.
Narzędzie systemowe bazy wiedzy: Konfiguracja agenta dodaje narzędzie systemowe knowledge_base z konfigurowalnym enabled_strategies (SearchStrategy[]). Zapytania RAG bazy wiedzy agenta dodają opcjonalne use_agent_defaults (wartość logiczna, domyślnie true); ustaw false, aby używać neutralnych ustawień pobierania przy zachowaniu modelu osadzania agenta.
Wykrywanie aktywności głosowej agenta: Schematy tworzenia, aktualizacji, odpowiedzi i nadpisywania workflow agenta dodają konfigurację vad. VADConfig obecnie obsługuje background_voice_detection (wartość logiczna, domyślnie false).
Niestandardowe LLM przez WebSocket: CustomLLMAPIType dodaje websocket.
Kontrola pamięci plików: Konfiguracja wejścia plików widżetu dodaje max_files_in_memory (liczba całkowita, 1–30, domyślnie 10). Pliki ponad limit są podsumowywane i zwalniane z pamięci; max_files_per_conversation musi wynosić -1 lub co najmniej limit pamięci.
Redagowanie danych wejściowych DTMF: DTMFInputConfig dodaje opcjonalne redact_input (wartość logiczna, domyślnie false), aby zastępować cyfry klawiatury dzwoniącego w transkrypcjach, logach rozmów i analizie. Cyfry powtarzane przez agenta lub przekazywane do narzędzi pozostają bez zmian.
Mowa na tekst
Wykrywanie encji w czasie rzeczywistym: Scribe v2 Realtime dodaje opcję zapytania entity_detection. Akceptuje all, jeden typ lub kategorię encji albo tablicę typów i kategorii, a wykryte encje emituje w zdarzeniach committed_transcript_entities. Obsługiwane kategorie znajdziesz w przewodniku po wykrywaniu encji.
Głosy
Replikacja głosów między lokalizacjami danych: Dodaliśmy POST /v1/voices/{voice_id}/replicate-to-isolated-environment do kopiowania głosu Instant Voice Clone lub Voice Design do obszaru roboczego w tej samej skonsolidowanej grupie rozliczeniowej. Żądania wymagają target_workspace_id (ciąg znaków) i akceptują preserve_voice_id (wartość logiczna, domyślnie true); odpowiedzi zwracają docelowe voice_id.
Metadane postaci: Odpowiedzi postaci dodają recommended_voice_ids (tablica ciągów znaków, domyślnie []), metadane dodają role (CharacterRole) dopuszczające null, a CharacterAge zastępuje middle-aged przez middle_aged.
v0.12.1 - Zawiera aktualizacje narzędzi v0.11 i odświeżenie zależności, które rozwiązuje 44 alerty bezpieczeństwa.
v0.11.0 - Dodano simulate_conversation z konfigurowalnym zachowaniem symulowanego użytkownika, kryteriami oceny, wyjściem transkrypcji i analizą zaliczenia/niezaliczenia. Narzędzie speech_to_text używa teraz domyślnie scribe_v2, a voice_clone wysyła teraz zawartość plików audio zamiast ciągów ścieżek.
API
Zobacz zmiany w API
Nowe endpointy
Głosy
POST /v1/voices/{voice_id}/replicate-to-isolated-environment
Powiela głos Instant Voice Clone lub Voice Design w izolowanym środowisku innego obszaru roboczego