Scribe v2 Realtime
Scribe v2 Realtime, nasz najszybszy i najdokładniejszy model rozpoznawania mowy na żywo, jest już oficjalnie dostępny. Zapewnia najwyższą w branży dokładność w ponad 92 językach przy bardzo niskim opóźnieniu 150 ms. Dowiedz się więcej.
Platforma Agents
- Opinie po zakończeniu rozmowy w widżecie: Widżety obsługują teraz konfigurowalne zbieranie opinii po zakończeniu rozmowy z opcjonalnymi polami oceny i komentarza, dzięki czemu możesz zbierać opinie użytkowników bezpośrednio w rozmowach z agentem.
- Konfiguracja miękkiego limitu czasu: Dodaliśmy rozbudowane ustawienia miękkiego limitu czasu, które pozwalają określić, jak agenci reagują na pauzy w rozmowie, z konfigurowalnymi promptami i zachowaniem na poziomie tury i rozmowy.
- Zaawansowane filtrowanie rozmów: Endpoint rozmów obsługuje teraz filtrowanie według zakresu czasu trwania połączenia, parametrów oceny, parametrów zbierania danych i konkretnych nazw narzędzi.
- Ulepszone opinie o rozmowach: Zaktualizowaliśmy system opinii o rozmowach o ustrukturyzowane typy opinii, w tym oceny i komentarze, aby lepiej śledzić doświadczenia użytkowników.
ElevenCreative Studio
- Rozszerzone metadane projektu: Projects zawierają teraz pełne śledzenie zasobów z miniaturami wideo, referencjami do zewnętrznego audio i rozszerzonymi informacjami o migawkach, w tym czasem trwania audio.
Rozliczenia
- Ulepszone szczegóły faktur: Odpowiedzi dotyczące faktur zawierają teraz szczegółowe informacje o rabatach w nowej tablicy
discounts, zastępującej wycofane poladiscount_percent_offidiscount_amount_off. Polasubtotal_centsitax_centszapewniają czytelniejszy podział faktury.
Music API
- Krótsze opóźnienia przy rozdzielaniu ścieżek: Endpoint rozdzielania ścieżek został zaktualizowany, aby lepiej obsługiwać pliki audio i zapewniać bardziej przewidywalne opóźnienia przetwarzania żądań.
Wydania SDK
JavaScript SDK
- v2.23.0 - Zaktualizowano endpoint Speech to Text (Scribe) do
scribe_realtimei wyeksportowano dodatkowe typy TypeScript, by ułatwić pracę deweloperom. - v2.22.0 - Zaktualizowano o najnowsze zmiany schematu API, w tym filtrowanie rozmów, konfigurację miękkiego limitu czasu i funkcje opinii w widżetach.
Python SDK
- v2.22.1 - Zaktualizowano endpoint Speech to Text (Scribe) do
scribe_realtimei naprawiono problemy z cyklicznymi importami dla większej stabilności. - v2.22.0 - Zaktualizowano o najnowsze zmiany schematu API, w tym filtrowanie rozmów, konfigurację miękkiego limitu czasu i funkcje opinii w widżetach.
Pakiety Agents
- @elevenlabs/client@0.10.0 - Zaktualizowano konfigurację endpointu realtime i ulepszono dokumentację.
- @elevenlabs/react@0.10.0 - Zaktualizowano konfigurację endpointu realtime i ulepszono dokumentację.
- @elevenlabs/types@0.2.0 - Zaktualizowano definicje typów, aby odpowiadały najnowszym zmianom schematu API.
- @elevenlabs/react@0.9.2 - Drobne poprawki błędów i większa stabilność.
- @elevenlabs/convai-widget-embed@0.5.1 - Zaktualizowano funkcję osadzania widżetu o obsługę opinii po zakończeniu rozmowy.
- @elevenlabs/convai-widget-core@0.5.1 - Dodano konfigurację opinii po zakończeniu rozmowy do rdzenia widżetu.
- @elevenlabs/convai-widget-embed@0.5.0 - Dodano obsługę konfigurowalnego zbierania opinii po zakończeniu rozmowy.
- @elevenlabs/convai-widget-core@0.5.0 - Wprowadzono
WidgetEndFeedbackConfigiWidgetEndFeedbackTypedo obsługi opinii. - @elevenlabs/client@0.9.2 - Zaktualizowano konfigurację klienta o najnowsze zmiany API.
Android SDK
- v0.5.0 - Dodano funkcje
setVolumeigetVolumedo programowego sterowania audio oraz przykładową implementację z paskiem regulacji głośności w aplikacji demonstracyjnej.
API
Zobacz zmiany w API
Zaktualizowane endpointy
Platforma Agents
Zarządzanie rozmowami
-
- Dodano parametr zapytania
call_duration_min_secs(integer) do filtrowania rozmów według minimalnego czasu trwania połączenia - Dodano parametr zapytania
call_duration_max_secs(integer) do filtrowania rozmów według maksymalnego czasu trwania połączenia - Dodano parametr zapytania
evaluation_params(tablica ciągów) do filtrowania według kryteriów oceny - Dodano parametr zapytania
data_collection_params(tablica ciągów) do filtrowania według parametrów zbierania danych - Dodano parametr zapytania
tool_names(tablica ciągów) do filtrowania rozmów, które używały konkretnych narzędzi
- Dodano parametr zapytania
-
- Korzysta teraz z
ConversationFeedbackRequestModelz ustrukturyzowanymi typami opinii - Dodano pole
type, aby określić kategorię opinii - Dodano pole
ratingdla opinii liczbowej - Dodano pole
commentdla opinii tekstowej
- Korzysta teraz z
Konfiguracja agenta
- Pobierz widżet agenta
- Dodano pole
end_feedbackzWidgetEndFeedbackConfigdo konfiguracji zbierania opinii po zakończeniu rozmowy - Obsługuje opcjonalne pola oceny i komentarza w formularzach opinii
- Dodano pole
- Pobierz agenta i Zaktualizuj agenta
- Zaktualizowano schemat odpowiedzi o nowe opcje konfiguracji platformy
- Rozszerzono schemat żądania o dodatkowe pola ustawień
Konfiguracja tur i rozmów
-
Utwórz agenta, Symuluj rozmowę, Symuluj strumień rozmowy
- Dodano pole
soft_timeout_configdo sterowania zachowaniem podczas pauz w rozmowach - Dodano nadpisania konfiguracji
turnprzezTurnConfigOverrideiTurnConfigOverrideConfig - Dodano
initial_wait_timedoTurnConfigdo sterowania czasem początkowej odpowiedzi - Konfiguracja jest dostępna na poziomie rozmowy i nadpisania workflow
- Dodano pole
Testowanie
-
- Rozszerzono schemat żądania o obsługę wyrażeń workflow
- Zaktualizowano schemat odpowiedzi o dodatkowe pola wyników testów
-
- Odpowiedź zawiera rozszerzone dane wyników testu
- Zaktualizowano schemat wyników wyrażeń workflow
ElevenCreative Studio
-
- Dodano wymagane pole
assetszawierające filmy i referencje do zewnętrznego audio - Wprowadzono
ProjectVideoResponseModeldla metadanych zasobów wideo - Wprowadzono
ProjectExternalAudioResponseModeldo śledzenia zewnętrznego audio - Wprowadzono
ProjectVideoThumbnailSheetResponseModeldla miniatur wideo
- Dodano wymagane pole
-
- Przebudowano odpowiedź z nowym
ProjectSnapshotExtendedResponseModel - Dodano wymagane pole
audio_duration_secsdo danych migawki - Usunięto
character_alignmentszProjectSnapshotResponseModel - Wprowadzono
ProjectSnapshotsResponseModeldla kolekcji migawek
- Przebudowano odpowiedź z nowym
Rozliczenia
- Pobierz subskrypcję
- Dodano wymaganą tablicę
discountsz wpisamiDiscountResponseModel - Wycofano pole
discount_percent_off(nadal dostępne, ale oznaczone do usunięcia) - Wycofano pole
discount_amount_off(nadal dostępne, ale oznaczone do usunięcia) - Dodano pole
subtotal_cents(integer, nullable) dla sum faktur przed podatkiem - Dodano pole
tax_cents(integer, nullable) dla kwot podatku - Zaktualizowano przykłady faktur o nowe pola rabatów i sum
- Dodano wymaganą tablicę
Speech to Text
- Transkrybuj audio
- Zaktualizowano schemat odpowiedzi o rozszerzone dane transkrypcji
Text to Speech
-
Zamień tekst na mowę ze znacznikami czasu i Przesyłaj strumieniowo tekst na mowę ze znacznikami czasu
- Zaktualizowano schemat odpowiedzi o rozszerzone dane znaczników czasu
-
Zamień tekst na dialog ze znacznikami czasu i Przesyłaj strumieniowo tekst na dialog ze znacznikami czasu
- Zaktualizowano schemat odpowiedzi o rozszerzone dane znaczników czasu i segmentów głosowych
Zarządzanie głosami
-
Pobierz głos, Pobierz ustawienia głosu, Pobierz domyślne ustawienia głosu
- Zaktualizowano schematy odpowiedzi o nowe metadane głosu i pola konfiguracji
-
- Zaktualizowano schemat żądania zmiany ustawień głosu
-
- Zaktualizowano schemat odpowiedzi o nowe dane generowania głosu
Professional Voice Cloning (PVC)
- Pobierz próbkę audio PVC i Pobierz rozdzielone audio mówcy PVC
- Zaktualizowano schematy odpowiedzi dla pobierania próbek audio
Ustawienia językowe
- Modele ustawień językowych zawierają teraz pole
soft_timeout_translationdla zlokalizowanych komunikatów miękkiego limitu czasu
Wyzwalacze integracji API
- Zarejestrowano nową kolekcję API:
convai_api_integration_trigger_connections
Wycofania
- Pola faktury
discount_percent_offidiscount_amount_offsą wycofane; użyj zamiast nich tablicydiscounts