For AI agents: a documentation index is available at the root level at /llms.txt. Append /llms.txt to any URL for a page-level index, or .md for the markdown version of any page.
Zamiana tekstu na mowę
- Obsługa formatu Opus: Dodaliśmy obsługę formatu Opus z próbkowaniem 48 kHz przy różnych bitrate’ach (32–192 kb/s).
- Lepsza obsługa błędów websocket: Zaktualizowaliśmy API websocket TTS, aby zwracało dokładniejsze kody błędów (1011 dla błędów wewnętrznych zamiast 1008), co ułatwia ich identyfikację i monitorowanie SLA.
- Połączenia wychodzące Twilio: Dodaliśmy natywną obsługę połączeń wychodzących.
- Nadpisywanie webhooka po rozmowie: Dodaliśmy możliwość nadpisania ustawień webhooka po rozmowie na poziomie agenta, co daje większą elastyczność konfiguracji.
- Wyświetlanie dużych dokumentów bazy wiedzy: Ulepszyliśmy interfejs bazy wiedzy, aby można było wyświetlać całą zawartość dużych dokumentów RAG.
- Dodano dynamiczną zmienną SID połączenia: Dodaliśmy
system__call_sid jako systemową zmienną dynamiczną, aby można było odwoływać się do identyfikatora połączenia w promptach i narzędziach.
ElevenCreative Studio
- Tryb aktora: Dodaliśmy Tryb aktora w ElevenCreative Studio, który pozwala używać własnych nagrań głosowych do kierowania brzmieniem mowy w projektach ElevenCreative Studio.
- Lepsze skróty klawiszowe: Zaktualizowaliśmy skróty do wyświetlania ustawień i skróty edytora, aby uniknąć konfliktów, oraz uprościliśmy skróty do blokowania akapitów.
Dubbing
- Duplikowanie dubbingu: Udostępniliśmy funkcję duplikowania dubbingu wszystkim użytkownikom.
- Generowanie pierwszego planu w trybie ręcznym: Dodaliśmy możliwość generowania audio na pierwszym planie podczas korzystania z trybu ręcznego z plikiem i CSV.
Głosy
- Ulepszone kolekcje głosów: Ulepszyliśmy kolekcje głosów o zmiany wizualne, filtrowanie według języka, ścieżkę nawigacji, obrazy kolekcji i przeciąganie myszą do nawigacji po karuzeli.
- Filtrowanie według ustawień regionalnych: Dodaliśmy parametr locale do endpointu wspólnych głosów, aby precyzyjniej filtrować głosy.
API