Zamiana mowy na tekst

  • scribe_v1_experimental: Udostępniliśmy nową eksperymentalną wersję podglądową modelu Scribe v1 z lepszą obsługą plików audio w wielu językach, mniejszą liczbą halucynacji, gdy audio przeplata się z ciszą, oraz ulepszonymi tagami audio. Nowy model jest dostępny przez API pod nazwą scribe_v1_experimental

Zamiana tekstu na mowę

  • Obsługa formatu a-law: Dodaliśmy format a-law z próbkowaniem 8 kHz, aby umożliwić integrację z europejskimi systemami telefonicznymi.
  • Naprawiono problemy z limitem: Naprawiliśmy błąd bazy danych, przez który niektóre żądania były błędnie odrzucane jako przekraczające limit.

Platforma Agents

  • Filtrowanie według typu dokumentu: Dodaliśmy obsługę filtrowania dokumentów bazy wiedzy według ich typu (plik, URL lub tekst).
  • Agenci bez audio: Dodaliśmy obsługę agentów konwersacyjnych, którzy nie generują audio, ale nadal wysyłają transkrypcje odpowiedzi i mogą korzystać z narzędzi. Agentów bez audio można włączyć, usuwając zdarzenie klienta audio.
  • Ulepszone szablony agentów: Zaktualizowaliśmy wszystkie szablony agentów o lepsze konfiguracje i prompty. Więcej o ulepszaniu promptów systemowych przeczytasz tutaj.
  • Naprawiono zablokowane eksporty: Naprawiliśmy problem, przez który eksporty blokowały się na długi czas.

ElevenCreative Studio

  • Naprawiono normalizację głośności: Naprawiliśmy problem ze strumieniowaniem migawek projektu przy włączonej normalizacji głośności.

Nowe endpointy API

  • Wymuszone wyrównanie: Dodaliśmy nowy endpoint wymuszonego wyrównania do wyrównywania audio z tekstem, idealny do tworzenia napisów.
  • Połączenia wsadowe: Dodaliśmy endpoint połączeń wsadowych do planowania połączeń z wieloma odbiorcami

API

Nowe endpointy

Zaktualizowane endpointy

Text to Speech

Głosy

  • Pobierz głosy - Dodano parametr collection_id do filtrowania głosów według kolekcji

Baza wiedzy

  • Pobierz bazę wiedzy - Dodano parametr types do filtrowania dokumentów według typu
  • Ogólny endpoint do tworzenia dokumentów bazy wiedzy oznaczono jako przestarzały na rzecz wyspecjalizowanych endpointów

Subskrypcja użytkownika

  • Pobierz subskrypcję użytkownika - Dodano właściwość professional_voice_slots_used do śledzenia liczby głosów profesjonalnych używanych w obszarze roboczym

Platforma Agents

  • Dodano parametr silence_end_call_timeout, aby ustawić maksymalny czas oczekiwania przed zakończeniem połączenia
  • Usunięto endpoint /v1/convai/agents/{agent_id}/add-secret (obsługiwany teraz przez endpointy sekretów obszaru roboczego)