Scribe v2
Wprowadziliśmy Scribe v2, nowy, najnowocześniejszy model transkrypcji. Dowiedz się więcej o Scribe v2 w dokumentacji.
Platforma Agents
- Obsługa stref czasowych przy planowaniu połączeń wsadowych: Możesz teraz wybrać strefę czasową podczas planowania połączeń wsadowych. Zaplanowany czas jest przeliczany na UTC na podstawie wybranej strefy. Domyślnie automatycznie wybierana jest strefa czasowa przeglądarki, a walidacja zapobiega planowaniu połączeń na terminy, które już minęły w wybranej strefie. Ułatwia to planowanie połączeń wychodzących na właściwy czas w strefach czasowych odbiorców.
- URL pliku źródłowego Bazy wiedzy: Dodaliśmy nowy endpoint do pobierania URL oryginalnego pliku źródłowego dokumentów bazy wiedzy, zapewniający bezpośredni dostęp do przesłanych plików.
- Limit czasu kaskady zapasowych LLM: Dodaliśmy opcję konfiguracji
cascade_timeout_secondsdla konfiguracji zapasowych LLM agenta, która pozwala określić, jak długo czekać przed przejściem do kolejnego LLM. Domyślnie jest to 8 sekund, a dozwolony zakres wynosi 2–15 sekund. - Wiadomości generowane przez LLM przy miękkim limicie czasu: Dodaliśmy opcję
use_llm_generated_messagedo konfiguracji miękkiego limitu czasu. Po włączeniu agent wygeneruje kontekstową wiadomość za pomocą LLM zamiast używać zdefiniowanej wiadomości po uruchomieniu miękkiego limitu czasu. - Nawigacja po folderach Bazy wiedzy: Odpowiedzi dokumentów Bazy wiedzy zawierają teraz pole
folder_path, pokazujące segmenty ścieżki od katalogu głównego do folderu nadrzędnego. Ułatwia to zrozumienie hierarchii dokumentów. - Filtrowanie rozmów według źródła inicjacji: Endpoint Pobierz rozmowy obsługuje teraz filtrowanie za pomocą parametru zapytania
conversation_initiation_source.
Dubbing
- Nowy endpoint formatu transkrypcji: Dodaliśmy endpoint
GET /v1/dubbing/{dubbing_id}/transcripts/{language_code}/format/{format_type}, obsługujący formaty wyjściowesrt,webvttijson. Poprzedni endpointGET /v1/dubbing/{dubbing_id}/transcript/{language_code}jest teraz przestarzały. - Wymagana nazwa pliku dla zdubbingowanych plików: Modele plików Bazy wiedzy wymagają teraz pola
filename.
Speech to Text
- Wykrywanie encji: Dodaliśmy opcję
entity_detectiondo żądań Speech-to-Text. Akceptuje'all', stringi określonych typów encji lub tablicę typów encji. Wykryte encje są zwracane w nowym polu odpowiedzientitiesprzy użyciu schematuDetectedEntity. - Podpowiedzi keytermów: Dodaliśmy parametr tablicowy
keytermsdo żądań Speech-to-Text, aby ukierunkować transkrypcję na określone terminy lub frazy.
Wydania SDK
Python SDK
- v2.29.0 - Dodano wykrywanie encji i podpowiedzi keytermów dla Speech-to-Text, konfigurację limitu czasu kaskady LLM, generowanie wiadomości LLM przy miękkim limicie czasu oraz obsługę stref czasowych dla połączeń wsadowych
- v2.28.0 - Dodano pola wersjonowania agenta, ID kolekcji głosów, ulepszenia połączeń wsadowych i etykiety numerów telefonu
JavaScript SDK
- v2.30.0 - Dodano wykrywanie encji i podpowiedzi keytermów dla Speech-to-Text, konfigurację limitu czasu kaskady LLM, generowanie wiadomości LLM przy miękkim limicie czasu oraz obsługę stref czasowych dla połączeń wsadowych
- v2.29.0 - Dodano pola wersjonowania agenta, ID kolekcji głosów, ulepszenia połączeń wsadowych i etykiety numerów telefonu
Serwer MCP
- v0.9.1 - Dodano obsługę rozszerzenia Gemini, poprawiono obsługę ścieżek dla nieabsolutnego
output_directoryi brakującegobase_path
API
Zobacz zmiany w API
Nowe endpointy
- Pobierz transkrypcję dubbingu z formatem -
GET /v1/dubbing/{dubbing_id}/transcripts/{language_code}/format/{format_type}- Pobieraj transkrypcje dubbingu w formacie SRT, WebVTT lub JSON - Pobierz URL pliku źródłowego bazy wiedzy -
GET /v1/convai/knowledge-base/{documentation_id}/source-file-url- Pobierz URL oryginalnego pliku źródłowego dokumentu bazy wiedzy
Przestarzałe endpointy
GET /v1/dubbing/{dubbing_id}/transcript/{language_code}- Zamiast tego użyj nowego endpointu dla konkretnego formatu
Zaktualizowane endpointy
Platforma Agents
- Wyślij połączenie wsadowe
- Dodano
timezone(string, opcjonalne) do treści żądania dla planowania uwzględniającego strefę czasową - Dodano
scheduled_time(string, opcjonalne) jako alternatywę w formacie ISO dlascheduled_time_unix
- Dodano
- Pobierz połączenie wsadowe, Anuluj połączenie wsadowe, Ponów połączenie wsadowe
- Dodano
timezone(string, wymagane) do modeli odpowiedzi połączeń wsadowych
- Dodano
- Utwórz agenta, Zaktualizuj agenta, Pobierz agenta
- Dodano
cascade_timeout_seconds(integer, domyślnie 8, zakres 2–15, nullable) do konfiguracji zapasowego LLM - Dodano
use_llm_generated_message(boolean, domyślniefalse) do konfiguracji miękkiego limitu czasu
- Dodano
- Pobierz rozmowy
- Dodano parametr zapytania
conversation_initiation_source(string, opcjonalne) do filtrowania rozmów według źródła inicjacji
- Dodano parametr zapytania
- Symuluj rozmowę, Symuluj strumień rozmowy
- Zaktualizowano
entity_detection, aby akceptowało'all', stringi lub tablice stringów zamiast wartości boolean
- Zaktualizowano
Baza wiedzy
- Wyświetl dokumenty bazy wiedzy
- Usunięto przestarzały parametr zapytania
use_typesense - Dodano
folder_path(tablica segmentów ścieżki) do modeli odpowiedzi dokumentów - Dodano
filename(string, wymagane) do modeli plików bazy wiedzy
- Usunięto przestarzały parametr zapytania
Speech to Text
- Transkrybuj mowę
- Dodano
keyterms(tablica stringów, opcjonalne), aby ukierunkować transkrypcję na określone terminy - Dodano
entity_detection(string, tablica lub'all', opcjonalne) do wykrywania encji w transkrybowanym tekście - Dodano
entities(tablicaDetectedEntity, opcjonalne) do modelu odpowiedzi
- Dodano
Dubbing
- Utwórz projekt dubbingowy
- Zaktualizowano opis
mode, aby zaznaczyć, że trybmanualjest eksperymentalny i nie jest zalecany do zastosowań produkcyjnych
- Zaktualizowano opis