Scribe v2

Wprowadziliśmy Scribe v2, nowy, najnowocześniejszy model transkrypcji. Dowiedz się więcej o Scribe v2 w dokumentacji.

Platforma Agents

  • Obsługa stref czasowych przy planowaniu połączeń wsadowych: Możesz teraz wybrać strefę czasową podczas planowania połączeń wsadowych. Zaplanowany czas jest przeliczany na UTC na podstawie wybranej strefy. Domyślnie automatycznie wybierana jest strefa czasowa przeglądarki, a walidacja zapobiega planowaniu połączeń na terminy, które już minęły w wybranej strefie. Ułatwia to planowanie połączeń wychodzących na właściwy czas w strefach czasowych odbiorców.
  • URL pliku źródłowego Bazy wiedzy: Dodaliśmy nowy endpoint do pobierania URL oryginalnego pliku źródłowego dokumentów bazy wiedzy, zapewniający bezpośredni dostęp do przesłanych plików.
  • Limit czasu kaskady zapasowych LLM: Dodaliśmy opcję konfiguracji cascade_timeout_seconds dla konfiguracji zapasowych LLM agenta, która pozwala określić, jak długo czekać przed przejściem do kolejnego LLM. Domyślnie jest to 8 sekund, a dozwolony zakres wynosi 2–15 sekund.
  • Wiadomości generowane przez LLM przy miękkim limicie czasu: Dodaliśmy opcję use_llm_generated_message do konfiguracji miękkiego limitu czasu. Po włączeniu agent wygeneruje kontekstową wiadomość za pomocą LLM zamiast używać zdefiniowanej wiadomości po uruchomieniu miękkiego limitu czasu.
  • Nawigacja po folderach Bazy wiedzy: Odpowiedzi dokumentów Bazy wiedzy zawierają teraz pole folder_path, pokazujące segmenty ścieżki od katalogu głównego do folderu nadrzędnego. Ułatwia to zrozumienie hierarchii dokumentów.
  • Filtrowanie rozmów według źródła inicjacji: Endpoint Pobierz rozmowy obsługuje teraz filtrowanie za pomocą parametru zapytania conversation_initiation_source.

Dubbing

  • Nowy endpoint formatu transkrypcji: Dodaliśmy endpoint GET /v1/dubbing/{dubbing_id}/transcripts/{language_code}/format/{format_type}, obsługujący formaty wyjściowe srt, webvtt i json. Poprzedni endpoint GET /v1/dubbing/{dubbing_id}/transcript/{language_code} jest teraz przestarzały.
  • Wymagana nazwa pliku dla zdubbingowanych plików: Modele plików Bazy wiedzy wymagają teraz pola filename.

Speech to Text

  • Wykrywanie encji: Dodaliśmy opcję entity_detection do żądań Speech-to-Text. Akceptuje 'all', stringi określonych typów encji lub tablicę typów encji. Wykryte encje są zwracane w nowym polu odpowiedzi entities przy użyciu schematu DetectedEntity.
  • Podpowiedzi keytermów: Dodaliśmy parametr tablicowy keyterms do żądań Speech-to-Text, aby ukierunkować transkrypcję na określone terminy lub frazy.

Wydania SDK

Python SDK

  • v2.29.0 - Dodano wykrywanie encji i podpowiedzi keytermów dla Speech-to-Text, konfigurację limitu czasu kaskady LLM, generowanie wiadomości LLM przy miękkim limicie czasu oraz obsługę stref czasowych dla połączeń wsadowych
  • v2.28.0 - Dodano pola wersjonowania agenta, ID kolekcji głosów, ulepszenia połączeń wsadowych i etykiety numerów telefonu

JavaScript SDK

  • v2.30.0 - Dodano wykrywanie encji i podpowiedzi keytermów dla Speech-to-Text, konfigurację limitu czasu kaskady LLM, generowanie wiadomości LLM przy miękkim limicie czasu oraz obsługę stref czasowych dla połączeń wsadowych
  • v2.29.0 - Dodano pola wersjonowania agenta, ID kolekcji głosów, ulepszenia połączeń wsadowych i etykiety numerów telefonu

Serwer MCP

  • v0.9.1 - Dodano obsługę rozszerzenia Gemini, poprawiono obsługę ścieżek dla nieabsolutnego output_directory i brakującego base_path

API

Nowe endpointy

Przestarzałe endpointy

  • GET /v1/dubbing/{dubbing_id}/transcript/{language_code} - Zamiast tego użyj nowego endpointu dla konkretnego formatu

Zaktualizowane endpointy

Platforma Agents

Baza wiedzy

  • Wyświetl dokumenty bazy wiedzy
    • Usunięto przestarzały parametr zapytania use_typesense
    • Dodano folder_path (tablica segmentów ścieżki) do modeli odpowiedzi dokumentów
    • Dodano filename (string, wymagane) do modeli plików bazy wiedzy

Speech to Text

  • Transkrybuj mowę
    • Dodano keyterms (tablica stringów, opcjonalne), aby ukierunkować transkrypcję na określone terminy
    • Dodano entity_detection (string, tablica lub 'all', opcjonalne) do wykrywania encji w transkrybowanym tekście
    • Dodano entities (tablica DetectedEntity, opcjonalne) do modelu odpowiedzi

Dubbing

  • Utwórz projekt dubbingowy
    • Zaktualizowano opis mode, aby zaznaczyć, że tryb manual jest eksperymentalny i nie jest zalecany do zastosowań produkcyjnych