Dubbing

  • Format transkrypcji JSON: Dodaliśmy obsługę transkrypcji w formacie JSON w endpointzie GET /v1/dubbing/{dubbing_id}/transcript/{language_code}, który zwraca szczegółowe dane o czasie na poziomie słów i znaków przez DubbingTranscriptResponseModel.

Platforma agentów

  • Obsługa GPT-5.1: Dodaliśmy obsługę modeli LLM gpt-5.1 i gpt-5.1-2025-11-13 w konfiguracjach agentów.
  • Kontrola intensywności rozumowania: Dodaliśmy opcję none do LLMReasoningEffort, aby lepiej kontrolować zachowanie modelu podczas rozumowania.
  • Zdarzenia żądań narzędzi agenta: Dodaliśmy agent_tool_request do ClientEvent, aby lepiej śledzić interakcje z narzędziami w rozmowach w czasie rzeczywistym.
  • DTMF poza pasmem: Dodaliśmy flagę use_out_of_band_dtmf do PlayDTMFToolConfig, co ułatwia integrację telefoniczną.
  • Nowe modele LLM: Rozszerzyliśmy enum LLM o gemini-3-pro-preview, aby ulepszyć możliwości konwersacyjnej AI.

Speech to Text

  • Zdarzenia przekroczenia limitu Scribe: Dodaliśmy zdarzenie quota_exceeded w SDK oraz parametr include_timestamps, aby ułatwić zarządzanie limitami i znacznikami czasu.

ElevenCreative Studio

  • Śledzenie głosów w rozdziałach: Dodaliśmy pole voice_ids do modeli odpowiedzi rozdziałów, aby ułatwić zarządzanie głosami w projektach z wieloma głosami.
  • Zasoby obrazów projektu: Wprowadziliśmy ProjectImageResponseModel do obsługi zasobów obrazów, teraz dostępny w ProjectResponseModel.assets.
  • Pole głosów bazowych: Dodaliśmy pole base_voices do ProjectResponseModel, aby ułatwić zarządzanie głosami.

Text to Speech

  • Kontrola normalizacji tekstu: Dodaliśmy enum TextNormalisationType i pole text_normalisation_type w ustawieniach głosu TTS, aby precyzyjnie kontrolować przetwarzanie tekstu.
  • Tokeny TTS WebSocket: Rozszerzyliśmy SingleUseTokenType o tts_websocket dla bezpiecznego uwierzytelniania WebSocket.

Wydania SDK

JavaScript SDK

  • v2.25.0 - Zaktualizowano o najnowsze zmiany schematu API, w tym transkrypcje dubbingu JSON i obsługę GPT-5.1
  • v2.24.1 - Dodano parametr include_timestamps do Scribe API, aby kontrolować znaczniki czasu w transkrypcjach

Python SDK

  • v2.24.0 - Zaktualizowano o najnowsze zmiany schematu API, w tym transkrypcje dubbingu JSON i obsługę GPT-5.1
  • v2.23.0 - Dodano parametr include_timestamps i zdarzenie quota_exceeded do Scribe API, aby ułatwić zarządzanie limitami

Pakiety

API

Zaktualizowane endpointy

Dubbing

  • GET /v1/dubbing/{dubbing_id}/transcript/{language_code}
    • parametr ścieżki language akceptuje teraz wartość 'original'
    • parametr zapytania format_type obsługuje teraz 'json' (oprócz srt i webvtt)
    • odpowiedź 200 zawiera teraz typ mediów application/json, zwracający DubbingTranscriptResponseModel z:
      • DubbingTranscriptUtterance - dane na poziomie wypowiedzi
      • DubbingTranscriptWord - czas na poziomie słowa
      • DubbingTranscriptCharacter - czas na poziomie znaku
  • Dodano enum DubbingModel z wartościami dubbing_v2 i dubbing_v3

Platforma agentów

  • Wyślij rozmowy wsadowe
    • Zaktualizowano schemat treści żądania (zgodne wstecz)
    • Zaktualizowano schemat odpowiedzi (zgodne wstecz)
  • Pobierz status rozmów wsadowych
    • Zaktualizowano schemat odpowiedzi (zgodne wstecz)
  • Anuluj rozmowy wsadowe
    • Zaktualizowano schemat odpowiedzi (zgodne wstecz)
  • Ponów rozmowy wsadowe
    • Zaktualizowano schemat odpowiedzi (zgodne wstecz)
  • Pobierz ustawienia agenta
    • Zaktualizowano schemat odpowiedzi (zgodne wstecz)
  • Zaktualizuj ustawienia agenta
    • Zaktualizowano schematy żądania i odpowiedzi (zgodne wstecz)
  • Utwórz agenta
    • Zaktualizowano schemat żądania o ulepszoną strukturę guardrails (zmiana niezgodna wstecz — uproszczono guardrails do bezpośredniego odwołania, usuwając oneOf)
  • Pobierz agenta
    • Zaktualizowano schemat odpowiedzi (zmiana niezgodna wstecz — usunięto pola version_id i branch_id ukryte za flagą funkcji)
  • Zaktualizuj agenta
    • Zaktualizowano schemat odpowiedzi (zmiana niezgodna wstecz — usunięto pola version_id i branch_id ukryte za flagą funkcji)
  • Symuluj rozmowę
    • Zaktualizowano schemat żądania (zgodne wstecz)
  • Streamuj symulację rozmowy
    • Zaktualizowano schemat żądania (zgodne wstecz)
  • Pobierz rozmowę
    • Zaktualizowano schemat odpowiedzi (zgodne wstecz)
  • Zaktualizowano zdarzenia klienta:
    • Dodano typ zdarzenia agent_tool_request
  • Zaktualizowano konfiguracje narzędzi:
    • Dodano use_out_of_band_dtmf do PlayDTMFToolConfig
    • Usunięto schematy ApiIntegrationWebhookToolConfigExternal-* i ich mapowania dyskryminatorów

Text to Speech

Zarządzanie głosami

ElevenCreative Studio

  • Pobierz projekt
    • Zaktualizowano schemat odpowiedzi (zgodne wstecz)
    • Dodano pole assets z obsługą obrazów
    • Dodano pole base_voices
  • Dodaj rozdział
    • Zaktualizowano schemat odpowiedzi (zgodne wstecz)
    • Dodano pole voice_ids
  • Pobierz rozdział
    • Zaktualizowano schemat odpowiedzi (zgodne wstecz)
    • Dodano pole voice_ids
  • Zaktualizuj rozdział
    • Zaktualizowano schemat odpowiedzi (zgodne wstecz)
    • Dodano pole voice_ids

Muzyka

Inne aktualizacje

Usunięte funkcje

  • Usunięto przestarzałe opcje eleven_expressive i expressive z enumów TTS