Przedstawiamy Music v2

Music v2 jest już dostępny przez API ElevenLabs. Ustaw model_id na music_v2 w Generuj muzykę, Strumieniuj muzykę, Generuj muzykę szczegółowo i Prześlij muzykę, aby użyć nowego modelu. Music v2 wprowadza oparte na chunkach plany kompozycji, zbudowane z segmentów GenerationChunk i AudioRefChunk, które dają większą kontrolę nad strukturą, tempem i aranżacją niż oparty na promptach przepływ music_v1.

Używaj planów kompozycji music_v2 w żądaniach generowania i przesyłania albo najpierw wygeneruj plan przez endpoint planu kompozycji. Treści żądań i odpowiedzi akceptują kształt planu v1 lub v2, więc możesz migrować endpoint po endpoincie. MusicPrompt pozostaje dostępny tylko dla music_v1.

  • Znaczniki czasu przesyłania: Prześlij muzykę akceptuje opcjonalne with_timestamps; odpowiedzi mogą zawierać words_timestamps.

ElevenAgents

  • Uruchom ocenę rozmowy: Dodano endpoint Uruchom ocenę rozmowy (POST /v1/convai/conversations/{conversation_id}/analysis/evaluations/run) do ponownego uruchamiania pojedynczego kryterium oceny dla zakończonej rozmowy za pomocą RunConversationEvaluationsRequest.
  • Zachowanie przy wejściu do workflow: Węzły workflow zastępujące agenta dodają opcjonalne entry_behavior (generate_immediately, wait_for_user, auto), aby określić, czy subagent mówi pierwszy, czy czeka na dane od użytkownika.
  • Narzędzie systemowe kończenia procedury: Dodano konfigurację narzędzia systemowego end_procedure z odpowiadającymi jej statusami błędów. Narzędzie start_procedure dodaje already_active do statusów błędów.
  • Nadpisania TTS przy przekazaniu: AgentTransfer, samodzielne węzły agentów workflow i pomyślne wyniki narzędzia transfer_to_agent dodają opcjonalne preserve_client_tts_overrides (wartość logiczna), aby zachować nadpisania TTS po stronie klienta po przekazaniu.
  • Enum budżetu interakcji: InteractionBudget usuwa async i dodaje 5_minutes, 10_minutes oraz 1_hour. Zaktualizuj wszystkie konfiguracje lub enumy SDK, które nadal odwołują się do async.
  • Wybór własnego modelu zabezpieczeń: Konfiguracja własnych zabezpieczeń dodaje opcjonalne model z wariantami Gemini, Claude i GPT. Konfiguracja zabezpieczeń dodaje też opcjonalne history_message_count (liczba całkowita).
  • Filtry listy numerów telefonów: Lista numerów telefonów dodaje opcjonalne parametry zapytania provider, agent_id i branch_id do filtrowania zaimportowanych numerów.
  • Filtrowanie kont WhatsApp: Lista kont WhatsApp dodaje opcjonalny parametr zapytania agent_id do filtrowania kont według przypisanego agenta.
  • Filtry zakresu czasu tematów: Pobierz tematy rozmów agenta dodaje opcjonalne parametry zapytania from_unix_secs i to_unix_secs, aby ograniczyć wyniki wyszukiwania tematów.
  • Konfiguracja kodeków SIP: Modele żądań i odpowiedzi wychodzącego trunku SIP dodają opcjonalne enabled_codecs (enum MediaCodec).
  • Typy narzędzi pamięci: Dodano schematy LoadableMemoryEntry i LoadMemoryEntryToolErrorStatus do obsługi błędów narzędzi pamięci.
  • Limity partii testów agentów: Schematy żądań dołączania, uruchamiania i ponownego przesyłania testów agentów zwiększają maksymalną liczbę dołączonych testów z 1000 do 5000.
  • Obsługa tagów fonemów: Ustawienia TTS agenta dodają opcjonalne enable_phoneme_tags (wartość logiczna) do opcjonalnej obsługi fonemów V3 SSML.
  • Nadpisania pomijania schematu tablic: Właściwości schematu JSON tablic dodają opcjonalne is_omitted (wzajemnie wykluczające się z innymi źródłami wartości). ConstantSchemaOverride może używać stałych wartości tablicowych.
  • Kontekst błędu przekazania: Dane błędu przekazania na numer mogą zawierać opcjonalne agent_message (ciąg).

Workspaces

  • Aktualizacje kluczy API kont usług: Aktualizuj klucz API konta usługi nie wymaga już treści żądania. Pola edycji obsługują częściowe aktualizacje przez no_update oraz dopuszczające null name, w tym permissions i character_limit.
  • Grupowanie użycia według strefy czasowej: Żądania użycia workspace według produktu w czasie dodają opcjonalne time_zone (ciąg strefy czasowej IANA) z doprecyzowanymi zasadami segmentów interval_seconds.
  • Filtr źródła historii: Filtry source listy i szczegółów historii dodają Flows.

ElevenCreative Studio

  • Referencje głosów projektu: Modele projektów, węzły TTS rozdziałów, listy głosów i statystyki głosów przechodzą na project_voice_ref_id jako kanoniczne pole głosu. Dotychczasowe pola voice_id pozostają w odpowiedziach jako przestarzałe, tylko do odczytu kopie dla zgodności.

Speech to Text

  • Diarizacja z biblioteką mówców: Konwertuj mowę na tekst dodaje opcjonalne use_speaker_library (wartość logiczna, domyślnie false) do diarizacji transkrypcji wsadowych.

Głosy

  • Sortowanie udostępnionych głosów: Parametr zapytania sort w Lista udostępnionych głosów otrzymuje jawny enum, domyślną wartość created_date i zaktualizowany opis.

Wydania SDK

SDK JavaScript

  • v2.53.0 - Wygenerowano ponownie z najnowszego schematu OpenAPI z obsługą ponownego uruchamiania oceny rozmów, uniami planów kompozycji music v2, entry_behavior workflow, filtrami list numerów telefonów i WhatsApp, parametrami zakresu czasu tematów, aktualizacjami schematu alertów, polami project_voice_ref_id studio oraz rozszerzonymi limitami partii testów agentów.

SDK Python

  • v2.53.0 - Wygenerowano ponownie z najnowszego schematu OpenAPI z obsługą ponownego uruchamiania oceny rozmów, planami kompozycji music v2, zachowaniem wejścia do workflow i narzędziami kończenia procedur, parametrami filtrów telefonii, modelami częściowych aktualizacji alertów i kont usług oraz polami referencji głosów studio.

Pakiety

SDK iOS

  • v3.2.1 - Dodano obsługę rezydencji danych w Singapurze i włączono singlePeerConnection dla sesji WebRTC.

API

Nowe endpointy

ElevenAgents

  • Uruchom ocenę rozmowy - POST /v1/convai/conversations/{conversation_id}/analysis/evaluations/run
    • Treść żądania używa RunConversationEvaluationsRequest do ponownego uruchomienia pojedynczego kryterium oceny

Zaktualizowane endpointy

ElevenAgents

  • Lista numerów telefonów - GET /v1/convai/phone-numbers
    • Dodano opcjonalne parametry zapytania provider, agent_id i branch_id
  • Pobierz tematy rozmów agenta - GET /v1/convai/agents/{agent_id}/topics
    • Dodano opcjonalne parametry zapytania from_unix_secs i to_unix_secs
  • Lista kont WhatsApp - GET /v1/convai/whatsapp-accounts
    • Dodano opcjonalny parametr zapytania agent_id

Music

Speech to Text

  • Konwertuj mowę na tekst - POST /v1/speech-to-text
    • Dodano opcjonalny parametr zapytania use_speaker_library (wartość logiczna, domyślnie false)

Głosy

Zmiany w schematach

ElevenAgents

  • Węzły workflow zastępujące agenta
    • Dodano opcjonalny enum entry_behavior (generate_immediately, wait_for_user, auto)
  • Narzędzia systemowe
    • Dodano konfigurację narzędzia end_procedure i statusy błędów
  • Schematy przekazywania i interakcji
    • Dodano opcjonalne preserve_client_tts_overrides w przekazaniach i wynikach narzędzia przekazywania
    • InteractionBudget usuwa async; dodaje 5_minutes, 10_minutes, 1_hour
  • Zabezpieczenia i TTS
    • Własne zabezpieczenia dodają opcjonalne model i history_message_count
    • Ustawienia TTS agenta dodają opcjonalne enable_phoneme_tags
  • Telefonia
    • Modele trunku SIP dodają opcjonalne enabled_codecs (enum MediaCodec)
  • Narzędzia pamięci i kodu
    • Dodano LoadableMemoryEntry i LoadMemoryEntryToolErrorStatus
  • Testowanie agentów
    • Zwiększono limity dołączonych testów z 1000 do 5000 w żądaniach uruchamiania i ponownego przesyłania
  • Właściwości schematu JSON narzędzi
    • Właściwości tablic dodają opcjonalne is_omitted

Workspaces

  • Konta usług
    • PATCH klucza API obsługuje częściowe aktualizacje ze znacznikami no_update
  • Użycie i historia
    • Użycie według produktu w czasie dodaje opcjonalne time_zone
    • Filtry source historii dodają Flows

Music

  • Plany kompozycji
    • Dodano oparte na chunkach CompositionPlan, GenerationChunk i AudioRefChunk dla music_v2
    • Treści żądań i odpowiedzi akceptują kształty planów v1 lub v2 przez anyOf

ElevenCreative Studio

  • Modele głosów projektu
    • Dodano project_voice_ref_id jako kanoniczną referencję głosu
    • W odpowiedziach zachowano przestarzałe kopie voice_id tylko do odczytu