Przedstawiamy Music v2
Music v2 jest już dostępny przez API ElevenLabs. Ustaw model_id na music_v2 w Generuj muzykę, Strumieniuj muzykę, Generuj muzykę szczegółowo i Prześlij muzykę, aby użyć nowego modelu. Music v2 wprowadza oparte na chunkach plany kompozycji, zbudowane z segmentów GenerationChunk i AudioRefChunk, które dają większą kontrolę nad strukturą, tempem i aranżacją niż oparty na promptach przepływ music_v1.
Używaj planów kompozycji music_v2 w żądaniach generowania i przesyłania albo najpierw wygeneruj plan przez endpoint planu kompozycji. Treści żądań i odpowiedzi akceptują kształt planu v1 lub v2, więc możesz migrować endpoint po endpoincie. MusicPrompt pozostaje dostępny tylko dla music_v1.
- Znaczniki czasu przesyłania: Prześlij muzykę akceptuje opcjonalne
with_timestamps; odpowiedzi mogą zawieraćwords_timestamps.
ElevenAgents
- Uruchom ocenę rozmowy: Dodano endpoint Uruchom ocenę rozmowy (
POST /v1/convai/conversations/{conversation_id}/analysis/evaluations/run) do ponownego uruchamiania pojedynczego kryterium oceny dla zakończonej rozmowy za pomocąRunConversationEvaluationsRequest. - Zachowanie przy wejściu do workflow: Węzły workflow zastępujące agenta dodają opcjonalne
entry_behavior(generate_immediately,wait_for_user,auto), aby określić, czy subagent mówi pierwszy, czy czeka na dane od użytkownika. - Narzędzie systemowe kończenia procedury: Dodano konfigurację narzędzia systemowego
end_procedurez odpowiadającymi jej statusami błędów. Narzędziestart_proceduredodajealready_activedo statusów błędów. - Nadpisania TTS przy przekazaniu:
AgentTransfer, samodzielne węzły agentów workflow i pomyślne wyniki narzędziatransfer_to_agentdodają opcjonalnepreserve_client_tts_overrides(wartość logiczna), aby zachować nadpisania TTS po stronie klienta po przekazaniu. - Enum budżetu interakcji:
InteractionBudgetusuwaasynci dodaje5_minutes,10_minutesoraz1_hour. Zaktualizuj wszystkie konfiguracje lub enumy SDK, które nadal odwołują się doasync. - Wybór własnego modelu zabezpieczeń: Konfiguracja własnych zabezpieczeń dodaje opcjonalne
modelz wariantami Gemini, Claude i GPT. Konfiguracja zabezpieczeń dodaje też opcjonalnehistory_message_count(liczba całkowita). - Filtry listy numerów telefonów: Lista numerów telefonów dodaje opcjonalne parametry zapytania
provider,agent_idibranch_iddo filtrowania zaimportowanych numerów. - Filtrowanie kont WhatsApp: Lista kont WhatsApp dodaje opcjonalny parametr zapytania
agent_iddo filtrowania kont według przypisanego agenta. - Filtry zakresu czasu tematów: Pobierz tematy rozmów agenta dodaje opcjonalne parametry zapytania
from_unix_secsito_unix_secs, aby ograniczyć wyniki wyszukiwania tematów. - Konfiguracja kodeków SIP: Modele żądań i odpowiedzi wychodzącego trunku SIP dodają opcjonalne
enabled_codecs(enumMediaCodec). - Typy narzędzi pamięci: Dodano schematy
LoadableMemoryEntryiLoadMemoryEntryToolErrorStatusdo obsługi błędów narzędzi pamięci. - Limity partii testów agentów: Schematy żądań dołączania, uruchamiania i ponownego przesyłania testów agentów zwiększają maksymalną liczbę dołączonych testów z 1000 do 5000.
- Obsługa tagów fonemów: Ustawienia TTS agenta dodają opcjonalne
enable_phoneme_tags(wartość logiczna) do opcjonalnej obsługi fonemów V3 SSML. - Nadpisania pomijania schematu tablic: Właściwości schematu JSON tablic dodają opcjonalne
is_omitted(wzajemnie wykluczające się z innymi źródłami wartości).ConstantSchemaOverridemoże używać stałych wartości tablicowych. - Kontekst błędu przekazania: Dane błędu przekazania na numer mogą zawierać opcjonalne
agent_message(ciąg).
Workspaces
- Aktualizacje kluczy API kont usług: Aktualizuj klucz API konta usługi nie wymaga już treści żądania. Pola edycji obsługują częściowe aktualizacje przez
no_updateoraz dopuszczające nullname, w tympermissionsicharacter_limit. - Grupowanie użycia według strefy czasowej: Żądania użycia workspace według produktu w czasie dodają opcjonalne
time_zone(ciąg strefy czasowej IANA) z doprecyzowanymi zasadami segmentówinterval_seconds. - Filtr źródła historii: Filtry
sourcelisty i szczegółów historii dodająFlows.
ElevenCreative Studio
- Referencje głosów projektu: Modele projektów, węzły TTS rozdziałów, listy głosów i statystyki głosów przechodzą na
project_voice_ref_idjako kanoniczne pole głosu. Dotychczasowe polavoice_idpozostają w odpowiedziach jako przestarzałe, tylko do odczytu kopie dla zgodności.
Speech to Text
- Diarizacja z biblioteką mówców: Konwertuj mowę na tekst dodaje opcjonalne
use_speaker_library(wartość logiczna, domyślniefalse) do diarizacji transkrypcji wsadowych.
Głosy
- Sortowanie udostępnionych głosów: Parametr zapytania
sortw Lista udostępnionych głosów otrzymuje jawny enum, domyślną wartośćcreated_datei zaktualizowany opis.
Wydania SDK
SDK JavaScript
- v2.53.0 - Wygenerowano ponownie z najnowszego schematu OpenAPI z obsługą ponownego uruchamiania oceny rozmów, uniami planów kompozycji music v2,
entry_behaviorworkflow, filtrami list numerów telefonów i WhatsApp, parametrami zakresu czasu tematów, aktualizacjami schematu alertów, polamiproject_voice_ref_idstudio oraz rozszerzonymi limitami partii testów agentów.
SDK Python
- v2.53.0 - Wygenerowano ponownie z najnowszego schematu OpenAPI z obsługą ponownego uruchamiania oceny rozmów, planami kompozycji music v2, zachowaniem wejścia do workflow i narzędziami kończenia procedur, parametrami filtrów telefonii, modelami częściowych aktualizacji alertów i kont usług oraz polami referencji głosów studio.
Pakiety
- @elevenlabs/client@1.11.0 - Dodano eksport podścieżki
@elevenlabs/client/internal/unitydla mostu WebGL SDK Unity, udostępniającyMediaDeviceInput,MediaDeviceOutput, pomocników dołączania połączeń oraz typy adaptera WebRTC. - @elevenlabs/client@1.11.1, @elevenlabs/react@1.6.7, @elevenlabs/react-native@1.2.7, @elevenlabs/convai-widget-core@0.14.2 i @elevenlabs/convai-widget-embed@0.14.2 - Ujednolicono zależności do
@elevenlabs/client@1.11.1i@elevenlabs/types@0.14.1. - @elevenlabs/types@0.14.1 - Dodano
"license": "MIT"dopackage.jsondla zgodności z license-checker.
SDK iOS
- v3.2.1 - Dodano obsługę rezydencji danych w Singapurze i włączono
singlePeerConnectiondla sesji WebRTC.
API
Zobacz zmiany w API
Nowe endpointy
ElevenAgents
- Uruchom ocenę rozmowy -
POST /v1/convai/conversations/{conversation_id}/analysis/evaluations/run- Treść żądania używa
RunConversationEvaluationsRequestdo ponownego uruchomienia pojedynczego kryterium oceny
- Treść żądania używa
Zaktualizowane endpointy
ElevenAgents
- Lista numerów telefonów -
GET /v1/convai/phone-numbers- Dodano opcjonalne parametry zapytania
provider,agent_idibranch_id
- Dodano opcjonalne parametry zapytania
- Pobierz tematy rozmów agenta -
GET /v1/convai/agents/{agent_id}/topics- Dodano opcjonalne parametry zapytania
from_unix_secsito_unix_secs
- Dodano opcjonalne parametry zapytania
- Lista kont WhatsApp -
GET /v1/convai/whatsapp-accounts- Dodano opcjonalny parametr zapytania
agent_id
- Dodano opcjonalny parametr zapytania
Music
- Generuj muzykę, Generuj muzykę szczegółowo, Strumieniuj muzykę i Prześlij muzykę
- Dodano
music_v2do obsługiwanych wartościmodel_id - Przesyłanie dodaje opcjonalne
with_timestamps; odpowiedzi mogą zawieraćwords_timestamps
- Dodano
Speech to Text
- Konwertuj mowę na tekst -
POST /v1/speech-to-text- Dodano opcjonalny parametr zapytania
use_speaker_library(wartość logiczna, domyślniefalse)
- Dodano opcjonalny parametr zapytania
Głosy
- Lista udostępnionych głosów -
GET /v1/shared-voices- Parametr zapytania
sortużywa teraz jawnego enuma z domyślną wartościącreated_date
- Parametr zapytania
Zmiany w schematach
ElevenAgents
- Węzły workflow zastępujące agenta
- Dodano opcjonalny enum
entry_behavior(generate_immediately,wait_for_user,auto)
- Dodano opcjonalny enum
- Narzędzia systemowe
- Dodano konfigurację narzędzia
end_procedurei statusy błędów
- Dodano konfigurację narzędzia
- Schematy przekazywania i interakcji
- Dodano opcjonalne
preserve_client_tts_overridesw przekazaniach i wynikach narzędzia przekazywania InteractionBudgetusuwaasync; dodaje5_minutes,10_minutes,1_hour
- Dodano opcjonalne
- Zabezpieczenia i TTS
- Własne zabezpieczenia dodają opcjonalne
modelihistory_message_count - Ustawienia TTS agenta dodają opcjonalne
enable_phoneme_tags
- Własne zabezpieczenia dodają opcjonalne
- Telefonia
- Modele trunku SIP dodają opcjonalne
enabled_codecs(enumMediaCodec)
- Modele trunku SIP dodają opcjonalne
- Narzędzia pamięci i kodu
- Dodano
LoadableMemoryEntryiLoadMemoryEntryToolErrorStatus
- Dodano
- Testowanie agentów
- Zwiększono limity dołączonych testów z 1000 do 5000 w żądaniach uruchamiania i ponownego przesyłania
- Właściwości schematu JSON narzędzi
- Właściwości tablic dodają opcjonalne
is_omitted
- Właściwości tablic dodają opcjonalne
Workspaces
- Konta usług
- PATCH klucza API obsługuje częściowe aktualizacje ze znacznikami
no_update
- PATCH klucza API obsługuje częściowe aktualizacje ze znacznikami
- Użycie i historia
- Użycie według produktu w czasie dodaje opcjonalne
time_zone - Filtry
sourcehistorii dodająFlows
- Użycie według produktu w czasie dodaje opcjonalne
Music
- Plany kompozycji
- Dodano oparte na chunkach
CompositionPlan,GenerationChunkiAudioRefChunkdlamusic_v2 - Treści żądań i odpowiedzi akceptują kształty planów v1 lub v2 przez
anyOf
- Dodano oparte na chunkach
ElevenCreative Studio
- Modele głosów projektu
- Dodano
project_voice_ref_idjako kanoniczną referencję głosu - W odpowiedziach zachowano przestarzałe kopie
voice_idtylko do odczytu
- Dodano