For AI agents: a documentation index is available at the root level at /llms.txt. Append /llms.txt to any URL for a page-level index, or .md for the markdown version of any page.
Równoległe wywołania narzędzi: Konfiguracja promptu agenta zawiera teraz enable_parallel_tool_calls (boolean, domyślnie true). Gdy jest włączona, obsługiwane modele mogą wykonać wiele narzędzi w jednej turze.
Modele agentów: Dodano gpt-6-astra do opcji LLM agenta.
Alerty: Alerty agenta obsługują teraz kanały Slack obok powiadomień PagerDuty i webhooków.
Wyszukiwanie numerów telefonów: Dodano endpoint numerów telefonów z paginacją opartą na kursorze i filtrami dostawcy, obsługi połączeń wychodzących, przypisanego agenta i gałęzi, etykiety oraz numeru telefonu.
Obrazy i wideo
Modele GPT Image 2.5: Generowanie obrazów obsługuje teraz gpt-image-2.5-flare i gpt-image-2.5-sunburst. Oba modele przyjmują do 10 obrazów referencyjnych, poziomy jakości do max, 14 stałych proporcji obrazu oraz auto, a także wynik 1K, 2K lub 4K.
Speech Engine
Limit czasu kaskady: Żądania tworzenia i aktualizacji Speech Engine przyjmują teraz cascade_timeout_seconds (number, 2–15, domyślnie 4), aby określić, jak długo ElevenLabs czeka na nadrzędny Speech Engine przed ponowną próbą.
Text to Speech
Granice tur z wieloma kontekstami: Znacznik is_final_audio_for_turn jest teraz wysyłany po każdym zbuforowanym bajcie dla danej tury, w tym w formatach MP3 i Opus. Klienci mogą używać znacznika jako dokładnej granicy tury bez przechodzenia na PCM.
Wydania SDK
JavaScript SDK
v2.69.0 - Dodano transcriptEdit do wrappera Speech to Text w czasie rzeczywistym, z edytowanym tekstem dostarczanym przez zdarzenia edited_transcript. Naprawiono weryfikację JWT Speech Engine dla kluczy API z sufiksami rezydencji danych. Dodano phoneNumbers.listV2 i metody szablonów Flows do wyświetlania i pobierania szablonów oraz wyświetlania, tworzenia i pobierania uruchomień. Wygenerowano ponownie klientów i typy dla GPT Image 2.5, alertów agentów Slack, równoległych wywołań narzędzi, gpt-6-astra, limitów równoczesności kluczy API kont usługowych, zerowej retencji Music, filtrów rozmów i statusów zatwierdzania narzędzi MCP.
Python SDK
v2.69.0 - Dodano transcript_edit do wrappera Speech to Text w czasie rzeczywistym, z edytowanym tekstem dostarczanym przez zdarzenia edited_transcript. Naprawiono weryfikację JWT Speech Engine dla kluczy API z sufiksami rezydencji danych oraz sprawiono, że play zgłasza błąd, gdy ffplay zawiedzie. Dodano phone_numbers.list_v2 i metody szablonów Flows do wyświetlania i pobierania szablonów oraz wyświetlania, tworzenia i pobierania uruchomień. Wygenerowano ponownie klientów i typy dla GPT Image 2.5, alertów agentów Slack, równoległych wywołań narzędzi, gpt-6-astra, limitów równoczesności kluczy API kont usługowych, zerowej retencji Music, filtrów rozmów i statusów zatwierdzania narzędzi MCP.
ElevenLabs CLI
v1.3.2 - Dodano opcjonalne metadane --intent do zbierania opinii o użyciu CLI. Dodano elevenlabs feedback missing-capability do zgłaszania workflow, których CLI nie obsługuje.
Dodano opcjonalne filtry search, label, phone_number, provider, supports_outbound, agent_id, branch_id, sort_by i sort_direction. sort_by przyjmuje label lub phone_number; sort_direction domyślnie ma wartość asc.
Odpowiedź zawiera wymagane phone_numbers (array), opcjonalne nullable next_cursor (string) i has_more (boolean, domyślnie false).
Enum LLM dodaje gpt-6-astra, w tym nadpisania inicjowania rozmowy.
Powiadomienia integracji alertów używają teraz integration_type do wyboru pagerduty lub slack. Powiadomienia Slack wymagają connection_id i channel_id (string); channel_id przyjmuje 1–64 znaki.
Dodano cascade_timeout_seconds (number, 2–15). Żądania tworzenia domyślnie używają 4, żądania aktualizacji przyjmują wartość nullable, a odpowiedzi wymagają tego pola.
Dodano warianty żądań dla gpt-image-2.5-flare i gpt-image-2.5-sunburst.
Oba warianty wymagają prompt i model_id, przyjmują do 10 images oraz dodają resolution (1K, 2K lub 4K, domyślnie 1K).
quality przyjmuje low, medium, high, xhigh lub max i domyślnie ma wartość high. aspect_ratio przyjmuje auto oraz 14 stałych proporcji i domyślnie ma wartość 16:9.
Wiadomości WebSocket audio i final z wieloma kontekstami definiują teraz is_final_audio_for_turn jako występujące po dostarczeniu wszystkich zbuforowanych bajtów dla tury.