For AI agents: a documentation index is available at the root level at /llms.txt. Append /llms.txt to any URL for a page-level index, or .md for the markdown version of any page.
Parallele Tool-Aufrufe: Die Agent-Prompt-Konfiguration enthält jetzt enable_parallel_tool_calls (Boolean, Standardwert true). Wenn aktiviert, können unterstützte Modelle mehrere Tools in einem Zug ausführen.
Agent-Modelle: gpt-6-astra zu den Agent-LLM-Optionen hinzugefügt.
Benachrichtigungen: Agent-Benachrichtigungen unterstützen jetzt neben PagerDuty und Webhook-Benachrichtigern auch Slack-Kanäle.
Telefonnummernsuche: Einen cursor-paginierten Telefonnummern-Endpunkt mit Filtern für Anbieter, Unterstützung für ausgehende Anrufe, zugewiesenen Agent und Branch, Label und Telefonnummer hinzugefügt.
Bild und Video
GPT Image 2.5-Modelle: Bildgenerierung unterstützt jetzt gpt-image-2.5-flare und gpt-image-2.5-sunburst. Beide Modelle akzeptieren bis zu 10 Referenzbilder, Qualitätsstufen bis max, 14 feste Seitenverhältnisse sowie auto und eine Ausgabe in 1K, 2K oder 4K.
Speech Engine
Cascade-Timeout: Anfragen zum Erstellen und Aktualisieren der Speech Engine akzeptieren jetzt cascade_timeout_seconds (Zahl, 2–15, Standardwert 4), um zu steuern, wie lange ElevenLabs vor einem erneuten Versuch auf eine übergeordnete Speech Engine wartet.
Text to Speech
Turn-Grenzen mit mehreren Kontexten: Der Marker is_final_audio_for_turn wird jetzt nach jedem gepufferten Byte für diesen Turn ausgegeben, einschließlich MP3- und Opus-Ausgabe. Clients können den Marker als exakte Turn-Grenze verwenden, ohne zu PCM wechseln zu müssen.
SDK-Releases
JavaScript SDK
v2.69.0 - transcriptEdit zum Echtzeit-Speech-to-Text-Wrapper hinzugefügt; bearbeiteter Text wird über edited_transcript-Ereignisse bereitgestellt. JWT-Verifizierung der Speech Engine für API-Keys mit Data-Residency-Suffixen behoben. phoneNumbers.listV2 und Flows-Template-Methoden zum Auflisten und Abrufen von Templates sowie zum Auflisten, Erstellen und Abrufen von Ausführungen hinzugefügt. Clients und Typen für GPT Image 2.5, Slack-Agent-Benachrichtigungen, parallele Tool-Aufrufe, gpt-6-astra, Parallelitätslimits für API-Keys von Servicekonten, Music Zero Retention, Gesprächsfilter und MCP-Tool-Genehmigungsstatus neu generiert.
Python SDK
v2.69.0 - transcript_edit zum Echtzeit-Speech-to-Text-Wrapper hinzugefügt; bearbeiteter Text wird über edited_transcript-Ereignisse bereitgestellt. JWT-Verifizierung der Speech Engine für API-Keys mit Data-Residency-Suffixen behoben und play löst jetzt einen Fehler aus, wenn ffplay fehlschlägt. phone_numbers.list_v2 und Flows-Template-Methoden zum Auflisten und Abrufen von Templates sowie zum Auflisten, Erstellen und Abrufen von Ausführungen hinzugefügt. Clients und Typen für GPT Image 2.5, Slack-Agent-Benachrichtigungen, parallele Tool-Aufrufe, gpt-6-astra, Parallelitätslimits für API-Keys von Servicekonten, Music Zero Retention, Gesprächsfilter und MCP-Tool-Genehmigungsstatus neu generiert.
ElevenLabs CLI
v1.3.2 - Optionale --intent-Metadaten hinzugefügt, um Feedback zur CLI-Nutzung zu sammeln. elevenlabs feedback missing-capability hinzugefügt, um Workflows zu melden, die die CLI nicht unterstützt.
data_collection_params akzeptiert den Operator missing nicht mehr. Verwenden Sie einen leeren Wert, um Unterhaltungen abzugleichen, bei denen das Feld nicht erfasst wurde.
Ein leerer Wert in dynamic_variable_params gleicht Unterhaltungen ab, bei denen die Variable nicht gesetzt wurde.
cascade_timeout_seconds (Zahl, 2–15) hinzugefügt. Erstellungsanfragen haben standardmäßig den Wert 4, Aktualisierungsanfragen akzeptieren einen nullable Wert und Antworten erfordern das Feld.
Anfragevarianten für gpt-image-2.5-flare und gpt-image-2.5-sunburst hinzugefügt.
Beide Varianten erfordern prompt und model_id, akzeptieren bis zu 10 images und enthalten zusätzlich resolution (1K, 2K oder 4K, Standardwert 1K).
quality akzeptiert low, medium, high, xhigh oder max und hat standardmäßig den Wert high. aspect_ratio akzeptiert auto und 14 feste Verhältnisse und hat standardmäßig den Wert 16:9.
WebSocket-Nachrichten audio und final mit mehreren Kontexten definieren is_final_audio_for_turn jetzt als nach der Übermittlung aller gepufferten Bytes für den Turn auftretend.