For AI agents: a documentation index is available at the root level at /llms.txt. Append /llms.txt to any URL for a page-level index, or .md for the markdown version of any page.
LogoLogo
Connect
BlogHelp CenterAPI PricingSign up
ÜbersichtElevenCreativeElevenAgentsElevenAPIReception.aiAPI-ReferenzChangelogHilfezentrum
Anmelden
ÜbersichtElevenCreativeElevenAgentsElevenAPIReception.aiAPI-ReferenzChangelogHilfezentrum
Connect
BlogHelp CenterAPI PricingSign up
Auf dieser Seite
  • 23. September 2026
  • Bild & Video
  • 21. September 2026
  • ElevenAgents
  • Bild und Video
  • Speech Engine
  • Text to Speech
  • SDK-Releases
  • API
  • Neue Endpunkte
  • Aktualisierte Endpunkte
  • Schemaänderungen
  • 14. September 2026
  • ElevenAgents
  • Musik
  • SDK-Releases
  • API
  • Neue Endpunkte
  • Aktualisierte Endpunkte
  • Schemaänderungen
  • 11. September 2026
  • Scribe v2 Medical
  • 7. September 2026
  • ElevenAgents
  • Workspaces
  • SDK-Releases
  • API
  • Neue Endpunkte
  • Aktualisierte Endpunkte
  • Schemaänderungen
  • 31. August 2026
  • ElevenAgents
  • Musik
  • Synchronisation
  • SDK-Releases
  • API
  • Aktualisierte Endpunkte
  • Schemaänderungen
  • 24. August 2026
  • ElevenLabs CLI
  • Verfahren
  • ElevenAgents
  • SDK-Releases
  • API
  • Neue Endpunkte
  • Aktualisierte Endpunkte
  • Schemaänderungen
  • 22. August 2026
  • MCP-Server
  • 17. August 2026
  • ElevenCreative
  • ElevenAgents
  • SDK-Releases
  • API
  • Neue Endpunkte
  • Aktualisierte Endpunkte
  • Schema-Änderungen
  • 10. August 2026
  • Dubbing v2 API
  • ElevenAgents
  • Stimmen
  • SDK-Releases
  • API
  • Neue Endpunkte
  • Aktualisierte Endpunkte
  • Schema-Änderungen

Changelog

September 23, 2026
September 23, 2026

September 21, 2026
September 21, 2026

September 14, 2026
September 14, 2026

September 11, 2026
September 11, 2026

September 7, 2026
September 7, 2026

August 31, 2026
August 31, 2026

August 24, 2026
August 24, 2026

August 22, 2026
August 22, 2026

August 17, 2026
August 17, 2026

August 10, 2026
August 10, 2026
Ältere Beiträge
Weiter
Erstellt mit
Anmelden

Bild & Video

  • Sora 2 und Sora 2 Pro eingestellt: OpenAI stellt die Sora API am 24. September 2026 ein. Beide Modelle wurden aus der Modellauswahl für Bild & Video entfernt und generieren ab diesem Datum nicht mehr. Bestehende Generierungen bleiben in Ihrem Verlauf verfügbar. Flows und Templates, die einen Sora-Knoten verwenden, müssen auf ein anderes Videomodell wie Gemini Omni 1.1 Flash umgestellt werden, bevor sie wieder ausgeführt werden können.
  • Seedance 1.5 Pro veraltet: ByteDance stellt Seedance 1.5 Pro am 11. November 2026 ein. Das Modell wird nicht mehr für neue Generierungen angeboten und funktioniert ab diesem Datum nicht mehr. Verwenden Sie stattdessen ein Seedance 2.0-Modell.

ElevenAgents

  • Parallele Tool-Aufrufe: Die Agent-Prompt-Konfiguration enthält jetzt enable_parallel_tool_calls (Boolean, Standardwert true). Wenn aktiviert, können unterstützte Modelle mehrere Tools in einem Zug ausführen.
  • Agent-Modelle: gpt-6-astra zu den Agent-LLM-Optionen hinzugefügt.
  • Benachrichtigungen: Agent-Benachrichtigungen unterstützen jetzt neben PagerDuty und Webhook-Benachrichtigern auch Slack-Kanäle.
  • Telefonnummernsuche: Einen cursor-paginierten Telefonnummern-Endpunkt mit Filtern für Anbieter, Unterstützung für ausgehende Anrufe, zugewiesenen Agent und Branch, Label und Telefonnummer hinzugefügt.

Bild und Video

  • GPT Image 2.5-Modelle: Bildgenerierung unterstützt jetzt gpt-image-2.5-flare und gpt-image-2.5-sunburst. Beide Modelle akzeptieren bis zu 10 Referenzbilder, Qualitätsstufen bis max, 14 feste Seitenverhältnisse sowie auto und eine Ausgabe in 1K, 2K oder 4K.

Speech Engine

  • Cascade-Timeout: Anfragen zum Erstellen und Aktualisieren der Speech Engine akzeptieren jetzt cascade_timeout_seconds (Zahl, 2–15, Standardwert 4), um zu steuern, wie lange ElevenLabs vor einem erneuten Versuch auf eine übergeordnete Speech Engine wartet.

Text to Speech

  • Turn-Grenzen mit mehreren Kontexten: Der Marker is_final_audio_for_turn wird jetzt nach jedem gepufferten Byte für diesen Turn ausgegeben, einschließlich MP3- und Opus-Ausgabe. Clients können den Marker als exakte Turn-Grenze verwenden, ohne zu PCM wechseln zu müssen.

SDK-Releases

JavaScript SDK

  • v2.69.0 - transcriptEdit zum Echtzeit-Speech-to-Text-Wrapper hinzugefügt; bearbeiteter Text wird über edited_transcript-Ereignisse bereitgestellt. JWT-Verifizierung der Speech Engine für API-Keys mit Data-Residency-Suffixen behoben. phoneNumbers.listV2 und Flows-Template-Methoden zum Auflisten und Abrufen von Templates sowie zum Auflisten, Erstellen und Abrufen von Ausführungen hinzugefügt. Clients und Typen für GPT Image 2.5, Slack-Agent-Benachrichtigungen, parallele Tool-Aufrufe, gpt-6-astra, Parallelitätslimits für API-Keys von Servicekonten, Music Zero Retention, Gesprächsfilter und MCP-Tool-Genehmigungsstatus neu generiert.

Python SDK

  • v2.69.0 - transcript_edit zum Echtzeit-Speech-to-Text-Wrapper hinzugefügt; bearbeiteter Text wird über edited_transcript-Ereignisse bereitgestellt. JWT-Verifizierung der Speech Engine für API-Keys mit Data-Residency-Suffixen behoben und play löst jetzt einen Fehler aus, wenn ffplay fehlschlägt. phone_numbers.list_v2 und Flows-Template-Methoden zum Auflisten und Abrufen von Templates sowie zum Auflisten, Erstellen und Abrufen von Ausführungen hinzugefügt. Clients und Typen für GPT Image 2.5, Slack-Agent-Benachrichtigungen, parallele Tool-Aufrufe, gpt-6-astra, Parallelitätslimits für API-Keys von Servicekonten, Music Zero Retention, Gesprächsfilter und MCP-Tool-Genehmigungsstatus neu generiert.

ElevenLabs CLI

  • v1.3.2 - Optionale --intent-Metadaten hinzugefügt, um Feedback zur CLI-Nutzung zu sammeln. elevenlabs feedback missing-capability hinzugefügt, um Workflows zu melden, die die CLI nicht unterstützt.

API

API-Änderungen anzeigen

Neue Endpunkte

ElevenAgents

  • Telefonnummernseite auflisten - GET /v1/convai/v2/phone-numbers
    • Optionale Paginierungsparameter page_size (Ganzzahl, 1–1.000, Standardwert 100) und cursor (nullable String) hinzugefügt.
    • Optionale Filter search, label, phone_number, provider, supports_outbound, agent_id, branch_id, sort_by und sort_direction hinzugefügt. sort_by akzeptiert label oder phone_number; sort_direction hat standardmäßig den Wert asc.
    • Die Antwort enthält die erforderlichen phone_numbers (Array), optional nullable next_cursor (String) und has_more (Boolean, Standardwert false).

Aktualisierte Endpunkte

ElevenAgents

  • Agent erstellen, Agent abrufen und Agent aktualisieren
    • Die Prompt-Konfiguration enthält zusätzlich enable_parallel_tool_calls (Boolean, Standardwert true). Workflow-Überschreibungen akzeptieren einen nullable Boolean.
    • Die Aufzählung LLM enthält zusätzlich gpt-6-astra, einschließlich Überschreibungen für die Gesprächsinitiierung.
    • Benachrichtiger für Alerting-Integrationen verwenden jetzt integration_type, um pagerduty oder slack auszuwählen. Slack-Benachrichtiger erfordern connection_id und channel_id (Strings); channel_id akzeptiert 1–64 Zeichen.
  • Unterhaltungen auflisten und Unterhaltungsreferenz auflösen
    • data_collection_params akzeptiert den Operator missing nicht mehr. Verwenden Sie einen leeren Wert, um Unterhaltungen abzugleichen, bei denen das Feld nicht erfasst wurde.
    • Ein leerer Wert in dynamic_variable_params gleicht Unterhaltungen ab, bei denen die Variable nicht gesetzt wurde.
  • Speech Engine erstellen, Speech Engine abrufen und Speech Engine aktualisieren
    • cascade_timeout_seconds (Zahl, 2–15) hinzugefügt. Erstellungsanfragen haben standardmäßig den Wert 4, Aktualisierungsanfragen akzeptieren einen nullable Wert und Antworten erfordern das Feld.

Bild und Video

  • Bildgenerierung erstellen - POST /v1/flows/image
    • Anfragevarianten für gpt-image-2.5-flare und gpt-image-2.5-sunburst hinzugefügt.
    • Beide Varianten erfordern prompt und model_id, akzeptieren bis zu 10 images und enthalten zusätzlich resolution (1K, 2K oder 4K, Standardwert 1K).
    • quality akzeptiert low, medium, high, xhigh oder max und hat standardmäßig den Wert high. aspect_ratio akzeptiert auto und 14 feste Verhältnisse und hat standardmäßig den Wert 16:9.

Synchronisation

  • Synchronisationsprojekt erstellen - POST /v1/dubbing/project
    • Multipart-keyterms akzeptiert wiederholte Felder oder ein einzelnes JSON-Array.
    • Multipart-webhook_ids akzeptiert wiederholte Felder, ein einzelnes JSON-Array oder einen kommagetrennten String.
  • Workspace-Ressource abrufen, Workspace-Ressource freigeben und Freigabe einer Workspace-Ressource aufheben
    • WorkspaceResourceType enthält zusätzlich dubbing_project.

Wissensdatenbank

  • Crawl-Job erstellen - POST /v1/convai/knowledge-base/crawl
    • max_depth (Ganzzahl, Standardwert 3) als veraltet markiert. Das Feld hat jetzt keine Wirkung mehr und unterliegt keinen Mindest- oder Höchstgrenzen.
    • Metadaten des Crawl-Jobs erfordern max_depth nicht mehr.

Benutzer

  • Benutzer abrufen und Abonnement abrufen
    • Währungsaufzählungen enthalten zusätzlich gbp.

Schemaänderungen

Text to Speech

  • WebSocket-Nachrichten audio und final mit mehreren Kontexten definieren is_final_audio_for_turn jetzt als nach der Übermittlung aller gepufferten Bytes für den Turn auftretend.

ElevenAgents

  • Anrufwarteschlange und Wartemusik: Anrufwarteschlangen für Agents an ihrem Parallelitätslimit hinzugefügt. Wartende Anrufer hören Wartemusik und erhalten queue_status-Ereignisse, bis sie zugelassen werden oder die Zeit abläuft. Neue API-Methoden laden benutzerdefinierte Wartemusik hoch oder löschen sie.
  • Metadaten zu Testversionen: Agent-Testergebnisse zeigen jetzt die Agent-Version, mit der sie ausgeführt wurden, und ob sie Entwurfsänderungen enthielten. Aufrufzusammenfassungen zeigen auch an, wenn teilweise erneute Einreichungen mit anderen Versionen ausgeführt wurden.
  • Modell- und Kontometadaten: Die Agent-LLM-Konfiguration akzeptiert jetzt gemini-3.8-flash. WhatsApp-Kontoantworten geben an, ob das Konto die Cloud API oder den Coexistence-Anmeldeprozess verwendet.

Musik

  • Unterstützung der Music v2.5 API: Musik-Endpunkte und SDKs akzeptieren jetzt music_v2_5. Chunks für Kompositionspläne unterstützen bis zu 6.132 Zeichen, mit bis zu 30 Zeilen à 200 Zeichen.

SDK-Releases

JavaScript SDK

  • v2.68.0 - Methoden zum Hochladen und Löschen von Wartemusik für Agents hinzugefügt. Typen für Anrufwarteschlangen, Prozedurreferenzen, Erstellung von Entwurfs-Branches, RAG-Abfragelimits, Metadaten zu Testversionen, gemini-3.8-flash und music_v2_5 neu generiert.

Python SDK

  • v2.68.0 - Synchrone und asynchrone Methoden zum Hochladen und Löschen von Wartemusik für Agents hinzugefügt. Typen für Anrufwarteschlangen, Prozeduren, Erstellung von Entwurfs-Branches, RAG-Abfragelimits, Metadaten zu Testversionen, gemini-3.8-flash und music_v2_5 neu generiert. Der Wrapper compose_detailed akzeptiert jetzt jede generierte Musikmodell-ID sowie prompt- und chunkbasierte Kompositionspläne.

iOS SDK

  • v3.3.1 - Gleicht Agent-Nachrichten anhand von response_id statt event_id ab. Dadurch bleiben mehrere Antworten bei Tool-Aufrufen erhalten und gestreamte Teile oder Korrekturen werden nicht der falschen Nachricht zugeordnet.

ElevenLabs CLI

  • v1.3.0 - Optionale --intent-Metadaten zu generierten API-Befehlen hinzugefügt. elevenlabs feedback missing-capability hinzugefügt, um Workflows zu melden, die die CLI nicht unterstützt.

Pakete

  • @elevenlabs/convai-widget-core@0.18.2 und @elevenlabs/convai-widget-embed@0.18.2 - Doppelte Agent-Antworten nach Tool- und Prozeduraufrufen behoben. Gestreamte Textantworten behalten die Markdown-Formatierung bei und Sprachunterhaltungen rendern keine nicht gesprochenen gestreamten Chat-Teile mehr. Das Embed-Paket begrenzt user_activity-Ereignisse außerdem auf einmal pro Sekunde und setzt die Begrenzung zurück, wenn eine Sitzung endet.

API

API-Änderungen anzeigen

Neue Endpunkte

ElevenAgents

  • Wartemusik für Agent hochladen - POST /v1/convai/agents/{agent_id}/hold-audio
    • Akzeptiert die erforderliche hold_audio_file (binär) als Multipart-Formulardaten. Die Datei muss MP3 oder WAV sein und darf bis zu 40 MB bzw. 180 Sekunden umfassen.
    • Gibt die erforderliche agent_id (String) und hold_audio (AgentHoldAudioConfig) zurück. Das Wartemusik-Objekt erfordert audio_path, audio_url, original_filename (Strings), duration_secs (Zahl) und size_bytes (Ganzzahl).
  • Wartemusik für Agent löschen - DELETE /v1/convai/agents/{agent_id}/hold-audio
    • Entfernt den benutzerdefinierten Clip, sodass wartende Anrufer den Standard-Warteton hören.
    • Gibt die erforderliche agent_id (String) zurück.

Aktualisierte Endpunkte

ElevenAgents

  • Agent erstellen, Agent abrufen und Agent aktualisieren
    • Optionale platform_settings.queueing_config (AgentQueueingConfig) mit enabled (Boolean, Standardwert false) und wait_timeout_seconds (Ganzzahl, 1–1.800, Standardwert 180) hinzugefügt.
    • Antworten zur Warteschlangenkonfiguration enthalten schreibgeschützte nullable hold_audio (AgentHoldAudioConfig). Agent-Antworten enthalten außerdem optional default_hold_audio_url (String).
  • Unterhaltung abrufen - GET /v1/convai/conversations/{conversation_id}
    • Metadaten enthalten zusätzlich optional nullable queue_wait_secs (Zahl). Die Wartezeit wird nicht in call_duration_secs und die abrechenbare Zeit einbezogen.
  • Agent-Branch erstellen - POST /v1/convai/agents/{agent_id}/branches
    • Optionales include_draft (Boolean, Standardwert false) hinzugefügt. Bei true enthält ein vom Branch-Tipp erstellter Branch den Entwurfs-Prozedursatz des Aufrufers.
  • Prozeduren auflisten sowie Endpunkte zum Erstellen, Abrufen und für Entwürfe von Prozeduren
    • Listenelemente enthalten zusätzlich optionale referenced_tool_ids, referenced_kb_ids, referenced_procedure_ids und referenced_dynamic_variables (String-Arrays).
    • Agent- und Merge-Vorschauantworten enthalten zusätzlich optionale procedures, eine nach Prozedur-ID sortierte Map.
  • Testaufrufe auflisten - GET /v1/convai/test-invocations
    • Optionales nullable search (String) hinzugefügt, um Tests und Ordner nach Namen zu filtern.
  • Tests für Agent ausführen und Testaufruf abrufen
    • Antworten für Test-Suite-Aufrufe und Unit-Test-Ausführungen enthalten zusätzlich optional nullable version_id (String) und optional ran_against_draft (Boolean, Standardwert false).
    • Aufrufzusammenfassungen enthalten außerdem optional runs_diverged_from_version (Boolean, Standardwert false).
  • POST /v1/convai/agents/{agent_id}/knowledge-base/rag-query
    • Der Anfragetext enthält zusätzlich optionale nullable, abfragespezifische Überschreibungen für max_documents_length (Ganzzahl, 1–50.000) und max_retrieved_rag_chunks_count (Ganzzahl, 1–20).
  • WhatsApp-Konto abrufen - GET /v1/convai/whatsapp-accounts/{phone_number_id}
    • Optionales account_type (WhatsAppAccountType, Standardwert cloud_api) hinzugefügt. Werte sind cloud_api und coexistence.
  • Erwartete LLM-Nutzung berechnen - POST /v1/convai/agent/{agent_id}/llm-usage/calculate
    • LLMUsageCalculatorLLMResponseModel enthält zusätzlich das erforderliche price_per_message (Zahl).

Musik

  • MusicModelID enthält zusätzlich music_v2_5 für POST /v1/music/video-to-music, POST /v1/music/plan, Musik komponieren, POST /v1/music/detailed, POST /v1/music/detailed/stream, POST /v1/music/stream, POST /v1/music/upload und POST /v1/music/finetunes.
  • GenerationChunk.text erhöht maxLength von 6.000 auf 6.132 Zeichen für POST /v1/music/plan, POST /v1/music, POST /v1/music/detailed, POST /v1/music/detailed/stream, POST /v1/music/stream und POST /v1/music/upload. Abschnittsnamen können 1–100 Zeichen enthalten und Chunks können bis zu 30 Zeilen mit jeweils 200 Zeichen enthalten.

Schemaänderungen

ElevenAgents

  • Echtzeit-Serverereignisse enthalten zusätzlich queue_status. Das erforderliche queue_status_event.status akzeptiert waiting, admitted oder timed_out; timed_out geht dem WebSocket-Schließcode 4300 voraus. Wartemusik trifft weiterhin als reguläre audio-Ereignisse ein.
  • Die Aufzählung LLM enthält zusätzlich gemini-3.8-flash, einschließlich Überschreibungen für die Gesprächsinitiierung.
  • Vereinigungen für System-Tool-Ergebnisse von Unterhaltungen enthalten zusätzlich start_procedure_success, start_procedure_error, end_procedure_success und end_procedure_error.
  • FeaturesUsageCommonModel enthält zusätzlich optionale Feature-Status für freeform_procedure und structured_procedure.

Scribe v2 Medical

Scribe v2 Medical ist jetzt allgemein verfügbar. Es ist ein Batch-Spracherkennungsmodell für medizinische und klinische Audiodaten, das zum gleichen Preis wie Scribe v2 abgerechnet wird.

Übergeben Sie scribe_v2_medical als model_id bei Transkript erstellen. Keyterm-Prompting, Entitätserkennung, Sprecherdiarisierung und der No-verbatim-Modus funktionieren wie bei Scribe v2.

Modelle

Modell-ID, Funktionen und Einsatzbereiche von Scribe v2 Medical.

Transkript erstellen

Transkribieren Sie Audio mit model_id auf scribe_v2_medical gesetzt.

ElevenAgents

  • Gesprächs-Tickets für den gesamten Workspace: Workspace-Tickets auflisten hinzugefügt, um Gesprächs-Triage-Tickets aller zugänglichen Agenten abzurufen. Filtern Sie nach Status oder Bearbeiter und verwenden Sie Cursor-Paginierung, um bis zu 100 Tickets pro Seite abzurufen.
  • Gesprächsfilter für dynamische Variablen: Gespräche auflisten und Gesprächsnachrichten per Text durchsuchen akzeptieren jetzt wiederholbare Filter dynamic_variable_params. Verwenden Sie name:op:value mit eq, gt, gte, lt oder lte; Vergleichsoperatoren erfordern numerische Werte.
  • Twilio-Anrufbeantwortererkennung: Konfigurationen für ausgehende Telefonie und Batch-Anrufe unterstützen jetzt optional twilio_machine_detection. Wählen Sie enable für eine frühe Entscheidung Mensch oder Maschine oder detect_message_end, um auf das Ende einer Mailboxansage zu warten. Ergebnisse werden über das neue Webhook-Ereignis answering_machine_detection bereitgestellt.
  • Wertbeschränkungen bei der Datenerfassung: Datenerfassungseigenschaften können jetzt allowed_values verwenden, um eine dynamische Variable mit den zulässigen Werten zu benennen. Das bisherige Feld allowed_values_dynamic_variable ist veraltet.
  • Agentenmetadaten: Antworten von Agentenzweige auflisten zeigen jetzt an, wann ein Entwurf erstellt wurde und ob er älter als die Spitze des Zweigs ist. Agenten- und Speech-Engine-Zusammenfassungen erfordern jetzt voice_id.
  • Quell-URLs der Wissensdatenbank: Agent-RAG-Abfrage-Chunks enthalten jetzt das erforderliche nullable source_url mit der nachverfolgten URL für URL-Dokumente.
  • Anhänge in Agentenantworten: WebSocket-Ereignisse agent_response enthalten jetzt optionale attachments. Jeder Anhang erfordert url und name und kann mime_type enthalten.

Workspaces

  • Plattformlimits für API-Schlüssel: Antworten für API-Schlüssel von Servicekonten können jetzt Enterprise-platform_limits für Credits, Professional Voice Clones sowie TTS-, Synchronisations- und Musik-Parallelität enthalten.

SDK-Releases

JavaScript SDK

  • v2.67.0 - dynamicVariableParams zu Anfragen für Gesprächslisten und Textsuche hinzugefügt. Typen für Twilio-Anrufbeantwortererkennung, Wertbeschränkungen bei der Datenerfassung, Plattformlimits für API-Schlüssel, Entwurfsmetadaten von Agentenzweigen und Quell-URLs der Wissensdatenbank neu generiert.

Python SDK

  • v2.67.0 - dynamic_variable_params zu synchronen und asynchronen Methoden für Gesprächslisten und Textsuche hinzugefügt. Typen für Twilio-Anrufbeantwortererkennung, Wertbeschränkungen bei der Datenerfassung, Plattformlimits für API-Schlüssel, Entwurfsmetadaten von Agentenzweigen und Quell-URLs der Wissensdatenbank neu generiert. Der Echtzeit-Text-to-Speech-Client übergibt das interne Omit-Sentinel nicht mehr an die Verbindung.

ElevenLabs CLI

  • v1.2.0 - Den Befehl elevenlabs say und dessen Agenten-Skill hinzugefügt, API-Befehlsbindungen neu generiert und eleven_v3 zum Standard-TTS-Modell gemacht.

Pakete

  • @elevenlabs/client@1.25.0, @elevenlabs/react@1.15.2, @elevenlabs/react-native@1.2.27, @elevenlabs/convai-widget-core@0.18.1 und @elevenlabs/convai-widget-embed@0.18.1 - MessageAttachment aus @elevenlabs/client erneut exportiert, sodass Nutzer den Typ direkt importieren können.
  • @elevenlabs/client@1.24.0, @elevenlabs/types@0.23.0, @elevenlabs/react@1.15.1, @elevenlabs/react-native@1.2.26, @elevenlabs/convai-widget-core@0.18.0 und @elevenlabs/convai-widget-embed@0.18.0 - Dateianhänge von Agentenantworten an onMessage weitergeleitet und die optionale Sitzungseinstellung webRtc.singlePeerConnection hinzugefügt. Das Widget lokalisiert jetzt auch Begrüßungsschaltflächen und behebt verlorene oder doppelte Textchat-Antworten.

API

API-Änderungen anzeigen

Neue Endpunkte

ElevenAgents

  • Workspace-Tickets auflisten - GET /v1/convai/triage-tickets
    • Listet Gesprächs-Triage-Tickets aller Agenten auf, auf die der Aufrufer Zugriff hat, sortiert nach den zuletzt erstellten zuerst.
    • Optionale Abfrageparameter page_size (Integer, 1–100, Standard 100), status (AgentConversationTicketStatus), assignee_user_id (String oder unassigned) und cursor (String) hinzugefügt.
    • Gibt GetAgentConversationTicketsPageResponseModel zurück.

Aktualisierte Endpunkte

ElevenAgents

  • Gespräche auflisten - GET /v1/convai/conversations
    • Optionales nullable dynamic_variable_params (wiederholbares String-Array) hinzugefügt. Jeder Wert verwendet name:op:value, wobei op eq, gt, gte, lt oder lte ist.
  • Gesprächsnachrichten per Text durchsuchen - GET /v1/convai/conversations/messages/text-search
    • Optionales nullable dynamic_variable_params (wiederholbares String-Array) mit derselben Syntax hinzugefügt.
  • Ausgehender Twilio-Anruf, ausgehender SIP-Trunk-Anruf, ausgehender Exotel-Anruf und Batch-Anrufe übermitteln
    • telephony_call_config verwendet jetzt separate Eingabe- und Ausgabeschemas.
    • Optionales nullable twilio_machine_detection (TwilioMachineDetectionConfig) hinzugefügt. Der Modus mode akzeptiert enable oder detect_message_end und hat standardmäßig den Wert enable. Die Einstellung wird für Nicht-Twilio-Anbieter und eingehende Anrufe ignoriert.
  • Telefonnummer importieren - POST /v1/convai/phone-numbers
    • Optionales nullable account_auth_token (String) für Importe von Twilio-API-Schlüsseln hinzugefügt, um Signaturen eingehender Webhooks zu validieren.

Schemaänderungen

ElevenAgents

  • WebhookEventType enthält jetzt answering_machine_detection.
  • AgentBranchSummary enthält jetzt optionales nullable draft_created_at (Integer) und optionales draft_is_behind_tip (Boolean, Standard false).
  • AgentKnowledgeBaseRagChunkResponseModel enthält jetzt das erforderliche nullable source_url (String).
  • AgentSummaryResponseModel und SpeechEngineSummaryResponse enthalten jetzt das erforderliche voice_id (String).
  • AnalysisProperty enthält jetzt optionales nullable name (String) und allowed_values (AllowedValues). LiteralJsonSchemaProperty enthält jetzt ebenfalls allowed_values. Beide verwerfen allowed_values_dynamic_variable.
  • DataCollectionResultCommonModel enthält jetzt optionales nullable name (String).
  • WorkspaceApiKeyResponseModel enthält jetzt optionales nullable platform_limits (PlatformLimits).
  • MCP-Tool Icon enthält jetzt optionales nullable theme (light oder dark).
  • SMBToolConfig enthält jetzt die Parametervarianten send_custom_email, create_service_quote_request und create_product_quote_request.
  • Webhook-Abfrageparameterschemas und die Telefonie-Anrufkonfiguration verwenden jetzt separate Eingabe- und Ausgabemodelle.
  • WebSocket-Ereignisse agent_response enthalten jetzt optionale attachments (Array). Jedes Element erfordert url und name (Strings) und akzeptiert optionales mime_type (String).

ElevenCreative

  • ReferenceVideo.studio_clip verwendet jetzt StudioClipLocator statt StudioClipReference. Die Felder und das Wire-Format bleiben unverändert.

ElevenAgents

  • Telefontastatureingabe: Die Konfiguration von Agentengesprächen unterstützt jetzt optional dtmf_input_settings für DTMF-Eingabe. Konfigurieren Sie das Ziffern-Timeout, verwenden Sie # als Abschlusszeichen und schwärzen Sie Tastatureingaben in Transkripten, Logs und Analysen.
  • Verlauf von Gesprächsanhängen: Transkripteinträge von Gespräch abrufen enthalten jetzt file_inputs, ein Array mit ID, Name, MIME-Typ und URL jeder angehängten Datei.
  • Filterung nach Agent-Tags: Agenten auflisten akzeptiert jetzt den optionalen Abfrageparameter tags. Wiederholen Sie den Parameter, um Agenten mit einem der angegebenen Tags zu finden.
  • Kontext für Batch-Kampagnen: Gespräch abrufen kennzeichnet Batch-Anrufe jetzt mit nullable campaign-Metadaten, die das erforderliche campaign_id und campaign_lead_id enthalten.

Musik

  • Visuelle Wellenformdaten: Musik detailliert generieren, Musik mit Details streamen und Musik hochladen akzeptieren jetzt optional with_waveform_visual (Boolean, Standard false). Antworten mit dieser Option enthalten ein niedrig aufgelöstes waveform_visual-Integer-Array mit vier Samples pro Sekunde.

Synchronisation

  • Verhalten der Projektpaginierung: Synchronisationsprojekte auflisten und Sprachziele auflisten begrenzen page_size jetzt auf 1–100. Die Projektstatusfilterung enthält queued, und beide Endpunkte dokumentieren die Verwendung von next_cursor zum Abrufen der nächsten Seite.

SDK-Releases

JavaScript SDK

  • v2.66.0 - fileIds zu sendMultimodalMessage hinzugefügt, sodass eine Nachricht mehrere Dateianhänge enthalten kann.

Python SDK

  • v2.66.0 - file_ids zu send_multimodal_message hinzugefügt, sodass eine Nachricht mehrere Dateianhänge enthalten kann.

Android SDK

  • v0.12.2 - Den Callback onUnhandledClientToolCall beim Verknüpfen von Sitzungsereignissen beibehalten. Nicht behandelte Client-Tool-Aufrufe, die eine Antwort erwarten, erhalten jetzt die automatische Fehlerantwort, statt ungelöst zu bleiben.

ElevenLabs CLI

  • v1.1.0 - API-Befehlsbindungen neu generiert und befehlsspezifische Anfragezuordnung für ElevenAgents-Workflows hinzugefügt. Diese Befehle hängen cmd/<command> an den CLI-User-Agent an, sodass Anfragen aus Workflows wie agents push und agents create unterschieden werden können.

Pakete

  • @elevenlabs/client@1.23.0, @elevenlabs/react@1.15.0, @elevenlabs/types@0.22.1, @elevenlabs/react-native@1.2.25, @elevenlabs/convai-widget-core@0.17.1 und @elevenlabs/convai-widget-embed@0.17.1 - fileIds zu sendMultimodalMessage hinzugefügt. Der Client sendet aus Kompatibilitätsgründen sowohl die Felder file als auch files, und React stellt die aktualisierte Client-API bereit.

API

API-Änderungen anzeigen

Aktualisierte Endpunkte

ElevenAgents

  • Agenten auflisten - GET /v1/convai/agents
    • Optionales nullable tags (String-Array) hinzugefügt. Wiederholen Sie den Abfrageparameter, um einen beliebigen angegebenen Tag abzugleichen.
  • Agent erstellen, Agent abrufen und Agent aktualisieren
    • Optionales nullable conversation_config.conversation.dtmf_input_settings (DTMFInputConfig) hinzugefügt. Es unterstützt dtmf_input_timeout (Zahl, 0,5–10 Sekunden, Standard 2), hash_terminator (Boolean, Standard true) und redact_input (Boolean, Standard false).
    • Optionales sip_refer_play_dialtone (Boolean, Standard true) zur Konfiguration der Telefonnummernweiterleitung hinzugefügt. Setzen Sie es auf false, damit der ursprüngliche Anrufzweig stumm bleibt, während eine SIP-REFER-Weiterleitung abgeschlossen wird.
    • System-Tools für Start- und Endprozeduren akzeptieren jetzt entweder einen ProcedureVersionRef oder einen ProcedureDraftRef. Entwurfsreferenzen erfordern procedure_id (String) und setzen version_id auf null.
  • Gespräch abrufen - GET /v1/convai/conversations/{conversation_id}
    • file_inputs (Array von ConversationHistoryTranscriptFileInputResponseModel) zu Transkripteinträgen hinzugefügt. Jedes Element erfordert file_id, original_filename, mime_type und file_url (Strings).
    • Optionales nullable campaign (BatchCallingCampaignInformation) zu Batch-Anrufmetadaten hinzugefügt. Das Objekt erfordert campaign_id und campaign_lead_id (Strings).
    • dtmf zu ChatSourceMedium hinzugefügt.
  • Problemtypen für Gesprächs-Triage-Tickets enthalten jetzt incorrect_information, documentation_gap, platform_bug und wrong_action.

Musik

  • Musik detailliert generieren (POST /v1/music/detailed) und Musik mit Details streamen (POST /v1/music/detailed/stream)
    • Optionales with_waveform_visual (Boolean, Standard false) hinzugefügt.
    • Detaillierte Antworten enthalten jetzt nullable waveform_visual (Integer-Array), viermal pro Sekunde von -1000 bis 1000 gesampelt.
  • Musik hochladen - POST /v1/music/upload
    • Optionales with_waveform_visual (Boolean, Standard false) und nullable waveform_visual (Integer-Array) in der Antwort hinzugefügt.

ElevenCreative

  • Studio-Projekt erstellen und Podcast erstellen
    • quality_preset akzeptiert jetzt null, und der Schema-Standardwert standard wurde entfernt.

Synchronisation

  • Synchronisationsprojekte auflisten - GET /v1/dubbing/project
    • page_size bleibt ein optionaler Integer mit dem Standardwert 20, aber Werte werden jetzt auf 1–100 begrenzt, statt abgelehnt zu werden.
    • Der Filter status dokumentiert jetzt queued, preparing, ready und failed.
    • Übergeben Sie den next_cursor der vorherigen Antwort in cursor; lassen Sie ihn für die erste Seite weg.
  • Sprachziele auflisten - GET /v1/dubbing/project/{project_id}/language
    • page_size bleibt ein optionaler Integer mit dem Standardwert 20, aber Werte werden jetzt auf 1–100 begrenzt, statt abgelehnt zu werden.
    • Der Filter status unterstützt queued, processing, completed, stale und failed.
    • Übergeben Sie den next_cursor der vorherigen Antwort in cursor; lassen Sie ihn für die erste Seite weg.

Schemaänderungen

Workspace

  • PendingSubscriptionSwitchResponseModel.next_tier enthält jetzt grant.

ElevenLabs CLI

Die ElevenLabs CLI v1.0.0 ist jetzt verfügbar. Jede ElevenLabs-API-Operation steht als Unterbefehl bereit – mit JSON-, Tabellen-, YAML- und CSV-Ausgabe, automatischer Paginierung und Shell-Vervollständigung.

Die CLI bietet auch lokale Konfigurations-Workflows für ElevenAgents. Speichern Sie Agenten-, Tool- und Testkonfigurationen als Dateien, synchronisieren Sie sie mit Push- und Pull-Befehlen, verwalten Sie Branches, führen Sie Tests aus, installieren Sie ElevenLabs-UI-Komponenten und wählen Sie eine Datenresidenzregion.

CLI-Dokumentation

Installieren Sie die CLI, authentifizieren Sie sich und verwalten Sie Agenten als Code.

Verfahren

Verfahren sind jetzt allgemein in ElevenAgents verfügbar. Ein Verfahren enthält aufgabenspezifische Anweisungen und einen Auslöser, der bestimmt, wann sie gelten. Während eines Gesprächs lädt der Agent das relevante Verfahren. So kann ein Agent unterschiedliche Aufgaben bearbeiten, ohne jede Anweisung in seinen System-Prompt aufzunehmen.

Verwenden Sie Freiform-Verfahren, wenn der Agent die Formulierung oder Reihenfolge der Anweisungen anpassen kann. Verwenden Sie strukturierte Verfahren, wenn Schritte in einer definierten Reihenfolge ausgeführt werden müssen. Beide Typen können beim selben Agenten zusammen mit Workflows verwendet werden.

Überblick über Verfahren

Erfahren Sie, wann Sie Verfahren einsetzen und wie sie sich von Prompts und Workflows unterscheiden.

Freiform-Verfahren

Schreiben Sie Anweisungen in natürlicher Sprache, die der Agent an das Gespräch anpassen kann.

Strukturierte Verfahren

Definieren Sie typisierte Schritte, die der Agent in einer konsistenten Reihenfolge befolgt.

ElevenAgents

  • Tickets zur Gesprächstriage: APIs zum Erstellen von Tickets zur Agentenleistung, manuellen Follow-up-Tickets, Auflisten von Tickets, Zuweisen von Workspace-Mitgliedern, Aktualisieren von Status und zuständiger Person sowie Hinzufügen von Kommentaren auf Ticket- oder Turn-Ebene hinzugefügt.
  • Gesprächsbeobachtbarkeit: Echtzeit-Clients können nach jedem abgeschlossenen Agenten-Turn ein context_usage-Ereignis erhalten. Das Ereignis meldet das Modell, die Anzahl der Prompt-Tokens und das Kontextlimit des Modells.

SDK-Releases

JavaScript SDK

  • v2.65.0 - Clients und Typen für Gesprächstriage-Tickets und kompakte Gesprächszusammenfassungen hinzugefügt. Gesprächs-APIs ergänzen Filter für Verfahren, ungültige Tool-Aufrufe und Sortierung; Verfahrens-APIs ergänzen die Auswahl der Agentenversion; Themen-APIs ergänzen Steuerelemente für Bewertungsdetails und Sortierung nach Frustration. Das Release ergänzt außerdem Felder für Aktualisierungshäufigkeit der Wissensdatenbank, Testumgebung und Alerting-Integration sowie Echtzeit-Nachrichtentypen für Synchronisation.

Python SDK

  • v2.65.0 - Clients und Typen für Gesprächstriage-Tickets und kompakte Gesprächszusammenfassungen hinzugefügt. Gesprächs-APIs ergänzen Filter für Verfahren, ungültige Tool-Aufrufe und Sortierung; Verfahrens-APIs ergänzen die Auswahl der Agentenversion; Themen-APIs ergänzen Steuerelemente für Bewertungsdetails und Sortierung nach Frustration. Das Release ergänzt außerdem Felder für Aktualisierungshäufigkeit der Wissensdatenbank, Testumgebung und Alerting-Integration und erhält wiederholte Multipart-Felder für Speech to Text keyterms und Synchronisation webhook_ids.

Swift SDK

  • v3.3.0 - Typisierte Client-Fehleranalyse, Verarbeitung von expects_response und typsichere Tool-Ergebnisse hinzugefügt. Der WebRTC-Start ist jetzt bereit, sobald der Agent beitritt, statt auf das Abonnement des Audiotracks zu warten. Das Release verbessert außerdem die URL-Verarbeitung, unterdrückt Rauschen durch unbekannte Ereignisse und entfernt die Echtzeit-Thread-Allokation aus der Verarbeitung der Software-Stummschaltung.

Pakete

  • @elevenlabs/client@1.19.1, @elevenlabs/react@1.12.3, @elevenlabs/react-native@1.2.21, @elevenlabs/convai-widget-core@0.16.2 und @elevenlabs/convai-widget-embed@0.16.2 - Die WebRTC-Ausgabeerfassung verwendet jetzt selbst gehostete AudioWorklet-Pfade unter strikten Content-Security-Policies. Das Worklet-Caching umfasst die angeforderte Quelle, damit eine frühere Inline-URL keinen selbst gehosteten Pfad ersetzt. React-Native-Einrichtungsfehler verweisen jetzt auf @elevenlabs/react-native.
  • @elevenlabs/client@1.20.0, @elevenlabs/react@1.12.4, @elevenlabs/react-native@1.2.22, @elevenlabs/convai-widget-core@0.16.3 und @elevenlabs/convai-widget-embed@0.16.3 - Optionales webRtc.iceTransportPolicy hinzugefügt. Setzen Sie es auf relay, um WebRTC-ICE-Kandidaten in Netzwerken, die direkten UDP-Datenverkehr blockieren, auf TURN-Relays zu beschränken.
  • @elevenlabs/client@1.21.0, @elevenlabs/react@1.13.0, @elevenlabs/types@0.21.1, @elevenlabs/react-native@1.2.23, @elevenlabs/convai-widget-core@0.16.4 und @elevenlabs/convai-widget-embed@0.16.4 - Den Callback onContextUsage und den Typ ContextUsageEvent hinzugefügt. React stellt den Callback über useConversation bereit. React Native löst jetzt über seine Paketexport-Bedingung statt über die Erkennung globaler Browser-Objekte auf.
  • @elevenlabs/client@1.22.0, @elevenlabs/react@1.14.0, @elevenlabs/types@0.22.0, @elevenlabs/react-native@1.2.24, @elevenlabs/convai-widget-core@0.17.0 und @elevenlabs/convai-widget-embed@0.17.0 - Rich Content für die erste Nachricht mit zugeordneten Button-Antworten, onExternalAgentDisconnected und onMCPToolApprovalRequest hinzugefügt. WebRTC verwendet jetzt das ausgewählte Eingabegerät, behält den Stummschaltungsstatus beim Mikrofonwechsel bei und bricht die Einrichtung ab, wenn Initialisierungsdaten nicht gesendet werden können. Das Widget ergänzt den Status der Nebenläufigkeitswarteschlange, eine optionale Sprachauswahl im eingeklappten Auslöser und die Darstellung der ersten Nachricht für Agenten, die Text und Stimme unterstützen.

API

API-Änderungen anzeigen

Neue Endpunkte

ElevenAgents

  • Neun Endpunkte für Gesprächstriage-Tickets hinzugefügt:
    • Gesprächsticket erstellen - POST /v1/convai/triage-tickets. Die Anfrage erfordert conversation_id (String) und akzeptiert qa_comment (nullable String, 1–10.000 Zeichen) sowie bis zu 200 Turn-Kommentare.
    • Tickets auflisten - GET /v1/convai/agents/{agent_id}/triage-tickets, mit Cursor-Paginierung.
    • Manuelles Ticket erstellen - POST /v1/convai/agents/{agent_id}/triage-tickets. Die Anfrage erfordert qa_comment (String, 1–10.000 Zeichen).
    • Zuweisbare Benutzer auflisten - GET /v1/convai/agents/{agent_id}/triage-tickets/assignable-users. Die Antwort listet Workspace-Mitglieder ohne Service-Account und gibt an, ob jedes Mitglied Zugriff auf den Agenten hat.
    • Ticket abrufen - GET /v1/convai/triage-tickets/{agentqa_ticket_id}.
    • Ticket aktualisieren - PATCH /v1/convai/triage-tickets/{agentqa_ticket_id}. Die Anfrage akzeptiert optional status und nullable assignee_user_id.
    • Ticket löschen - DELETE /v1/convai/triage-tickets/{agentqa_ticket_id}.
    • Kommentar hinzufügen - POST /v1/convai/triage-tickets/{agentqa_ticket_id}/comments. Die Anfrage erfordert comment (String, 1–10.000 Zeichen).
    • Turn-Kommentar hinzufügen - POST /v1/convai/triage-tickets/{agentqa_ticket_id}/turn-comments. Die Anfrage erfordert den nullbasierten turn_index (Integer) und comment (String, 1–10.000 Zeichen).

Aktualisierte Endpunkte

ElevenAgents

  • Signierte URL abrufen - GET /v1/convai/conversation/get-signed-url
    • Optionales debug_events_request (Boolean, Standardwert false) hinzugefügt. Debug-Ereignisse erfordern Editor-Zugriff auf den Agenten.
  • WebRTC-Token abrufen - GET /v1/convai/conversation/token
    • Optionales debug_events_request (Boolean, Standardwert false) hinzugefügt. Die Legacy-Route GET /v1/convai/conversation/get_signed_url akzeptiert denselben Parameter.
  • Gespräche auflisten - GET /v1/convai/conversations
    • Optionales triggered_procedure_ids (nullable String-Array, maximal 50) hinzugefügt, um Gespräche abzugleichen, in denen eines der angegebenen Verfahren ausgeführt wurde.
    • Optionales include_invalid_tool_calls (Boolean, Standardwert false) hinzugefügt, um Tool-Aufrufe einzuschließen, die nicht ausgeführt wurden.
    • Optionales sort_direction (asc oder desc, Standardwert desc) für die Startzeit des Anrufs hinzugefügt.
  • Textsuche in Gesprächsnachrichten - GET /v1/convai/conversations/messages/text-search
    • Optionales triggered_procedure_ids (nullable String-Array, maximal 50) hinzugefügt.
    • Optionales include_invalid_tool_calls (Boolean, Standardwert false) hinzugefügt.
  • Themen von Agentengesprächen abrufen - GET /v1/convai/agents/{agent_id}/topics
    • Optionales include_evaluation_criteria (Boolean, Standardwert true) hinzugefügt.
    • frustration zu sort_by hinzugefügt.
    • Themenantworten ergänzen nullable success_rate (Zahl), während die Gesamtantwort aggregated_run_count (Integer, Standardwert 0) ergänzt.
    • from_unix_secs wird auf den Beginn seines UTC-Tags abgerundet. Ein begrenzter Bereich aggregiert abgeschlossene tägliche Ermittlungsläufe; ohne beide Grenzen wird der neueste Lauf zurückgegeben.
  • Verfahren auflisten (GET /v1/convai/agents/{agent_id}/branches/{branch_id}/procedures) und Verfahren abrufen (GET /v1/convai/agents/{agent_id}/branches/{branch_id}/procedures/{procedure_id})
    • Optionales nullable agent_version_id (String) hinzugefügt, um Verfahren aus einer bestimmten Agentenversion abzurufen.
  • Test erstellen und Test aktualisieren
    • Optionales nullable environment (String) zu den Schemata für Antwort-, Simulations- und Tool-Aufruf-Unit-Tests hinzugefügt. Der Wert wählt umgebungsspezifische URLs, Header und Auth-Verbindungen aus; Standard ist production.
  • URL-Dokument erstellen, Crawl-Job erstellen und Ordner erstellen
    • Optionales nullable minimum_frequency_days (Integer, 1–180) für die automatische Synchronisierung hinzugefügt. Der Standardwert ist 7, und eine strengere Häufigkeit des übergeordneten Ordners hat Vorrang.

Musik

  • Music-Finetunes auflisten - GET /v1/music/finetunes
    • Die maximale page_size wurde von 100 auf 150 erhöht. Der Standardwert bleibt 50.

Schemaänderungen

ElevenAgents

  • Anfragen zur Agentenaktualisierung ergänzen optionales nullable procedures (object<string, ProcedureVersionRef>). Jeder Wert erfordert procedure_id und version_id (Strings). Ein leeres Objekt entfernt alle Verfahren.
  • Die Konfiguration für die Gesprächsinitiierung ergänzt enable_procedure_ids_from_client (Boolean, Standardwert false). Initialisierungsdaten ergänzen optionales nullable procedure_ids (String-Array); ein leeres Array deaktiviert alle Verfahren für den startenden Agenten.
  • ClientEvent ergänzt context_usage.
  • Soft-Timeout-Overrides ergänzen optionales nullable additional_soft_timeout_messages (String-Array).
  • Konstante Werte in Analyse- und Schema-Override-Modellen akzeptieren jetzt null.
  • Die Standardwerte der Widget-Konfiguration für mic_muting_enabled und transcript_enabled wurden von false auf true geändert. Setzen Sie sie explizit auf false, um das bisherige Verhalten beizubehalten.

Workspace

  • Antworten von Benutzer abrufen haben xi_api_key aus UserResponseModel entfernt.
  • ResourceMetadataResponseModel.role_to_group_ids akzeptiert jetzt benutzerdefinierte Rollen-IDs als Schlüssel, statt Schlüssel auf admin, editor, commenter und viewer zu beschränken.
  • Antworten für direktes Veröffentlichen ergänzen optionales nullable restricted_to_user_email_domains (String-Array).
  • Antworten für ausstehende Abonnementwechsel ergänzen go zu next_tier.

MCP-Server

  • Lokaler MCP-Server eingestellt: Der lokale ElevenLabs MCP-Server und der MCP-Player werden zugunsten des gehosteten MCP-Servers eingestellt. Beide Repositories wurden archiviert und erhalten keine Updates mehr. Der gehostete Server ist unter https://api.elevenlabs.io/v1/mcp verfügbar, meldet Sie über OAuth mit Ihrem ElevenLabs-Konto an und erfordert weder eine lokale Installation noch einen API-Schlüssel. Anleitungen zur Einrichtung für Claude, Cursor und andere MCP-Clients finden Sie in der Dokumentation zum gehosteten MCP-Server.

ElevenCreative

  • APIs zur Bild-, Video- und Sprachgenerierung: Neue asynchrone Flows-APIs erstellen, listen und rufen Video-, Bild- und Sprachgenerierungen ab. Generierungsantworten enthalten die Status pending, generating, completed und failed. Anfragen können ein Webhook-Ziel für Abschlussereignisse enthalten.
  • Wiederverwendbare Medien-Assets: Neue Asset-APIs laden Workspace-Medien hoch, listen sie auf, rufen sie ab und löschen sie. Bild-, Video- und Audioreferenzen können ein hochgeladenes Asset, eine vorherige Generierung oder Inline-Base64-Daten verwenden. Dadurch lassen sich Generierungsjobs verketten. Siehe Referenzen und Assets.

ElevenAgents

  • Kompakte Konversationszusammenfassungen: Konversationszusammenfassung abrufen gibt den generierten Titel, die Transkriptzusammenfassung, das Anrufergebnis und einfache Benutzer- oder Agent-Nachrichten zurück, ohne das vollständige Transkript zu laden. Der optionale Abfrageparameter max_messages ist eine Ganzzahl von 1 bis 200 (Standardwert 40); bei längeren Konversationen wird messages_omitted auf true gesetzt. Nützlich für Agents, die Kontext erhalten müssen.
  • Seitennummerierung und Sortierung von Konversationsthemen: Konversationsthemen eines Agents abrufen fügt optionale Cursor-Paginierung und Sortierung hinzu. Verwenden Sie page_size (Integer, 1–100), cursor (String), sort_by (conversations, sentiment oder success_rate) und sort_direction (asc oder desc). Antworten erhalten has_more und nullable next_cursor.
  • Warteschlangen für Parallelitätslimits: Einstellungen der Agent-Plattform erhalten das optionale Feld queueing (AgentQueueingConfig). Setzen Sie enabled auf true, um Anrufer zu halten, wenn der Agent sein Parallelitätslimit erreicht; wait_timeout_seconds ist eine Ganzzahl bis 1.800 (Standardwert 180).
  • Steuerung von Turns und Workflows: Die Turn-Konfiguration erhält merge_with_default_ignore_terms (Boolean, Standardwert false), um benutzerdefinierte Unterbrechungsbegriffe mit kuratierten Standardwerten zu kombinieren. Soft-Timeouts erhalten disable_until_first_user_message (Boolean, Standardwert false), und Workflow-Tool-Locators erhalten optionale schema_overrides für Parameter-Overrides pro Knoten.
  • Standardwerte für Hintergrundaudio: BackgroundSoundConfig.volume hat jetzt standardmäßig den Wert 0.15 statt 0.6, und crossfade_loop standardmäßig true statt false. Setzen Sie diese Felder explizit, um das bisherige Verhalten beizubehalten.

SDK-Releases

JavaScript SDK

  • v2.64.0 - client.assets zum Hochladen, Auflisten, Abrufen und Löschen von Assets sowie client.flows für die asynchrone Video-, Bild- und Sprachgenerierung hinzugefügt. Die Turn-Konfiguration erhält mergeWithDefaultIgnoreTerms. CustomToolApiSchemaConfig und scimExternalId aus WorkspaceGroupResponseModel entfernt.

Python SDK

  • v2.64.0 - Clients für Assets und Flows zur asynchronen Video-, Bild- und Sprachgenerierung sowie merge_with_default_ignore_terms in der Turn-Konfiguration hinzugefügt. Das Einrichten von On-Prem-Session erhält extra_setup_config, um zusätzliche Setup-Nachrichtenfelder zu übergeben.

Pakete

  • @elevenlabs/client@1.18.0, @elevenlabs/react@1.12.1, @elevenlabs/types@0.20.0, @elevenlabs/react-native@1.2.19, @elevenlabs/convai-widget-core@0.16.0 und @elevenlabs/convai-widget-embed@0.16.0 - Experimentelle selbstgehostete Orchestrator-Sessions und Rich-Content-Ereignisse hinzugefügt. Scribe-Audio-Worklets können jetzt für strikte Content-Security-Policies selbst gehostet werden. Die Verarbeitung von Verbindungsabbrüchen erreicht jetzt konsistent disconnected und verhindert, dass späte Callbacks eine neuere Session zurücksetzen. Das Widget rendert Schnellantworten und Links inline, stellt Markdown in Sprachtranskripten wieder her und korrigiert die Positionierung des Sprachmenüs in Layouts mit Container Queries.
  • @elevenlabs/client@1.19.0, @elevenlabs/react@1.12.2, @elevenlabs/types@0.21.0, @elevenlabs/react-native@1.2.20 und @elevenlabs/convai-widget-core@0.16.1 - Optionen für Echtzeit-Spracherkennung für sekundäre Sprachen, Entitätserkennung und Filterung von Hintergrundgeräuschen hinzugefügt. Ereignisse für finale Transkripte, erkannte Entitäten und ungültige Anfragen hinzugefügt; Zeitstempel-Worttypen an das Live-Schema angepasst; Fehler bei Mikrofonberechtigungen korrigiert, die eine erneute Verbindung von useScribe verhinderten.

API

API-Änderungen anzeigen

Neue Endpunkte

ElevenCreative

  • Videogenerierung erstellen - POST /v1/flows/video
  • Videogenerierungen auflisten - GET /v1/flows/video
  • Videogenerierung abrufen - GET /v1/flows/video/{generation_id}
  • Bildgenerierung erstellen - POST /v1/flows/image
  • Bildgenerierungen auflisten - GET /v1/flows/image
  • Bildgenerierung abrufen - GET /v1/flows/image/{generation_id}
  • Sprachgenerierung erstellen - POST /v1/flows/text-to-speech
  • Sprachgenerierungen auflisten - GET /v1/flows/text-to-speech
  • Sprachgenerierung abrufen - GET /v1/flows/text-to-speech/{generation_id}
  • Asset hochladen - POST /v1/assets
  • Assets auflisten - GET /v1/assets
  • Asset abrufen - GET /v1/assets/{asset_id}
  • Asset löschen - DELETE /v1/assets/{asset_id}

ElevenAgents

  • Konversationszusammenfassung abrufen - GET /v1/convai/conversations/{conversation_id}/summary
    • Akzeptiert optionales max_messages (Integer, 1–200, Standardwert 40)
    • Gibt GetConversationSummaryResponseModel mit erforderlichem conversation_id, agent_id, status, message_count und note zurück
    • Einfache messages enthalten nur role (user oder agent) und message; Konversationen über dem Limit geben messages_omitted: true zurück

Aktualisierte Endpunkte

ElevenAgents

  • Live-Anzahl abrufen - GET /v1/convai/analytics/live-count
    • Optionales agent_ids (String-Array, maximal 25) hinzugefügt, das Vorrang vor agent_id hat
  • Konversationsthemen eines Agents abrufen - GET /v1/convai/agents/{agent_id}/topics
    • Optionales page_size (Integer, 1–100), cursor (String), sort_by (conversations, sentiment oder success_rate) und sort_direction (asc oder desc) hinzugefügt
    • Antworten erhalten has_more (Boolean, Standardwert false) und nullable next_cursor (String)

Schema-Änderungen

ElevenAgents

  • Optionales queueing (AgentQueueingConfig) zu den Einstellungen der Agent-Plattform hinzugefügt. Es enthält enabled (Boolean, Standardwert false) und wait_timeout_seconds (Integer größer als 0 und höchstens 1.800, Standardwert 180)
  • Optionales schema_overrides zu WorkflowToolLocator hinzugefügt; konstante, dynamische Variablen-, LLM- oder Auslassungs-Overrides pro Knoten haben Vorrang vor Overrides auf Tool-Ebene
  • merge_with_default_ignore_terms (Boolean, Standardwert false) zur Turn-Konfiguration und zugehörigen Override-Schemas hinzugefügt
  • disable_until_first_user_message (Boolean, Standardwert false) zur Soft-Timeout-Konfiguration und zugehörigen Override-Schemas hinzugefügt
  • Erforderliches schreibgeschütztes status (success, error, blocked oder skipped) zu Tool-Antwortereignissen von Echtzeit-Agents hinzugefügt
  • avaya zu Quellen für die Konversationsinitiierung und avaya_api_key zu Autorisierungsmethoden hinzugefügt
  • gemini-3.6-flash und gemini-3.7-flash zu unterstützten Agent-LLM-Werten hinzugefügt
  • Standardwert von BackgroundSoundConfig.volume von 0.6 auf 0.15 und von crossfade_loop von false auf true geändert
  • CustomToolApiSchemaConfig entfernt; Nutzer generierter SDKs, die diesen Typ importieren, müssen den Import entfernen
  • scim_external_id aus WorkspaceGroupResponseModel entfernt

Dubbing v2 API

Dubbing v2 ist jetzt über die API verfügbar. Es übersetzt Audio und Video in mehr als 90 Sprachen und bewahrt dabei Stimme, Tonfall und Sprechtempo aller Sprecher.

Die neue projektbasierte API speichert Quelltranskripte und Übersetzungen als bearbeitbares JSON. Erstellen Sie ein Projekt aus einer Datei oder URL, fügen Sie eine oder mehrere Zielsprachen hinzu, bearbeiten Sie einzelne Transkriptsegmente oder Übersetzungen und generieren Sie dann nur die geänderten Bereiche neu. Folgen Sie der Dubbing-Schnellstartanleitung, um Ihre erste Synchronisation zu erstellen.

Schnellstart

Erstellen Sie Ihr erstes Dubbing-v2-Projekt und generieren Sie eine übersetzte Audiospur.

Verfeinern und neu generieren

Bearbeiten Sie Quelltranskripte und Übersetzungen und generieren Sie geänderte Bereiche neu.

API-Referenz

Entdecken Sie Endpunkte für Dubbing-Projekte, Sprachen und Transkripte.

ElevenAgents

  • Guardrail-Filter für Konversationen: Konversationen auflisten fügt die optionalen Abfrageparameter guardrail_types (GuardrailType[]) und custom_guardrail_names (String-Array) hinzu. Die bestehende Konversationshierarchie kann jetzt mit dem optionalen Parameter parent_conversation_id (String) gefiltert werden.
  • Status von Branch-Abweichungen: Agent-Branches auflisten fügt das optionale Flag include_commit_status (Boolean, Standardwert false) hinzu. Wenn es aktiviert ist, enthalten Branch-Zusammenfassungen die nullable Felder commits_ahead, commits_behind und merged_into_branch_id.
  • Steuerung von Konversationen und Tools: Client-Overrides unterstützen jetzt max_duration_seconds und pronunciation_dictionary_locators. Die MCP-Serverkonfiguration fügt request_meta hinzu, um MCP-_meta-Werte an Tool-Aufrufe zu übergeben. Timeouts für Webhook-Tools unterstützen jetzt bis zu 300 Sekunden.
  • Nutzung der Analyse nach Anrufen: Die Konversationsabrechnung fügt eine Aufschlüsselung nach analysis mit laufenden Summen pro Funktion und Ausführungs-Snapshots hinzu. Transkript-Nachrichten erhalten triggered_guardrails und Konversationswechsel das optionale Feld producing_llm.

Stimmen

  • Filter für die Stimmensuche: Alle Stimmen v2 abrufen fügt die optionalen Abfrageparameter gender, age, language, accent, use_cases, min_notice_period_days, include_custom_rates, include_live_moderated und high_quality hinzu.

SDK-Releases

JavaScript SDK

  • v2.63.0 - Optionen für Echtzeit-Spracherkennung für sekundäre Sprachen, Sprach- und Entitätserkennung, Filterung von Hintergrundgeräuschen, Logging und Single-Use-Token-Authentifizierung hinzugefügt. Ereignisse für finale Transkripte, Entitäten und ungültige Anfragen hinzugefügt; Versand nicht akzeptierter Bedingungen, doppelte audio_format-Parameter und inklusive VAD-Grenzen korrigiert.
  • v2.62.0 - Methoden für Massenaktualisierungen von Dubbing-Transkripten und DubbingRegenerateResponse hinzugefügt; Guardrail-Filter für Konversationen, Commit-Status für Agent-Branches, Agent-Benachrichtigungen und MCP-requestMeta-Unterstützung hinzugefügt. Das Erstellen von Sprachzielen akzeptiert modelId nicht mehr.
  • v2.61.0 - Filterung der Konversationshierarchie, Abrechnung der Analyse nach Anrufen, Metadaten ausgelöster Guardrails, Details zu Branch-Merge-Konflikten, DTMF-Eingabeschwärzung und Dubbing-Transkript-Uploads hinzugefügt. Exportierte OpenAI-Realtime-Session-Typen und run_subagent_*-Tool-Ergebnisvarianten entfernt.

Python SDK

  • v2.63.0 - Optionen für Echtzeit-Spracherkennung für sekundäre Sprachen, Sprach- und Entitätserkennung, Filterung von Hintergrundgeräuschen, Logging und Single-Use-Token-Authentifizierung hinzugefügt. Ereignisse für finale Transkripte, Entitäten und ungültige Anfragen hinzugefügt; Versand nicht akzeptierter Bedingungen korrigiert. Verbindungen ohne API-Schlüssel oder Token werden jetzt abgelehnt.
  • v2.62.0 - Dubbing-Methoden update_segments und DubbingRegenerateResponse hinzugefügt; Unterstützung für guardrail_types, custom_guardrail_names, include_commit_status und MCP-request_meta hinzugefügt. Dubbing-Segmentaktualisierungen verwenden jetzt Request-Body-Modelle, und das Erstellen von Sprachzielen akzeptiert model_id nicht mehr.
  • v2.61.0 - parent_conversation_id, Analyseabrechnung, Metadaten ausgelöster Guardrails, Branch-Merge-Konflikte, DTMF-Eingabeschwärzung und Dubbing-Transkript-Uploads hinzugefügt. OpenAI-Realtime-Session-Typen und run_subagent_*-Ergebnismodelle entfernt.

Android SDK

  • v0.12.1 - Korrigiert, dass beabsichtigte Verbindungsabbrüche bei reinen Text-Sessions als ConversationStatus.ERROR gemeldet wurden.
  • v0.12.0 - ConversationConfig.useMediaStream hinzugefügt, um Konversationsaudio über den Android-Medienstream zu leiten. Normale Remote-WebSocket-Schließungen melden jetzt DisconnectionDetails.Agent, während lokal initiierte Schließungen DisconnectionDetails.User melden.

MCP-Server

  • v0.12.2 - Ein Problem mit Path Traversal korrigiert.

API

API-Änderungen anzeigen

Neue Endpunkte

Dubbing

  • Quellsegmente gesammelt aktualisieren - PATCH /v1/dubbing/project/{project_id}/transcript/segments
    • Erfordert DubbingBulkSegmentUpdateRequest
    • Aktualisiert Quellsegmenttext, Sprecher oder Timing atomar
    • Gibt DubbingBulkSourceSegmentUpdateResponse mit den aktualisierten segments und revision zurück
  • Zielsegmente gesammelt aktualisieren - PATCH /v1/dubbing/project/{project_id}/language/{language_id}/transcript/segments
    • Erfordert DubbingBulkTargetSegmentUpdateRequest
    • Aktualisiert Übersetzungen für mehrere Zielsegmente atomar
    • Gibt DubbingBulkTargetSegmentUpdateResponse mit den aktualisierten segments und revision zurück

Aktualisierte Endpunkte

ElevenAgents

  • Konversationen auflisten - GET /v1/convai/conversations
    • Optionales parent_conversation_id (String) hinzugefügt
    • Optionale wiederholbare Parameter guardrail_types (GuardrailType[]) und custom_guardrail_names (String-Array) hinzugefügt
  • Agent-Branches auflisten - GET /v1/convai/agents/{agent_id}/branches
    • Optionales include_commit_status (Boolean, Standardwert false) hinzugefügt
    • Branch-Zusammenfassungen erhalten die nullable Felder commits_ahead (Integer), commits_behind (Integer) und merged_into_branch_id (String)

Stimmen

  • Alle Stimmen v2 abrufen - GET /v2/voices
    • Optionale Filter gender, age und accent (String) hinzugefügt
    • Optionale Filter language und use_cases (String-Array) hinzugefügt
    • Optionale Filter min_notice_period_days (Integer), include_custom_rates, include_live_moderated und high_quality (Boolean) hinzugefügt

Schema-Änderungen

ElevenAgents

  • Client-Override-Schemas erhalten max_duration_seconds (Integer) und pronunciation_dictionary_locators (Array)
  • MCP-Server-Eingabe- und Ausgabeschemas erhalten request_meta-Maps
  • Einstellungen der Agent-Plattform erhalten alerting; die Spracherkennung erhält only_at_conversation_start (Boolean)
  • AnalysisCharging.last_run ist jetzt erforderlich und nicht nullable; laufende Summen erhalten das erforderliche Feld runs (Integer)
  • Antworten für RAG-Chunks erfordern jetzt content_format und document_type