Einführung von Speech Engine
ElevenLabs Speech Engine fügt Ihrem eigenen Chat-Agenten oder LLM Echtzeit-Voice hinzu. ElevenLabs übernimmt Speech to Text, Sprecherwechsel, Text to Speech und die Browserwiedergabe, während Ihr Server die Agentenlogik verwaltet und Antworttext über einen Speech-Engine-WebSocket streamt. Nutzen Sie sie, wenn Sie Voice für eine benutzerdefinierte Runtime statt einer vollständig gehosteten ElevenAgents-Konfiguration benötigen.
ElevenAgents
- Überschreibungen des Textverhaltens:
text_behavior_overrideshinzugefügt, eine nachConversationInitiationSourcegegliederte Map ausBehaviorOverride-Objekten mit optionalen Feldernverbosity,output_formatundinteraction_budgetfür kanalspezifisches Agentenverhalten. - Integrationsquellen: Intercom, Telegram und Freshdesk hinzugefügt.
- OTLP-Konversations-Traces: Konversationsdetails abrufen akzeptiert jetzt den optionalen Abfrageparameter
format. Setzen Sieformat=otlp_traces, um OTLP-kompatible Trace-Daten neben der Standard-Konversations-Payload zurückzugeben. - ASR-Schlüsselwortüberschreibungen: Die Schemas
ASRConversationalConfigOverrideundASRConversationalConfigOverrideConfigmit optionalenkeywords-Arrays wurden hinzugefügt und in Client-Override-Modelle für die Konfigurationskonversation eingebunden. - Webhook-Authentifizierungsmetadaten: Webhook-Tool-Konfigurationsschemas enthalten jetzt optional
auth_resolved_params(String-Array), das URL-Platzhalter dokumentiert, die aus der Authentifizierungsverbindung aufgelöst werden.
Musik
- Generierungsmodus:
MusicGenerationMode(track,loop,ambience) und ein optionales Feldgeneration_modein Request-Bodys für Musik-Prompts hinzugefügt. - Video-zu-Musik-Modell: Video zu Musik (
POST /v1/music/video-to-music) akzeptiert jetzt optionalmodel_id(String, Standardwertmusic_v1).
ElevenCreative Studio
- Konvertierungs-Credits: Antwortmodelle für Kapitel- und Stimmenkonvertierungsstatistiken enthalten jetzt optional
credits_needed_to_convert(Integer), das die vor der Konvertierung benötigten Credits angibt.
Workspaces
- Ressourcentypen:
studio_projectszuWorkspaceResourceTypehinzugefügt.
SDK-Releases
Python SDK
- v2.50.0 - SDK für das API-Schema vom 25. Mai 2026 neu generiert.
- v2.49.1 - Speech-Engine-API-Aufrufe aktualisiert, damit sie das vollständige Antwortobjekt zurückgeben.
- v2.49.0 - SDK für das API-Schema vom 18.–25. Mai 2026 neu generiert, einschließlich ElevenAgents-Überschreibungen des Textverhaltens, Musik-
generation_modeund Workspace-studio_projects.
JavaScript SDK
- v2.50.0 - Fehlende Music-API-Methoden und Tests hinzugefügt und das SDK für das API-Schema vom 25. Mai 2026 neu generiert.
- v2.49.1 - Speech-Engine-API-Aufrufe aktualisiert, damit sie das vollständige Antwortobjekt zurückgeben.
- v2.49.0 - SDK für das API-Schema vom 18.–25. Mai 2026 neu generiert, einschließlich ElevenAgents-Überschreibungen des Textverhaltens, Musik-
generation_modeund Workspace-studio_projects.
Pakete
- @elevenlabs/client@1.8.1 - Fehler behoben, durch den iOS Safari die erste Agentennachricht in WebSocket-Voice-Sitzungen verworfen hat. Dazu wird ein
AudioContextbei der ersten Nutzergeste entsperrt und der Wiedergabegraph nach dem Laden des Audio-Worklets vorbereitet. - @elevenlabs/convai-widget-core@0.12.8 und @elevenlabs/convai-widget-embed@0.12.8 - Emotions- und Audio-Tags in Voice-Transkripten stylen, wenn
strip_audio_tagsdeaktiviert ist, und null auf oberster Ebene fürterms_htmloderterms_textals Deaktivierung für das Modal zu Geschäftsbedingungen behandeln. - @elevenlabs/convai-widget-core@0.12.7 und @elevenlabs/convai-widget-embed@0.12.7 - Widget-Abhängigkeiten auf
@elevenlabs/client@1.8.1aktualisiert.
API
API-Änderungen anzeigen
Aktualisierte Endpunkte und Schemas
ElevenAgents
- Konversationsdetails abrufen -
GET /v1/convai/conversations/{conversation_id}- Optionalen Abfrageparameter
formathinzugefügt;otlp_tracesgibt OTLP-kompatible Trace-Daten zurück
- Optionalen Abfrageparameter
- Agentenkonfigurationsschemas
text_behavior_overrides-Map mitConversationInitiationSourceals Schlüssel undBehaviorOverride-Werten (verbosity,output_format,interaction_budget) hinzugefügt
ConversationInitiationSource-Enumintercom_integration,telegram_integrationundfreshdesk_integrationhinzugefügt
- ASR-Override-Schemas
ASRConversationalConfigOverrideundASRConversationalConfigOverrideConfigmit optionalemkeywords(String-Array) hinzugefügt
- Webhook-Tool-Schemas
- Optionales
auth_resolved_params(String-Array) in Webhook-Konfigurationsmodellen hinzugefügt
- Optionales
Musik
- Video zu Musik -
POST /v1/music/video-to-music- Optionales
model_id(String, Standardwertmusic_v1) hinzugefügt
- Optionales
- Request-Schemas für Musik-Prompts
- Optionales
generation_modehinzugefügt, das aufMusicGenerationMode(track,loop,ambience) verweist
- Optionales
ElevenCreative Studio
- Statistikschema für Kapitel- und Stimmenkonvertierung
- Optionales
credits_needed_to_convert(Integer) hinzugefügt
- Optionales
Workspaces
WorkspaceResourceType-Enumstudio_projectshinzugefügt