ElevenAgents
-
MCP-Tool-Scoping in Agent-Workflows: Agent-Workflow-Knoten können jetzt einschränken, welche MCP-Tools ein Sub-Agent aufrufen darf. Wenn die Tool-Vererbung für einen Knoten deaktiviert ist, werden für diesen Sub-Agenten nur die ausdrücklich ausgewählten MCP-Tools geladen. So erhalten Teams präzise Kontrolle über den Tool-Zugriff für jeden Workflow-Schritt.
-
Datei-Uploads in Gesprächen: Die Endpunkte Agent erstellen und Agent aktualisieren unterstützen jetzt ein
file_input-Feld inConversationConfig. Wenn es aktiviert ist, können Endnutzer Bilder oder PDFs im Chat anhängen (erfordert ein LLM mit Unterstützung für multimodale Eingaben). Konfigurierbar mitenabled(boolesch) undmax_files_per_conversation(Ganzzahl). -
Gesprächsanalyse erneut ausführen: Der neue Endpunkt Gesprächsanalyse ausführen (
POST /v1/convai/conversations/{conversation_id}/analysis/run) bewertet ein abgeschlossenes Gespräch anhand der aktuellen Bewertungskriterien und Einstellungen zur Datenerfassung des Agenten erneut, ohne dass ein neuer Anruf erforderlich ist. -
Mocking von Tool-Antworten für Tests: Agent-Simulationstests und Test-Suite-Aufrufe unterstützen jetzt ein
tool_mock_config-Feld, um zu steuern, wie Tool-Aufrufe während des Tests verarbeitet werden. Verwenden SieMockingStrategy(all,selected,none), um auszuwählen, welche Tools gemockt werden, undMockNoMatchBehavior(call_real_tool,raise_error), um das Fallback festzulegen, wenn kein Mock übereinstimmt. -
Sortierreihenfolge der Textsuche: Der Endpunkt Textsuche in Gesprächen akzeptiert jetzt den Abfrageparameter
sort_bymit den Wertensearch_score(Standard) odercreated_at. So können Sie festlegen, ob Ergebnisse nach Relevanz oder Aktualität sortiert werden. -
mTLS-Authentifizierungsverbindungen: Agent-Authentifizierungsverbindungen unterstützen jetzt zusätzlich zu den bestehenden Optionen Mutual TLS (
mtls) alsauth_type. Die neuen SchemasCreateMTLSAuthRequestundMTLSAuthResponsestehen zum Erstellen und Abrufen mTLS-authentifizierter Verbindungen zur Verfügung. -
Nachricht bei maximaler Dauer: Das Feld
max_conversation_duration_messagewurde zur Agent-Konfiguration hinzugefügt. Wenn es auf einen nicht leeren String gesetzt ist, sendet der Agent diese Nachricht an den Nutzer, sobald die maximale Gesprächsdauer erreicht ist. -
Branch und Umgebung bei der Gesprächsinitiierung: Die optionalen Felder
branch_idundenvironmentwurden zu den Clientdaten für die Gesprächsinitiierung (ConversationInitiationClientDataRequest) und zum Request-Body für Batch-Anruf übermitteln hinzugefügt. Damit ist Routing zu bestimmten Agent-Branches und Umgebungen möglich.
Musik
- Video zu Musik: Der neue Endpunkt
POST /v1/music/video-to-musicerzeugt Hintergrundmusik aus einer oder mehreren Videodateien. Videos werden nacheinander kombiniert. Akzeptiert optionaldescription(bis zu 1.000 Zeichen) undtags(bis zu 10 Stil-Tags wieupbeatodercinematic), um den erzeugten Track zu beeinflussen.
Speech to Text
- Transkribieren per URL: Der Endpunkt Sprache in Text umwandeln akzeptiert jetzt den optionalen String-Parameter
source_url, um Audio- oder Videodateien von einer gehosteten URL zu transkribieren, einschließlich YouTube-Videos, TikTok-Videos und anderer Video-Hosting-Dienste. Dies kann als Alternative zum direkten Hochladen einer Datei verwendet werden.
Stimmen
- Gesamtzahl in der Liste geteilter Stimmen: Die Antwort von Geteilte Stimmen auflisten enthält jetzt ein Feld
total_count. Das erleichtert die Implementierung der Paginierung und die Anzeige der Ergebnisanzahl.
SDK-Releases
JavaScript SDK
- v2.41.0 - Unterstützung für den WebSocket-Ereignistyp
multimodal_messagein Echtzeit-Gesprächen mit ElevenAgents hinzugefügt. Enthält eine Fern-Regenerierung für die neuesten API-Schema-Updates. - v2.41.1 - Fern-Regenerierung zur Anpassung an das API-Schema vom 1. April 2026.
Python SDK
- v2.41.0 -
audio_interfaceim reinen Textgesprächsmodus als optional korrigiert. Dadurch wird ein Laufzeitfehler beim Starten einer Sitzung ohne Audio behoben. Enthält eine Fern-Regenerierung für das neueste API-Schema.
Pakete
Dieses Release enthält die neuen v1.0.0 der clientseitigen Agent-SDKs. Es umfasst umfangreiche Breaking Changes für @elevenlabs/client, @elevenlabs/react und @elevenlabs/react-native. Lesen Sie vor dem Upgrade die folgenden Migrationshinweise.
Um das Upgrade zu erleichtern, haben wir einen Skill veröffentlicht, mit dem Ihre Agenten das Upgrade für Sie durchführen können. Installieren Sie ihn mit
Weitere Informationen zum v1-Release und seinen Verbesserungen finden Sie in unserem Developer-Blog.
-
@elevenlabs/client@1.0.0 — Breaking Changes:
- Die Klassen
InputundOutputwerden nicht mehr exportiert. Verwenden Sie stattdessen die InterfacesInputControllerundOutputControlleraus@elevenlabs/client. Conversationist keine Klasse mehr — es ist jetzt ein Namespace-Objekt und ein Typalias fürTextConversation | VoiceConversation. Entfernen Sie alleinstanceof Conversation-Prüfungen und Unterklassen.- Der Standardwert für
connectionTypewird jetzt aus dem Gesprächsmodus abgeleitet: Sprachgespräche verwenden standardmäßig"webrtc", reine Textgespräche"websocket". Um das bisherige Verhalten für Sprache beizubehalten, übergeben Sie explizitconnectionType: "websocket". VoiceConversation.wakeLockist jetzt privat. Übergeben Sie in den SitzungsoptionenuseWakeLock: false, um die Wake-Lock-Verwaltung zu unterdrücken.changeInputDevice()undchangeOutputDevice()geben jetztPromise<void>stattPromise<Input>oderPromise<Output>zurück.- Ersetzen Sie
conversation.input.analyser.getByteFrequencyData(data)durchconversation.getInputByteFrequencyData(). - Ersetzen Sie
conversation.input.setMuted(v)durchconversation.setMicMuted(v). - Ersetzen Sie
conversation.output.gain.gain.value = vdurchconversation.setVolume({ volume: v }). getInputVolume(),getOutputVolume(),getInputByteFrequencyData()undgetOutputByteFrequencyData()geben jetzt0oder ein leeresUint8Arrayzurück, statt einen Fehler auszulösen, wenn kein Gespräch aktiv ist.
- Die Klassen
-
@elevenlabs/react@1.0.0 — Breaking Changes:
useConversationerfordert jetzt einen übergeordnetenConversationProvider. Umschließen Sie Ihren Komponentenbaum mit<ConversationProvider>und verschieben Sie Optionen zum Provider oder zum Hook.- Die Exporte
DeviceFormatConfigundDeviceInputConfigwurden entfernt. Verwenden Sie stattdessenFormatConfigundInputDeviceConfigaus@elevenlabs/client. - Neue granulare Hooks ersetzen das monolithische
useConversationfür bessere Render-Performance:useConversationControls(),useConversationStatus(),useConversationInput(),useConversationMode(),useConversationFeedback()unduseRawConversation(). Jeder Hook abonniert nur den benötigten Status und verhindert so unnötige Re-Renders. - Neuer Hook
useConversationClientTool(name, handler)zum Registrieren von Client-Tools, die Agenten aufrufen können, mit automatischer Bereinigung beim Unmount. - Unterstützung für gesteuertes Stummschalten über die Props
isMutedundonMutedChangevonConversationProviderhinzugefügt.
-
@elevenlabs/react-native@1.0.0 — Breaking Changes:
- Die bisherige API
ElevenLabsProviderunduseConversationwurde entfernt und durch Re-Exports aus@elevenlabs/reactersetzt. Ersetzen SieElevenLabsProviderdurchConversationProviderunduseConversationdurch die granularen Hooks (useConversationControls,useConversationStatususw.). - Unter React Native ergänzt das Paket jetzt WebRTC-Globals per Polyfill, konfiguriert die native
AudioSessionund registriert beim Import eine plattformspezifische Sprachsitzungsstrategie.
- Die bisherige API
-
@elevenlabs/types@0.8.0 - Exportiert das Laufzeit-Array
CALLBACK_KEYS, das alle Schlüssel des InterfacesCallbacksenthält und vom React SDK intern für die Callback-Komposition verwendet wird. -
@elevenlabs/client@0.16.0 - Das Server-zu-Client-WebSocket-Ereignis
guardrail_triggeredund der CallbackonGuardrailTriggeredwurden hinzugefügt. Dieser wird ausgelöst, wenn der Server während eines Gesprächs eine Guardrail-Verletzung erkennt. Außerdem wurden Typdiskriminatoren zuTextConversationundVoiceConversationhinzugefügt, um die Einschränkung diskriminierter Unions zu ermöglichen, sowiestartSession-Overloads, die den Rückgabetyp basierend auf der OptiontextOnlyeinschränken. -
@elevenlabs/react-native@0.6.0 - Das WebSocket-Ereignis
guardrail_triggeredund der CallbackonGuardrailTriggeredwurden hinzugefügt, konsistent mit@elevenlabs/client@0.16.0. -
@elevenlabs/client@1.1.0 - Clientseitige Unterstützung für das Mocking von Tool-Antworten in Agent-Gesprächen hinzugefügt. Dadurch sind Testszenarien möglich, die Ergebnisse von Tool-Aufrufen simulieren, ohne echte Tools aufzurufen.
-
@elevenlabs/types@0.9.0 - Typdefinitionen für das Mocking von Tool-Antworten in Agent-Gesprächen hinzugefügt.
-
@elevenlabs/react@1.0.1 - Abhängigkeit von
@elevenlabs/client@1.1.0aktualisiert. -
@elevenlabs/react-native@1.0.1 - Abhängigkeiten von
@elevenlabs/client@1.1.0und@elevenlabs/react@1.0.1aktualisiert.
API
API-Änderungen anzeigen
Neue Endpunkte
-
Gesprächsanalyse ausführen -
POST /v1/convai/conversations/{conversation_id}/analysis/run- Führt die Analyse eines abgeschlossenen Gesprächs anhand der aktuellen Bewertungskriterien und Einstellungen zur Datenerfassung des Agenten erneut aus. -
POST /v1/music/video-to-music- Erzeugt Hintergrundmusik aus einer oder mehreren Videodateien, die als Multipart-Formulardaten bereitgestellt werden.
Aktualisierte Endpunkte
ElevenAgents
-
Agent erstellen, Agent abrufen
- Feld
file_input(FileInputConfig, optional) zuConversationConfighinzugefügt. Es ermöglicht Datei-Uploads (Bilder, PDFs) in Chat-Gesprächen, wenn das LLM multimodale Eingaben unterstützt. - Feld
max_conversation_duration_message(String, optional) zur Agent-Konfiguration hinzugefügt — der Agent sendet diese Nachricht, wenn das Zeitlimit der Sitzung erreicht ist.
- Feld
-
Test erstellen, Test aktualisieren
- Feld
tool_mock_config(Objekt, optional) hinzugefügt — eine Zuordnung von Tool-Namen zuToolResponseMockConfig-Einträgen zur Steuerung des Tool-Mocking-Verhaltens während der Simulation.
- Feld
-
- Abfrageparameter
sort_by(String, optional) hinzugefügt — akzeptiertsearch_score(Standard) odercreated_at.
- Abfrageparameter
-
- Feld
branch_id(String, optional) hinzugefügt, um einen bestimmten Agent-Branch anzusprechen. - Feld
environment(String, optional) hinzugefügt, um die Zielumgebung anzugeben.
- Feld
-
Ausgehender Twilio-Anruf, Ausgehender SIP-Trunk-Anruf
- Clientdaten für die Gesprächsinitiierung akzeptieren jetzt die optionalen Felder
branch_idundenvironment.
- Clientdaten für die Gesprächsinitiierung akzeptieren jetzt die optionalen Felder
Speech to Text
-
- Parameter
source_url(String, optional) hinzugefügt — akzeptiert eine URL zu einer Audio- oder Videodatei, einem YouTube-Video, TikTok-Video oder anderen gehosteten Medien als Alternative zum Datei-Upload.
- Parameter
Stimmen
-
- Feld
total_count(Ganzzahl) zum Antwortmodell hinzugefügt.
- Feld
Forced Alignment
-
- Parameter
enabled_spooled_fileaus dem Request-Body der Multipart-Formulardaten entfernt.
- Parameter