Hoppa till navigering

ElevenAgents

  • MCP-verktygsavgränsning i agentarbetsflöden: Noder i agentarbetsflöden kan nu begränsa vilka MCP-verktyg en underagent får anropa. När verktygsarv är inaktiverat för en nod läses endast de uttryckligen valda MCP-verktygen in för den underagenten, vilket ger team exakt kontroll över verktygsåtkomst i varje arbetsflödessteg.

  • Filuppladdningar i konversationer: Slutpunkterna create agent och update agent stöder nu fältet file_input i ConversationConfig. När det är aktiverat kan slutanvändare bifoga bilder eller PDF-filer i chatten (kräver en LLM med stöd för multimodala indata). Kan konfigureras med enabled (boolean) och max_files_per_conversation (integer).

  • Kör om konversationsanalys: Den nya slutpunkten run conversation analysis (POST /v1/convai/conversations/{conversation_id}/analysis/run) utvärderar en avslutad konversation igen med agentens aktuella utvärderingskriterier och inställningar för datainsamling, utan att ett nytt samtal behövs.

  • Mockning av verktygssvar för tester: Agentsimuleringstester och anrop av testsviter stöder nu fältet tool_mock_config för att styra hur verktygsanrop hanteras under testning. Använd MockingStrategy (all, selected, none) för att välja vilka verktyg som mockas och MockNoMatchBehavior (call_real_tool, raise_error) för att ange reservalternativet när ingen mockning matchar.

  • Sorteringsordning för textsökning: Slutpunkten text search conversations accepterar nu frågeparametern sort_by med värdena search_score (standard) eller created_at, så att du kan styra om resultaten sorteras efter relevans eller aktualitet.

  • mTLS-autentiseringsanslutningar: Agenters autentiseringsanslutningar stöder nu ömsesidig TLS (mtls) som en auth_type, utöver de befintliga alternativen. De nya schemana CreateMTLSAuthRequest och MTLSAuthResponse är tillgängliga för att skapa och hämta mTLS-autentiserade anslutningar.

  • Meddelande om maximal längd: Lade till fältet max_conversation_duration_message i agentkonfigurationen. När det anges som en icke-tom sträng skickar agenten detta meddelande till användaren när den maximala konversationslängden har uppnåtts.

  • Gren och miljö vid konversationsstart: Lade till de valfria fälten branch_id och environment i klientdata för konversationsstart (ConversationInitiationClientDataRequest) och i förfrågningstexten för submit batch call, vilket möjliggör dirigering till specifika agentgrenar och miljöer.

Music

  • Video till musik: Den nya slutpunkten POST /v1/music/video-to-music genererar bakgrundsmusik från en eller flera videofiler. Videor kombineras i sekvens. Accepterar valfria description (upp till 1 000 tecken) och tags (upp till 10 stiltaggar som upbeat eller cinematic) för att påverka det genererade spåret.

Speech to Text

  • Transkribera från URL: Slutpunkten convert speech to text accepterar nu parametern source_url (string, valfri) för att transkribera ljud eller video från en hostad URL, inklusive YouTube-videor, TikTok-videor och andra videohostingtjänster. Detta kan användas som ett alternativ till att ladda upp en fil direkt.

Voices

  • Totalt antal i listan över delade röster: Svaret från list shared voices innehåller nu fältet total_count, vilket gör det enklare att implementera sidindelning och visa antal resultat.

SDK-versioner

JavaScript SDK

  • v2.41.0 - Lade till stöd för WebSocket-händelsetypen multimodal_message i ElevenAgents-konversationer i realtid. Inkluderar Fern-regenerering för de senaste API-schemauppdateringarna.
  • v2.41.1 - Fern-regenerering för att matcha API-schemat från 1 april 2026.

Python SDK

  • v2.41.0 - Gjorde audio_interface valfri i läget för textbaserade konversationer, vilket löser ett körtidsfel när en session startas utan ljud. Inkluderar Fern-regenerering för det senaste API-schemat.

Packages

Den här versionen innehåller den nya v1.0.0 av Agent SDK:erna på klientsidan. Den innehåller stora bakåtkompatibilitetsbrytande ändringar i @elevenlabs/client, @elevenlabs/react och @elevenlabs/react-native. Läs migreringsguiden nedan innan du uppgraderar.

För att underlätta uppgraderingen släppte vi en Skill som hjälper dina agenter att uppgradera åt dig. Installera den med

npx skills add elevenlabs/packages

Du kan läsa mer om v1-versionen och dess förbättringar på vår utvecklarblogg.

  • @elevenlabs/client@1.0.0 — Bakåtkompatibilitetsbrytande ändringar:

    • Klasserna Input och Output exporteras inte längre. Använd i stället gränssnitten InputController och OutputController från @elevenlabs/client.
    • Conversation är inte längre en klass — det är nu ett namnområdesobjekt och ett typalias för TextConversation | VoiceConversation. Ta bort alla instanceof Conversation-kontroller och underklasser.
    • Standardvärdet för connectionType härleds nu från konversationsläget: röstkonversationer använder "webrtc" som standard och konversationer med endast text använder "websocket". För att behålla det tidigare beteendet för röst anger du uttryckligen connectionType: "websocket".
    • VoiceConversation.wakeLock är nu privat. Skicka useWakeLock: false i sessionsalternativen för att inaktivera hantering av wakelock.
    • changeInputDevice() och changeOutputDevice() returnerar nu Promise<void> i stället för Promise<Input> eller Promise<Output>.
    • Ersätt conversation.input.analyser.getByteFrequencyData(data) med conversation.getInputByteFrequencyData().
    • Ersätt conversation.input.setMuted(v) med conversation.setMicMuted(v).
    • Ersätt conversation.output.gain.gain.value = v med conversation.setVolume({ volume: v }).
    • getInputVolume(), getOutputVolume(), getInputByteFrequencyData() och getOutputByteFrequencyData() returnerar nu 0 eller en tom Uint8Array i stället för att kasta ett fel när ingen konversation är aktiv.
  • @elevenlabs/react@1.0.0 — Bakåtkompatibilitetsbrytande ändringar:

    • useConversation kräver nu en överordnad ConversationProvider. Omslut ditt komponentträd med <ConversationProvider> och flytta alternativen till providern eller hooken.
    • Exporterna DeviceFormatConfig och DeviceInputConfig har tagits bort. Använd i stället FormatConfig och InputDeviceConfig från @elevenlabs/client.
    • Nya detaljerade hookar ersätter den monolitiska useConversation för bättre renderingsprestanda: useConversationControls(), useConversationStatus(), useConversationInput(), useConversationMode(), useConversationFeedback() och useRawConversation(). Varje hook prenumererar bara på det tillstånd den behöver, vilket förhindrar onödiga omrenderingar.
    • Ny hook useConversationClientTool(name, handler) för att registrera klientverktyg som agenter kan anropa, med automatisk rensning vid avmontering.
    • Lade till stöd för styrd avstängning av ljud via egenskaperna isMuted och onMutedChange på ConversationProvider.
  • @elevenlabs/react-native@1.0.0 — Bakåtkompatibilitetsbrytande ändringar:

    • Det tidigare API:et ElevenLabsProvider och useConversation har tagits bort och ersatts med återexporter från @elevenlabs/react. Ersätt ElevenLabsProvider med ConversationProvider och useConversation med de detaljerade hookarna (useConversationControls, useConversationStatus osv.).
    • I React Native fyller paketet nu i WebRTC-globals, konfigurerar den inbyggda AudioSession och registrerar en plattformsspecifik strategi för röstsessionshantering vid import.
  • @elevenlabs/types@0.8.0 - Exporterar runtime-arrayen CALLBACK_KEYS som innehåller alla nycklar från gränssnittet Callbacks och används internt av React SDK för callback-komposition.

  • @elevenlabs/client@0.16.0 - Lade till WebSocket-händelsen guardrail_triggered från server till klient och callbacken onGuardrailTriggered, som utlöses när servern upptäcker en skyddsräcksöverträdelse under en konversation. Lade även till typdiskriminanter för TextConversation och VoiceConversation för att möjliggöra avgränsning av diskriminerade unioner, samt överlagringar för startSession som avgränsar returtypen baserat på alternativet textOnly.

  • @elevenlabs/react-native@0.6.0 - Lade till WebSocket-händelsen guardrail_triggered och callbacken onGuardrailTriggered, i linje med @elevenlabs/client@0.16.0.

  • @elevenlabs/client@1.1.0 - Lade till stöd på klientsidan för att mocka verktygssvar i agentkonversationer, vilket möjliggör testscenarier som simulerar resultat av verktygsanrop utan att anropa riktiga verktyg.

  • @elevenlabs/types@0.9.0 - Lade till typdefinitioner för mockning av verktygssvar i agentkonversationer.

  • @elevenlabs/react@1.0.1 - Uppdaterades för att bero på @elevenlabs/client@1.1.0.

  • @elevenlabs/react-native@1.0.1 - Uppdaterades för att bero på @elevenlabs/client@1.1.0 och @elevenlabs/react@1.0.1.

API

Nya slutpunkter

  • Kör konversationsanalys - POST /v1/convai/conversations/{conversation_id}/analysis/run - Kör om analysen för en avslutad konversation med agentens aktuella utvärderingskriterier och inställningar för datainsamling.

  • POST /v1/music/video-to-music - Genererar bakgrundsmusik från en eller flera videofiler som skickas som multipart-formulärdata.

Uppdaterade slutpunkter

ElevenAgents

  • Skapa agent, Uppdatera agent

    • Lade till fältet file_input (FileInputConfig, valfritt) i ConversationConfig, vilket möjliggör filuppladdning (bilder, PDF-filer) i chattkonversationer när LLM:en stöder multimodala indata
    • Lade till fältet max_conversation_duration_message (string, valfritt) i agentkonfigurationen — agenten skickar detta meddelande när sessionens tidsgräns nås
  • Skapa test, Uppdatera test

    • Lade till fältet tool_mock_config (object, valfritt) — en mappning av verktygsnamn till ToolResponseMockConfig-poster för att styra mockningsbeteendet för verktyg under simulering
  • Textsök i konversationer

    • Lade till frågeparametern sort_by (string, valfri) — accepterar search_score (standard) eller created_at
  • Skicka batchsamtal

    • Lade till fältet branch_id (string, valfritt) för att rikta in sig på en specifik agentgren
    • Lade till fältet environment (string, valfritt) för att ange målmiljön
  • Utgående Twilio-samtal, Utgående SIP trunk-samtal

    • Klientdata för konversationsstart accepterar nu de valfria fälten branch_id och environment

Speech to Text

  • Konvertera tal till text

    • Lade till parametern source_url (string, valfri) — accepterar en URL till en ljud- eller videofil, YouTube-video, TikTok-video eller annat hostat medium som alternativ till filuppladdning

Voices

Forcerad justering

  • Skapa forcerad justering

    • Tog bort parametern enabled_spooled_file från förfrågningstexten för multipart-formulärdata