Vi presenterar Eleven v4Vi presenterar Eleven v4, vår snabbaste och mest uttrycksfulla röstmodell

Hoppa till innehållet

Guardrails 2.0: Ett omarbetat kontrollager i ElevenAgents

Publicerad
Senast uppdaterad

LyssnaLyssna på den här artikeln

När röstassistenter tar sig an viktiga uppgifter inom support, försäljning, marknadsföring, interna arbetsflöden och annat behöver team känna sig trygga med att de förblir säkra, följer varumärket och uppfyller efterlevnadskrav i företagsskala.

Guardrails 2.0 i ElevenAgents är ett omarbetat kontrollager som hjälper till att styra agenter mot rätt svar och förhindra felaktiga svar innan de når slutanvändaren.

Guardrails Cover

Skydd i flera lager i realtid

En välformulerad systemprompt ger förutsägbart beteende i de flesta interaktioner. Men eftersom agenter är icke-deterministiska system kan de börja avvika i långa samtal, användare kan hitta kreativa sätt att tänja på gränserna och även väldefinierade policyer håller inte alltid när modellen är under press.

Därför behöver team som driftsätter agenter i produktion skydd i flera lager: en robust systemprompt som grund, plus oberoende kontroller av vad användare säger och hur agenter svarar.

Guardrails 2.0 skyddar samtal på tre nivåer, där varje nivå förstärker de andra:

Vad det gör
Förstärkt systemprompt
Definiera tillåtet och otillåtet beteende i systemprompten. Focus Guardrail förstärker dessa instruktioner genom hela samtalet.
Validering av användarindata
Ett skyddsnät som upptäcker försök till promptinjektion och manipulation och avslutar samtal som utgör en säkerhetsrisk.
Validering av agentsvar
Utvärderar varje svar mot dina policyer i realtid. Om ett svar bryter mot dina regler kan det blockeras innan det levereras.
Guardrails
Förstärkt systemprompt
Focus
Validering av användarindata
Manipulation
Validering av agentsvar
Content, Custom Guardrails

Färdiga skydd

Färdiga skyddsåtgärder täcker de vanligaste riskområdena.

Focus Guardrail förstärker din agents systemprompt och hjälper till att hålla svaren fokuserade, relevanta och i linje med dina mål och instruktioner. Det är särskilt användbart i långa eller komplexa samtal, där agenten löper större risk att avvika från sina avsedda mål.

Manipulation Guardrails upptäcker och blockerar användares försök att kringgå systeminstruktioner. När de är aktiverade analyserar systemet användarindata efter mönster som tyder på försök till promptinjektion eller åsidosättande av instruktioner, och kan avsluta samtal som utgör en säkerhetsrisk.

Content Guardrails hjälper till att säkerställa lämpliga agentsvar genom att granska flera kategorier av potentiellt känsligt eller osäkert innehåll, var och en med justerbara tröskelvärden för exakt kontroll.

Custom Guardrails: Dina regler, tillämpade automatiskt

Med Custom Guardrails kan du definiera områdesspecifika policyer på naturligt språk och tillämpa dem automatiskt i varje samtal. Det bidrar till färre incidenter och eskaleringar samt kortare granskningscykler för efterlevnad som annars kan bromsa driftsättningen.

Custom Guardrail Configuration Example

En lättviktig modell utvärderar varje agentsvar mot dina regler och beslutar om det ska blockeras eller tillåtas. Den körs oberoende och parallellt med svarsgenereringen.

Full kontroll över hur guardrails körs

Du kan styra hur policyöverträdelser upptäcks och vad som händer sedan.

Körlägen. Anpassa avvägningen mellan hastighet och strikthet – avgörande för röst, där låg latens är viktigast. Du kan köra guardrails parallellt med svaret för nästintill ingen fördröjning, även om en bråkdel av en sekunds ljud kan spelas upp innan det stoppas. Eller vänta med svar tills de har godkänts helt – något långsammare, men inget når användaren utan kontroll.

Avslutsstrategier. När en guardrail utlöses definierar du vad som händer sedan: avsluta samtalet, överför till en annan agent, eskalera till en människa eller försök igen med korrigerande instruktioner.

Känslighetsnivåer för innehåll. Anpassa känsligheten för enskilda innehållskategorier, med striktare tillämpning för användningsfall med högre risk och mindre strikt där överblockering skulle försämra användarupplevelsen.

Detaljerad konfiguration. Varje guardrail kan aktiveras eller inaktiveras individuellt, och olika agenter kan använda olika konfigurationer.

Full insyn. Varje utlösning loggas i din samtalsanalys, inklusive vilken guardrail som utlöstes och vilken åtgärd som vidtogs. Det ger team den data de behöver för att förbättra sina systemprompter och guardrails över tid.

Maskning av samtalshistorik

När ett samtal avslutas kan du automatiskt maskera känslig information i transkriptioner, inspelningar och webhook-payloads. Behåll allt du behöver för analys, QA och träning, samtidigt som du tar bort resten.

Identifierade entiteter ersätts med platshållare i text och pip i ljud. Du styr detaljnivån ned till enskilda entitetstyper: maskera alla namn eller bara efternamn, alla finansiella identifierare eller bara betalkortsnummer.

Detta fungerar tillsammans med bredare datakontroller som Zero Retention Mode, som kan användas för driftsättningar med strängare efterlevnadskrav.

Conversation History Redaction Example

Maskning av samtalshistorik och Zero Retention Mode är tillgängliga för företagskunder. Kontakta försäljning för åtkomst.

En del av en bredare grund för förtroende och säkerhet

Guardrails 2.0 och funktioner för dataskydd stöder driftsättning av ElevenAgents i företag, tillsammans med säkerhetsverktyg för varje steg i agentens livscykel:

Agentutveckling

  • Utformning av systemprompter, konfiguration av guardrails, red teaming och simuleringar för att stresstesta beteendet innan agenter tas i drift

Varje samtal

  • Under: Guardrails 2.0 (Focus, Manipulation, Content och Custom Guardrails), loggning, valfritt Zero Retention Mode
  • Efter: Utvärderingskriterier, övervakning, valfri maskning av samtalshistorik

Tillsammans ger dessa team den kontroll de behöver för att gå från pilot till produktion med färre incidenter, snabbare godkännandecykler och mer konsekvent agentbeteende. Plattformens grundfunktioner gör det också möjligt att kvalificera sig för AIUC-1-certifiering och få tillgång till branschens första försäkringar för agenter.

Börja använda Guardrails i dag

Vi har lanserat funktioner under de senaste månaderna, och hela Guardrails 2.0-sviten finns nu tillgänglig i alfa i ElevenAgents.

Aktivera dem på fliken Säkerhet i din agents inställningar, eller konfigurera via API:et. Kontakta vårt säljteam om du vill veta mer om driftsättningar i företag.

Mer information om konfigurering och bästa praxis finns här:

Få tillgång till datakontroller för företag

Behöver du något annat? Besök vår kundtjänst

Liknande artiklar

Skapa med AI-ljud av högsta kvalitet