Guardrails 2.0: Un nuovo livello di controllo in ElevenAgents
- Pubblicato
- Ultimo aggiornamento
AscoltaAscolta questo articolo
Man mano che gli agenti vocali svolgono attività ad alto impatto nell'assistenza, nelle vendite, nel marketing, nei workflow interni e non solo, i team devono avere la certezza che rimangano sicuri, in linea con il brand e conformi su scala enterprise.
Guardrails 2.0 in ElevenAgents è un livello di controllo riprogettato che aiuta a indirizzare gli agenti verso le risposte corrette e a prevenire quelle sbagliate prima che raggiungano l'utente finale.

Protezioni a più livelli in tempo reale
Un system prompt ben progettato porta a comportamenti prevedibili nella maggior parte delle interazioni. Tuttavia, poiché gli agenti sono sistemi non deterministici, possono allontanarsi dal loro obiettivo nelle conversazioni lunghe, gli utenti possono trovare modi creativi per oltrepassare i limiti e persino policy ben definite non sempre reggono quando il modello è sotto pressione.
Per questo i team che distribuiscono agenti in produzione hanno bisogno di difese a più livelli: un system prompt robusto come base, insieme a controlli indipendenti su ciò che dicono gli utenti e su come rispondono gli agenti.
Guardrails 2.0 protegge le conversazioni su tre livelli, ciascuno dei quali rafforza gli altri:
Protezioni predefinite
Le protezioni predefinite coprono le aree di rischio più comuni.
Focus Guardrail rafforza il system prompt del tuo agente, contribuendo a mantenere le risposte mirate, pertinenti e coerenti con gli obiettivi e le istruzioni definiti. È particolarmente utile nelle conversazioni lunghe o complesse, in cui è più probabile che l'agente si allontani dagli obiettivi previsti.
Manipulation Guardrails rilevano e bloccano i tentativi degli utenti di aggirare le istruzioni di sistema. Quando sono attivati, il sistema analizza gli input degli utenti alla ricerca di pattern che indicano tentativi di prompt injection o di sovrascrittura delle istruzioni e può terminare le conversazioni che rappresentano un rischio per la sicurezza.
Content Guardrails aiutano a garantire risposte appropriate dell'agente esaminando più categorie di contenuti potenzialmente sensibili o non sicuri, ciascuna con soglie regolabili per un controllo preciso.
Custom Guardrails: le tue regole, applicate automaticamente
Custom Guardrails ti consente di definire policy specifiche per il tuo ambito in linguaggio naturale e applicarle automaticamente a ogni chiamata. Così riduci incidenti, escalation e cicli di revisione della conformità normativa che possono rallentare la distribuzione.
.webp&w=3840&q=95)
Un modello leggero valuta ogni risposta dell'agente in base alle tue regole e restituisce una decisione di blocco o autorizzazione, operando in modo indipendente e parallelo alla generazione della risposta.
Controllo completo sull'esecuzione dei guardrail
Puoi controllare come vengono rilevate le violazioni delle policy e cosa succede dopo.
Modalità di esecuzione. Configura il compromesso tra velocità e rigore, fondamentale per la voce, dove la latenza conta più di tutto. Puoi eseguire i guardrail insieme alla risposta per un ritardo quasi nullo, anche se una frazione di secondo di audio potrebbe essere riprodotta prima dell'intercettazione. Oppure puoi trattenere le risposte finché non vengono completamente approvate: leggermente più lento, ma nulla raggiunge l'utente senza essere controllato.
Strategie di uscita. Quando viene attivato un guardrail, definisci cosa succede dopo: termina la conversazione, trasferiscila a un altro agente, inoltrala a un operatore umano oppure riprova la risposta con istruzioni correttive.
Livelli di sensibilità dei contenuti. Regola la sensibilità delle singole categorie di contenuti, rafforzando l'applicazione per i casi d'uso a rischio più elevato e riducendola dove un blocco eccessivo comprometterebbe l'esperienza utente.
Configurazione granulare. Ogni guardrail può essere attivato o disattivato singolarmente e diversi agenti possono usare configurazioni diverse.
Visibilità completa. Ogni attivazione viene registrata nelle analytics delle tue conversazioni, incluso quale guardrail è stato attivato e quale azione è stata eseguita. In questo modo i team dispongono dei dati necessari per perfezionare nel tempo system prompt e guardrail.
Redazione della cronologia delle conversazioni
Al termine di una chiamata, puoi rimuovere automaticamente le informazioni sensibili da trascrizioni, registrazioni e payload dei webhook. Conserva tutto ciò che ti serve per analytics, QA e formazione, eliminando ciò che non ti serve.
Le entità rilevate vengono sostituite da segnaposto nel testo e da segnali acustici nell'audio. Hai il controllo della granularità fino ai singoli tipi di entità: puoi rimuovere tutti i nomi o solo i cognomi, tutti gli identificativi finanziari o solo i numeri delle carte di pagamento.
Questa funzionalità si affianca a controlli più ampi sui dati, come Zero Retention Mode, che può essere usata per distribuzioni con requisiti di conformità normativa più rigorosi.
.webp&w=3840&q=95)
La redazione della cronologia delle conversazioni e Zero Retention Mode sono disponibili per i clienti enterprise. Contatta il team commerciale per ottenere l'accesso.
Parte di una più ampia base di fiducia e sicurezza
Guardrails 2.0 e le funzionalità per la privacy dei dati supportano le distribuzioni enterprise di ElevenAgents, insieme agli strumenti di sicurezza per ogni fase del ciclo di vita dell'agente:
Sviluppo dell'agente
- Progettazione del system prompt, configurazione dei guardrail, red teaming e simulazioni per mettere alla prova i comportamenti prima che gli agenti entrino in funzione
Ogni conversazione
- Durante: Guardrails 2.0 (Focus, Manipulation, Content e Custom Guardrails), logging, Zero Retention Mode facoltativa
- Dopo: Criteri di valutazione, monitoraggio, redazione della cronologia delle conversazioni facoltativa
Insieme, offrono ai team i controlli necessari per passare dal progetto pilota alla produzione con meno incidenti, cicli di approvazione più rapidi e comportamenti degli agenti più coerenti. Queste basi della piattaforma supportano anche l'idoneità alla certificazione AIUC-1 e l'accesso alle prime polizze assicurative per agenti del settore.
Inizia a usare Guardrails oggi
Negli ultimi mesi abbiamo rilasciato gradualmente nuove funzionalità e ora la suite completa Guardrails 2.0 è disponibile in alpha in ElevenAgents.
Attivale nella scheda Sicurezza delle impostazioni dell'agente, oppure configurale tramite API. Per maggiori informazioni sulle distribuzioni enterprise, contatta il nostro team commerciale.
Per indicazioni sulla configurazione e best practice, consulta:
.webp&w=3840&q=80)



