Guardrails 2.0 : Une couche de contrôle repensée dans ElevenAgents
- Publié
- Dernière mise à jour
ÉcouterÉcouter cet article
Alors que les agents vocaux prennent en charge des missions à fort impact dans le support, les ventes, le marketing, les processus internes et bien plus encore, les équipes doivent avoir la certitude qu'ils resteront sûrs, conformes à leur marque et conformes aux exigences réglementaires à l'échelle de l'entreprise.
Guardrails 2.0 dans ElevenAgents est une couche de contrôle repensée qui aide les agents à fournir les bonnes réponses et à empêcher les mauvaises avant qu'elles n'atteignent l'utilisateur final.

Protections multicouches en temps réel
Un prompt système bien conçu favorise un comportement prévisible dans la plupart des interactions. Toutefois, les agents étant des systèmes non déterministes, ils peuvent s'écarter de leurs objectifs lors de longues conversations, les utilisateurs peuvent trouver des moyens créatifs de repousser les limites, et même des politiques bien définies ne résistent pas toujours lorsque le modèle est sous pression.
C'est pourquoi les équipes qui déploient des agents en production ont besoin de défenses multicouches : un prompt système renforcé comme base, complété par des vérifications indépendantes de ce que disent les utilisateurs et de la manière dont les agents répondent.
Guardrails 2.0 protège les conversations à trois niveaux, qui se renforcent mutuellement :
Protections prêtes à l'emploi
Des garde-fous prêts à l'emploi couvrent les domaines de risque les plus courants.
Le Focus Guardrail renforce le prompt système de votre agent afin que ses réponses restent ciblées, pertinentes et cohérentes avec les objectifs et instructions que vous avez définis. Il est particulièrement utile dans les conversations longues ou complexes, où l'agent est davantage susceptible de s'écarter de ses objectifs prévus.
Les Manipulation Guardrails détectent et bloquent les tentatives des utilisateurs visant à contourner les instructions système. Lorsqu'ils sont activés, le système analyse les entrées utilisateur afin d'identifier les schémas indiquant une injection de prompt ou une tentative de remplacer les instructions, et peut mettre fin aux conversations présentant un risque pour la sécurité.
Les Content Guardrails contribuent à garantir des réponses appropriées de l'agent en filtrant plusieurs catégories de contenus potentiellement sensibles ou dangereux, chacune avec des seuils ajustables pour un contrôle précis.
Custom Guardrails : vos règles, appliquées automatiquement
Les Custom Guardrails vous permettent de définir des politiques propres à votre domaine en langage naturel et de les appliquer automatiquement à chaque appel. Vous réduisez ainsi les incidents, les escalades et les cycles de revue de conformité susceptibles de ralentir le déploiement.
.webp&w=3840&q=80)
Un modèle léger évalue chaque réponse de l'agent au regard de vos règles et décide de l'autoriser ou de la bloquer. Il fonctionne de manière indépendante et en parallèle de la génération des réponses.
Contrôle total sur l'exécution des guardrails
Vous contrôlez la détection des violations de politiques et les actions qui suivent.
Modes d'exécution. Configurez le compromis entre vitesse et rigueur, essentiel pour la voix, où la latence compte avant tout. Vous pouvez exécuter les guardrails en parallèle de la réponse pour un délai quasi nul, même si une fraction de seconde d'audio peut être diffusée avant l'interception. Vous pouvez aussi retenir les réponses jusqu'à leur validation complète : c'est légèrement plus lent, mais rien n'atteint l'utilisateur sans vérification.
Stratégies de sortie. Lorsqu'un guardrail est déclenché, vous définissez la suite : mettre fin à la conversation, transférer vers un autre agent, escalader vers un humain ou réessayer la réponse avec des instructions correctives.
Niveaux de sensibilité du contenu. Ajustez la sensibilité pour chaque catégorie de contenu, en renforçant l'application des règles pour les cas d'usage à risque élevé et en l'assouplissant lorsque des blocages excessifs nuiraient à l'expérience utilisateur.
Configuration granulaire. Chaque guardrail peut être activé ou désactivé individuellement, et différents agents peuvent exécuter différentes configurations.
Visibilité complète. Chaque déclenchement est enregistré dans vos analyses de conversations, avec le guardrail concerné et l'action effectuée. Les équipes disposent ainsi des données nécessaires pour affiner leurs prompts système et leurs guardrails au fil du temps.
Masquage de l'historique des conversations
À la fin d'un appel, vous pouvez automatiquement masquer les informations sensibles dans les transcriptions, les enregistrements et les charges utiles de webhook. Conservez tout ce dont vous avez besoin pour les analyses, l'assurance qualité et la formation, tout en supprimant ce qui ne vous est pas utile.
Les entités détectées sont remplacées par des espaces réservés dans le texte et des bips dans l'audio. Vous contrôlez le niveau de granularité jusqu'aux types d'entités individuels : masquez tous les noms ou uniquement les noms de famille, tous les identifiants financiers ou uniquement les numéros de carte de paiement.
Cette fonctionnalité complète des contrôles des données plus étendus, tels que Mode zéro rétention, utilisable pour les déploiements soumis à des exigences de conformité plus strictes.
.webp&w=3840&q=80)
Le masquage de l'historique des conversations et le Mode zéro rétention sont disponibles pour les clients Enterprise. Réserver une démo pour y accéder.
Un socle élargi de confiance et de sécurité
Guardrails 2.0 et les fonctionnalités de confidentialité des données prennent en charge les déploiements Enterprise d'ElevenAgents, avec des outils de sécurité pour chaque étape du cycle de vie de l'agent :
Développement des agents
- Conception du prompt système, configuration des guardrails, tests d'intrusion et simulations pour mettre les comportements à l'épreuve avant la mise en production des agents
Chaque conversation
- Pendant : Guardrails 2.0 (Focus, Manipulation, Content et Custom Guardrails), journalisation, Mode zéro rétention facultatif
- Après : Critères d'évaluation, suivi, masquage de l'historique des conversations facultatif
Ensemble, ces outils donnent aux équipes les contrôles nécessaires pour passer du pilote à la production avec moins d'incidents, des cycles d'approbation plus rapides et un comportement plus cohérent des agents. Ces fondations de plateforme favorisent également l'éligibilité à la certification AIUC-1 et l'accès aux premières polices d'assurance pour agents du secteur.
Commencez à utiliser Guardrails dès aujourd'hui
Nous avons déployé ces fonctionnalités au cours des derniers mois, et la suite complète Guardrails 2.0 est désormais disponible en alpha dans ElevenAgents.
Activez-les dans l'onglet Sécurité des paramètres de votre agent, ou configurez-les via l'API. Pour en savoir plus sur les déploiements Enterprise, contactez notre équipe commerciale.
Pour obtenir des conseils de configuration et découvrir les bonnes pratiques, consultez :
.webp&w=3840&q=80)



