Guardrails 2.0 : Une couche de contrôle repensée dans ElevenAgents
- Publié
- Dernière mise à jour
ÉcouterÉcouter cet article
À mesure que les agents vocaux prennent en charge des missions à fort impact dans l’assistance, les ventes, le marketing, les processus internes et bien plus encore, les équipes doivent avoir l’assurance qu’ils restent sûrs, fidèles à leur marque et conformes à grande échelle.
Guardrails 2.0 dans ElevenAgents est une couche de contrôle repensée qui aide les agents à fournir les bonnes réponses et à bloquer les mauvaises avant qu’elles n’atteignent l’utilisateur final.

Des protections multicouches en temps réel
Un prompt système bien conçu garantit un comportement prévisible pour la majorité des interactions. Toutefois, les agents étant des systèmes non déterministes, ils peuvent dériver au fil de longues conversations, les utilisateurs peuvent trouver des moyens créatifs de repousser les limites, et même des politiques clairement définies ne tiennent pas toujours lorsque le modèle est sous pression.
C’est pourquoi les équipes qui déploient des agents en production ont besoin de défenses multicouches : un prompt système renforcé comme fondation, complété par des contrôles indépendants sur les propos des utilisateurs et les réponses des agents.
Guardrails 2.0 protège les conversations à trois niveaux, qui se renforcent mutuellement :
Protections prêtes à l’emploi
Les protections prêtes à l’emploi couvrent les domaines de risque les plus courants.
Le Focus Guardrail renforce le prompt système de votre agent afin que ses réponses restent ciblées, pertinentes et conformes aux objectifs et instructions que vous avez définis. Il est particulièrement utile lors de conversations longues ou complexes, où l’agent risque davantage de s’écarter de ses objectifs initiaux.
Les Manipulation Guardrails détectent et bloquent les tentatives des utilisateurs visant à contourner les instructions système. Lorsqu’ils sont activés, le système analyse les saisies utilisateur afin d’identifier les schémas indiquant une injection de prompt ou une tentative de remplacement des instructions, et peut mettre fin aux conversations présentant un risque pour la sécurité.
Les Content Guardrails contribuent à garantir des réponses appropriées de l’agent en détectant plusieurs catégories de contenu potentiellement sensible ou dangereux, chacune avec des seuils ajustables pour un contrôle précis.
Custom Guardrails : vos règles, appliquées automatiquement
Les Custom Guardrails vous permettent de définir des politiques propres à votre domaine en langage naturel et de les appliquer automatiquement à chaque appel. Vous réduisez ainsi les incidents, les escalades et les cycles de validation de conformité susceptibles de ralentir le déploiement.
.webp&w=3840&q=95)
Un modèle léger évalue chaque réponse de l’agent selon vos règles et décide de l’autoriser ou de la bloquer, indépendamment et en parallèle de la génération de la réponse.
Un contrôle total sur l’exécution des guardrails
Vous contrôlez la détection des violations de politiques et les actions qui suivent.
Modes d’exécution. Réglez le compromis entre rapidité et rigueur, essentiel pour la voix, où la latence est déterminante. Vous pouvez exécuter les guardrails en parallèle de la réponse pour un délai quasi nul, même si une fraction de seconde d’audio peut être diffusée avant l’interception. Vous pouvez aussi retenir les réponses jusqu’à leur validation complète : c’est légèrement plus lent, mais aucun contenu non vérifié n’atteint l’utilisateur.
Stratégies de sortie. Lorsqu’un guardrail est déclenché, vous définissez la suite : mettre fin à la conversation, la transférer à un autre agent, la transmettre à un humain ou réessayer la réponse avec des instructions correctives.
Niveaux de sensibilité du contenu. Ajustez la sensibilité pour chaque catégorie de contenu, en renforçant les contrôles pour les cas d’usage à risque élevé et en les assouplissant lorsque des blocages excessifs nuiraient à l’expérience utilisateur.
Configuration granulaire. Chaque guardrail peut être activé ou désactivé individuellement, et différents agents peuvent utiliser des configurations distinctes.
Visibilité complète. Chaque déclenchement est enregistré dans vos analyses de conversations, avec le guardrail activé et l’action effectuée. Les équipes disposent ainsi des données nécessaires pour affiner au fil du temps leurs prompts système et leurs guardrails.
Masquage de l’historique des conversations
Une fois l’appel terminé, vous pouvez automatiquement masquer les informations sensibles dans les transcriptions, les enregistrements et les charges utiles de webhook. Conservez tout ce dont vous avez besoin pour l’analyse, l’assurance qualité et l’entraînement, sans garder ce qui ne l’est pas.
Les entités détectées sont remplacées par des espaces réservés dans le texte et par des bips dans l’audio. Vous contrôlez le niveau de granularité jusqu’aux types d’entités individuels : masquez tous les noms ou uniquement les noms de famille, tous les identifiants financiers ou uniquement les numéros de cartes de paiement.
Cette fonctionnalité complète des contrôles de données plus étendus, tels que Zero Retention Mode, utilisable pour les déploiements soumis à des exigences de conformité plus strictes.
.webp&w=3840&q=95)
Le masquage de l’historique des conversations et le Zero Retention Mode sont disponibles pour les clients Enterprise. Contacter l’équipe commerciale pour y accéder.
Une base de confiance et de sécurité plus large
Guardrails 2.0 et les fonctionnalités de confidentialité des données accompagnent les déploiements Enterprise d’ElevenAgents, avec des outils de sécurité à chaque étape du cycle de vie de l’agent :
Développement des agents
- Conception du prompt système, configuration des guardrails, red teaming et simulations pour mettre les comportements à l’épreuve avant la mise en service des agents
Chaque conversation
- Pendant : Guardrails 2.0 (Focus, Manipulation, Content et Custom Guardrails), journalisation, Zero Retention Mode facultatif
- Après : Critères d’évaluation, suivi, masquage de l’historique des conversations facultatif
Ensemble, ces fonctionnalités offrent aux équipes les contrôles nécessaires pour passer du pilote à la production avec moins d’incidents, des cycles d’approbation plus rapides et un comportement des agents plus cohérent. Ces fondations de plateforme favorisent également l’éligibilité à la certification AIUC-1 et l’accès aux premières polices d’assurance pour agents du secteur.
Commencez à utiliser Guardrails dès aujourd’hui
Nous avons déployé ces fonctionnalités au cours des derniers mois, et la suite complète Guardrails 2.0 est désormais disponible en version alpha dans ElevenAgents.
Activez-les dans l’onglet Security des paramètres de votre agent, ou configurez-les via l’API. Pour en savoir plus sur les déploiements Enterprise, contactez notre équipe commerciale.
Pour des conseils de configuration et les bonnes pratiques, consultez :
.webp&w=3840&q=80)



