Guardrails 2.0: Una capa de control rediseñada en ElevenAgents
- Publicado
- Última actualización
EscucharEscucha este artículo
A medida que agentes de voz asumen tareas de gran impacto en atención al cliente, ventas, marketing, workflows internos y más, los equipos necesitan la tranquilidad de que seguirán siendo seguros, coherentes con la marca y conformes con la normativa a escala empresarial.
Guardrails 2.0 en ElevenAgents es una capa de control rediseñada que ayuda a orientar a los agentes hacia las respuestas adecuadas y a impedir las incorrectas antes de que lleguen al usuario final.

Protecciones por capas en tiempo real
Un buen prompt de sistema permite un comportamiento predecible en la mayoría de las interacciones. Sin embargo, como los agentes son sistemas no deterministas, pueden desviarse en conversaciones largas, usuarios pueden encontrar formas ingeniosas de sortear los límites e incluso las políticas bien definidas no siempre se mantienen cuando el modelo está bajo presión.
Por eso, los equipos que implementan agentes en producción necesitan defensas por capas: un prompt de sistema reforzado como base, además de comprobaciones independientes sobre lo que dicen usuarios y cómo responden los agentes.
Guardrails 2.0 protege las conversaciones en tres niveles que se refuerzan entre sí:
Protecciones predefinidas
Las medidas de seguridad predefinidas cubren las áreas de riesgo más habituales.
Focus Guardrail refuerza el prompt de sistema de tu agente para que las respuestas se mantengan enfocadas, sean relevantes y coherentes con tus objetivos e instrucciones definidos. Resulta especialmente útil en conversaciones largas o complejas, donde es más probable que el agente se desvíe de sus objetivos previstos.
Manipulation Guardrails detectan y bloquean intentos de usuarios de eludir las instrucciones del sistema. Al activarlas, el sistema analiza las entradas de usuarios en busca de patrones que indiquen intentos de inyección de prompts o de anulación de instrucciones, y puede finalizar conversaciones que supongan un riesgo de seguridad.
Content Guardrails ayudan a garantizar respuestas adecuadas de los agentes al detectar varias categorías de contenido potencialmente sensible o inseguro, cada una con umbrales ajustables para un control preciso.
Custom Guardrails: tus reglas, aplicadas automáticamente
Custom Guardrails te permite definir políticas específicas de tu ámbito en lenguaje natural y aplicarlas automáticamente en cada llamada. Esto ayuda a reducir incidencias, escalados y ciclos de revisión de cumplimiento normativo que pueden ralentizar la implementación.
.webp&w=3840&q=95)
Un modelo ligero evalúa cada respuesta del agente según tus reglas y decide si la bloquea o permite, de forma independiente y en paralelo a la generación de respuestas.
Control total sobre cómo se ejecutan los guardrails
Puedes controlar cómo se detectan las infracciones de las políticas y qué ocurre después.
Modos de ejecución. Configura el equilibrio entre velocidad y rigor, algo esencial para la voz, donde la latencia es especialmente importante. Puedes ejecutar los guardrails junto con la respuesta para que el retraso sea casi nulo, aunque podría reproducirse una fracción de segundo de audio antes de la interceptación. También puedes retener las respuestas hasta que se hayan validado por completo: es algo más lento, pero nada llega al usuario sin comprobarse.
Estrategias de salida. Cuando se activa un guardrail, defines qué ocurre después: finalizar la conversación, transferirla a otro agente, escalarla a una persona o volver a intentar la respuesta con instrucciones correctivas.
Niveles de sensibilidad del contenido. Ajusta la sensibilidad de cada categoría de contenido, reforzando la aplicación en casos de uso de mayor riesgo y reduciéndola cuando un bloqueo excesivo perjudique la experiencia de usuario.
Configuración granular. Puedes activar o desactivar cada guardrail de forma individual, y distintos agentes pueden usar configuraciones diferentes.
Visibilidad completa. Cada activación se registra en tus análisis de conversaciones, incluido qué guardrail se activó y qué medida se tomó. Así, los equipos disponen de los datos que necesitan para perfeccionar sus prompts de sistema y guardrails con el tiempo.
Redacción del historial de conversaciones
Cuando termina una llamada, puedes redactar automáticamente información sensible de transcripciones, grabaciones y cargas útiles de webhooks. Conserva todo lo que necesitas para análisis, control de calidad y formación, y elimina lo que no necesitas.
Las entidades detectadas se sustituyen por marcadores de posición en el texto y pitidos en el audio. Tú controlas la granularidad hasta el nivel de cada tipo de entidad: puedes redactar todos los nombres o solo los apellidos, todos los identificadores financieros o solo los números de tarjetas de pago.
Esta función se suma a controles de datos más amplios como Zero Retention Mode, que puede utilizarse en implementaciones con requisitos de cumplimiento normativo más estrictos.
.webp&w=3840&q=95)
La redacción del historial de conversaciones y Zero Retention Mode están disponibles para clientes empresariales. Contacta con ventas para obtener acceso.
Parte de una base más amplia de confianza y seguridad
Guardrails 2.0 y las funciones de privacidad de datos respaldan implementaciones empresariales de ElevenAgents, junto con herramientas de seguridad para cada etapa del ciclo de vida del agente:
Desarrollo de agentes
- Diseño de prompts de sistema, configuración de guardrails, red teaming y simulaciones para poner a prueba el comportamiento antes de poner los agentes en marcha
Cada conversación
- Durante: Guardrails 2.0 (Focus, Manipulation, Content y Custom Guardrails), registro y Zero Retention Mode opcional
- Después: Criterios de evaluación, supervisión y redacción del historial de conversaciones opcional
En conjunto, proporcionan a los equipos los controles que necesitan para pasar del piloto a producción con menos incidencias, ciclos de aprobación más rápidos y un comportamiento más coherente de los agentes. Estas bases de la plataforma también permiten optar a la certificación AIUC-1 y acceder a las primeras pólizas de seguros para agentes del sector.
Empieza a usar Guardrails hoy
Hemos incorporado funciones durante los últimos meses y la suite completa de Guardrails 2.0 ya está disponible en versión alfa en ElevenAgents.
Actívalas en la pestaña Seguridad de la configuración de tu agente, o configúralas mediante la API. Para obtener más información sobre implementaciones empresariales, contacta con nuestro equipo de ventas.
Para consultar instrucciones de configuración y buenas prácticas, consulta:
.webp&w=3840&q=80)



