Implementación del conocimiento empresarial en agentes de voz
- Publicado
- Última actualización
EscucharEscucha este artículo
A medida que las organizaciones adoptan Agentes de Voz para ayudar a empleados y clientes, la calidad de la información en la que se basan estos Agentes se convierte en un factor crítico para su rendimiento. Los Agentes pueden razonar bien por sí mismos, pero cuando deben reflejar políticas específicas de la empresa, detalles de productos o procedimientos internos, necesitan acceso a conocimientos fiables y bien estructurados.
Las bases de conocimiento de los Agentes proporcionan esta base y especialización. Almacenan documentación, políticas, referencias técnicas, especificaciones de productos, materiales de soporte y otros recursos internos. Para utilizarlos de forma eficaz, el contenido debe estar seleccionado, organizado y estructurado para que los Agentes puedan generar respuestas precisas y fundamentadas, en lugar de depender del conocimiento general del modelo, que puede estar incompleto o desactualizado.
Esta guía presenta estrategias prácticas para gestionar bases de conocimiento empresariales en implementaciones de Agentes y permitir que los Agentes de Voz ofrezcan un rendimiento consistente incluso al trabajar con colecciones grandes y diversas de documentos.
Cómo acceden los Agentes de Voz a tu base de conocimiento
Puedes configurar una base de conocimiento directamente en la plataforma ElevenLabs Agents. Ese contenido estará disponible para tu Agente durante las conversaciones.
La plataforma ofrece dos modos de uso para este contenido:
- Inclusión directa en el contexto: Para bases de conocimiento más pequeñas, el contenido se introduce directamente en la ventana de contexto del modelo. Esto ofrece acceso inmediato con una latencia mínima y funciona mejor con bases de conocimiento pequeñas.
- Generación aumentada por recuperación (RAG): Cuando una base de conocimiento es demasiado grande para caber en el contexto, el sistema la busca y recupera únicamente las secciones más relevantes según la consulta del usuario.
Cuándo RAG es eficaz y cuándo no lo es
La decisión entre la inyección directa y RAG depende principalmente del tamaño de la base de conocimiento.
Imagina una «Biblioteca de manuales de producto» con 1000 documentos que suman aproximadamente 2 millones de palabras (~2,6 millones de tokens). En este caso, la inyección directa supera los límites de contexto de la mayoría de los LLM rápidos y se activa RAG. Por tanto, solo se recuperan fragmentos relevantes, lo que permite mantener un contexto manejable independientemente del tamaño total de la base de conocimiento.
En cambio, para un documento de políticas de 4 páginas (~3000 tokens), la inyección directa es más rápida y sencilla. RAG añadiría una latencia innecesaria.
La plataforma ElevenLabs gestiona esto automáticamente: la opción para activar RAG solo está disponible cuando tu base de conocimiento alcanza un tamaño en el que la recuperación sería más eficiente que la inclusión directa.
Las bases de conocimiento eficaces empiezan con la preparación de documentos
Si una empresa cuenta con una base amplia y variada de documentos internos, el primer paso no es la implementación, sino la selección del contenido. Las fuentes excelentes generan respuestas excelentes, mientras que las fuentes deficientes introducen errores y alucinaciones.
Selecciona el contenido antes de implementar. Archiva o elimina borradores obsoletos, versiones sustituidas y materiales irrelevantes. Si un documento no debería utilizarse para responder a preguntas de clientes, no debería estar en tu base de conocimiento. Esta selección garantiza que la fuente de información siga siendo fiable y reduce el ruido durante la recuperación.
Organiza por dominio. Estructura los documentos restantes en categorías diferenciadas y lógicas, como políticas de RR. HH., documentación de productos, acuerdos legales, manuales técnicos o procedimientos de atención al cliente. Esta organización por dominios se vuelve fundamental al implementar workflows multiagente en la plataforma ElevenLabs, donde Agentes especializados se encargan de áreas de conocimiento concretas.
Calidad antes que cantidad. Una colección bien seleccionada de unos pocos documentos de alta calidad superará a un gran número de archivos de calidad desigual. Céntrate en la integridad, precisión y relevancia dentro de cada dominio. Empezar con datos limpios y organizados no es solo una buena práctica: marca la diferencia entre un Agente que satisface a usuarios y otro que les frustra con respuestas irrelevantes o contradictorias.
Estrategias para implementar bases de conocimiento
Una vez que tienes los conocimientos y los patrones de acceso, la siguiente pregunta es cómo configurar la arquitectura de tu Agente para acceder eficazmente a la base de conocimiento. Las organizaciones pueden elegir entre cinco enfoques arquitectónicos que se implementan directamente en la plataforma ElevenLabs Agents, desde configuraciones sencillas hasta otras más complejas según la escala y los requisitos de conocimiento.
1. Base de conocimiento para un único Agente
La implementación más sencilla conecta una base de conocimiento directamente a un único Agente. Sube tus documentos seleccionados a la plataforma ElevenLabs Agents para crear una base de conocimiento y asígnala a tu Agente desde los ajustes de configuración. No necesitas workflows, enrutamiento ni herramientas externas. Este enfoque ofrece el menor tiempo hasta obtener valor: es ideal para casos de uso específicos, como políticas de RR. HH. únicamente, documentación de productos únicamente o atención al cliente para una sola línea de productos.
Las limitaciones surgen a gran escala. El rendimiento puede empeorar con bases de conocimiento muy grandes o muy diversas. Sin especialización, el Agente busca en todos los documentos y podría recuperar resultados menos relevantes cuando el conocimiento abarca temas muy distintos. Cuando detectes que la precisión disminuye debido a la diversidad de la base de conocimiento, es el momento de evolucionar a workflows multiagente.
2. Segregación del conocimiento entre varios Agentes
Para colecciones de documentos grandes y variadas, una arquitectura de workflow multiagente permite escalar de forma eficiente. Un Agente de orquestación analiza las preguntas entrantes y las dirige a Agentes especializados, cada uno con una base de conocimiento centrada en su dominio. Cuando un usuario pregunta «¿Cuál es la política de permiso parental en California?», el sistema identifica que se trata de RR. HH. y lo dirige a un Agente especializado en RR. HH. que solo tiene acceso a documentos de RR. HH.
La implementación implica crear bases de conocimiento separadas por dominio, construir un workflow con nodos especializados y configurar condiciones de enrutamiento. Los contextos más pequeños y específicos mejoran la precisión y reducen la latencia, mientras que la separación por dominios simplifica el mantenimiento porque cada área se actualiza de forma independiente. Este enfoque es adecuado para empresas que implementan Agentes en múltiples áreas temáticas.
3. Enfoque híbrido: base de conocimiento para descubrir, herramientas para datos
Este patrón separa la comprensión de la consulta. La base de conocimiento identifica la terminología y la relaciona con identificadores de sistema añadidos como documento a la base de conocimiento, mientras que las herramientas de webhook recuperan datos actualizados de fuentes autorizadas.
Por ejemplo, ante la pregunta «¿Cuáles son los detalles de mi plan Premium Plus?», el Agente usa su base de conocimiento para identificar el ID de plan PLAN_001 y, a continuación, llama a una herramienta que consulta tu base de datos en tiempo real para obtener los precios y las funcionalidades actuales.
Esto garantiza la precisión, ya que los datos proceden de bases de datos en lugar de generarse mediante un LLM; proporciona datos en tiempo real que reflejan el estado actual y crea registros de auditoría mediante llamadas a herramientas registradas. Es adecuado para casos que requieren tanto comprender la documentación como recuperar datos estructurados, habituales en atención al cliente, gestión de cuentas y e-commerce, donde los documentos explican conceptos pero las bases de datos contienen los datos actuales.
4. Base de datos vectorial externa
Las organizaciones pueden gestionar su propia base de datos vectorial (Pinecone, Weaviate, Qdrant) y exponerla mediante herramientas de webhook personalizadas. Esto ofrece control total sobre la segmentación, los embeddings y los algoritmos de recuperación, pero añade carga operativa por la gestión de la infraestructura y latencia adicional por las llamadas a API externas. Puede aportar flexibilidad, pero también incorpora carga operativa y latencia externa.
5. La arquitectura de doble cerebro
Algunas empresas ya mantienen sus propios LLM ajustados y la forma más eficaz de conectarlos es directamente con una plataforma ElevenLabs Agents (LLM personalizado) o mediante una arquitectura de doble cerebro.
La arquitectura de doble cerebro (dos LLM activos) se utiliza normalmente cuando el LLM personalizado es demasiado lento para mantener una conversación en tiempo real. En los casos en que se requiere un razonamiento más profundo o contexto adicional, el Agente funciona con un LLM más rápido que puede llamar al LLM personalizado del cliente para obtener información, que después se añade a la conversación mediante actualizaciones contextuales.
Como estas llamadas son asíncronas, la conversación sigue siendo fluida mientras el backend realiza cálculos más complejos. Este enfoque permite a las empresas aprovechar su infraestructura de IA existente.
Conclusión
Los Agentes de Voz eficaces se basan en conocimientos claros y bien organizados. Cuando la información empresarial está estructurada, es precisa y los Agentes pueden navegarla fácilmente, se convierte en una fuente fiable de la que pueden extraer información para ofrecer respuestas fundamentadas y consistentes.
La plataforma ElevenLabs ofrece gestión nativa de bases de conocimiento, workflows multiagente, integración de webhooks y API completas diseñadas para funcionar juntas sin complicaciones. Cuando se implementan cuidadosamente con datos limpios y una arquitectura adecuada, los conocimientos empresariales se vuelven accesibles mediante conversaciones naturales. Bien implementado, no es solo un detalle de implementación: es una ventaja operativa.
Guía práctica: escalar la subida de documentos
Consolida antes de subir. En lugar de subir 500 archivos individuales, reúne todos los documentos de un dominio en un único archivo. Esto reduce la complejidad de gestión, simplifica la configuración del Agente y mejora la recuperación al mantener juntos los contenidos relacionados.
Agrupa los documentos estratégicamente por línea de productos, región, departamento o función. Cada base de conocimiento consolidada se asigna a un Agente (un único Agente) o a un nodo de Agente especializado (workflows multiagente).
Aprovecha la API de ElevenLabs para subir contenido desde URL, texto o archivos. Integra las subidas en tu pipeline de CI/CD para que la consolidación y las actualizaciones se realicen automáticamente cada vez que cambie la documentación de origen.
Guía práctica: actualización automatizada del conocimiento
Supervisa tus repositorios de documentación (Git, SharePoint, CMS). Cuando se detecten cambios, activa un reprocesamiento automático para consolidar los documentos actualizados.
Usa la API para actualizar las bases de conocimiento mediante programación. Un workflow habitual: actualización de la documentación → se activa el pipeline de CI/CD → se consolidan los documentos → se llama a la API para sustituir la base de conocimiento → los Agentes acceden al instante a la información actualizada.
Trata la documentación como código. Aplica a las actualizaciones de la base de conocimiento el mismo rigor de DevOps que a los despliegues de código. La arquitectura de la plataforma centrada en la API facilita la integración con los pipelines existentes y mantiene la precisión y el cumplimiento normativo sin intervención manual.



