Habla con DeepSeek R1 usando ElevenLabs Conversational AI
- Escrito por
- Thor Schaeff
- Publicado
- Última actualización
EscucharEscucha este artículo
Últimamente todo el mundo habla de DeepSeek, pero nadie se ha parado a preguntarse: ¿cómo sonaría DeepSeek si pudiera hablar? Aquí es donde podemos usar IA Conversacional de ElevenLabs para hacer posible hablar con DeepSeek R1.
La IA Conversacional de ElevenLabs es una plataforma para desplegar agentes de voz conversacionales personalizados y en tiempo real. Una de las principales ventajas de la plataforma es su flexibilidad, que te permite conectar distintos LLM según tus necesidades.

La opción LLM personalizado funciona con cualquier proveedor de API compatible con OpenAI, siempre que el modelo admita el uso de herramientas o las llamadas a funciones. En nuestra documentación encontrarás guías para GroqCloud, Together AI y Cloudflare. Para la siguiente demo, usamos Cloudflare.
Usamos el modelo DeepSeek-R1-Distill-Qwen-32B, un modelo destilado de DeepSeek-R1 basado en Qwen2.5. Supera a OpenAI-o1-mini en varias pruebas comparativas y logra nuevos resultados punteros para modelos densos.
La razón principal por la que usamos la versión destilada es que las versiones puras todavía no funcionan de forma fiable con las llamadas a funciones. De hecho, el modelo de razonamiento R1 todavía no admite llamadas a funciones. Puedes seguir esta incidencia para mantenerte al día de sus avances.
Empieza con la IA Conversacional de ElevenLabs
El proceso para conectar un LLM personalizado es bastante sencillo y empieza creando un agente. Para este proyecto usaremos la plantilla de profesor de matemáticas. Si solo quieres descubrir cómo suena DeepSeek, tenemos una demo del agente que puedes probar tú mismo.
Para empezar, ve a la página de la app de IA Conversacional de ElevenLabs y crea un nuevo agente de IA llamado «DeepSeeker». Selecciona la plantilla de profesor de matemáticas, ya que es un caso de uso en el que el razonamiento de DeepSeek puede destacar, y selecciona «Crear agente».
La plantilla de matemáticas incluye un prompt de sistema que garantiza que lea los números y las ecuaciones en lenguaje natural, en lugar de hacerlo tal como los escribe el LLM. Por ejemplo, le indicamos que escriba «Alfa por x al cuadrado es igual a 4» si la respuesta del LLM es «ax^2=4».

Los modelos de razonamiento suelen explicar su «cadena de pensamiento», pero también podemos ampliar el prompt de sistema para asegurarnos aún más de obtener una buena explicación matemática, por ejemplo, especificando que debe desarrollar el razonamiento de la solución paso a paso. Puedes mantenerlo general o ampliar el prompt para incluir ejemplos concretos en los que pueda basarse.
Sin embargo, si de verdad quieres hacerte una idea de la personalidad de DeepSeek R1, puedes crear una plantilla en blanco, pedir al agente que se presente como DeepSeek AI y configurar el prompt de sistema para que responda a preguntas sobre distintos temas.
Configura DeepSeek R1 con Cloudflare Workers AI
Ahora necesitamos obtener una ruta de API de una versión de DeepSeek R1 para usarla con nuestro agente. En este ejemplo usaremos Cloudflare, que ofrece DeepSeek-R1-Distill-Qwen-32B en su plataforma Workers AI con fines de evaluación, aunque también puedes considerar otras opciones de alojamiento, como fireworks.ai, GroqCloud y together.ai
Primero, ve a dash.cloudflare.com y crea una cuenta o inicia sesión. En la navegación, selecciona IA > Workers AI y, a continuación, haz clic en el widget «Use REST API».

Para obtener una clave de API, haz clic en «Create a Workers AI API Token» y asegúrate de guardarla de forma segura.
Cuando tengas tu clave de API, puedes probarla de inmediato con una solicitud curl. Cloudflare ofrece una ruta de API compatible con OpenAI, lo que resulta muy práctico. En este punto, anota el modelo y la ruta completa, incluido el ID de la cuenta.
Por ejemplo: https://api.cloudflare.com/client/v4/accounts/{ACCOUNT_ID}c/ai/v1/
curl https://api.cloudflare.com/client/v4/accounts/{ACCOUNT_ID}/ai/v1/chat/completions \ -X POST \ -H "Authorization: Bearer {API_TOKEN}" \ -d '{ "model": "@cf/deepseek-ai/deepseek-r1-distill-qwen-32b", "messages": [ {"role": "system", "content": "You are a helpful assistant."}, {"role": "user", "content": "How many Rs in the word Strawberry?"} ], "stream": false }'
Configura tu LLM personalizado en ElevenLabs
El siguiente paso es añadir estos datos a tu agente en ElevenLabs. Primero, ve a tu agente de IA DeepSeeker en la app de ElevenLabs y, al final de la página, añade la clave de API que acabas de crear como secreto. Asígnale un nombre como CLOUDFLARE_AUTH_TOKEN y guarda los cambios.

A continuación, en LLM, selecciona la opción LLM personalizado e introduce la ruta de API compatible con OpenAI de Cloudflare Workers AI: API https://api.cloudflare.com/client/v4/accounts/{ACCOUNT_ID}/ai/v1
Asegúrate de sustituir «{ACCOUNT_ID}» en la URL por el ID de tu cuenta que aparece en Cloudflare.
Añade el ID del modelo: @cf/deepseek-ai/deepseek-r1-distill-qwen-32b
Por último, selecciona el secreto que acabas de crear.

Pruébalo
Genial, ahora que ya está todo configurado, haz clic en «Probar agente de IA» y pruébalo con el siguiente problema de matemáticas:
«Dos trenes se cruzan en dirección este/oeste a 65 mph y 85 mph, respectivamente. ¿Cuánto tardarán en estar separados por 330 millas?»
Nota: si no tienes configurado un método de pago, la API de Cloudflare Workers AI tendrá limitaciones de velocidad y es posible que los tiempos de respuesta sean mayores. Asegúrate de configurar tu cuenta de facturación antes de pasar a producción. Puede que esto no ocurra en otras plataformas de alojamiento.
Conclusión
Crear agentes de IA conversacionales en tiempo real con la plataforma de IA Conversacional de ElevenLabs te permite reaccionar rápidamente a los nuevos modelos que se lancen, ya que puedes conectar LLM personalizados mediante cualquier proveedor de API compatible con OpenAI.
Siempre que el modelo que quieras usar sea compatible con OpenAI y admita llamadas a funciones, puedes integrarlo con un agente de voz en tiempo real. Esto puede incluir modelos que hayas ajustado con conjuntos de datos personalizados. También puedes usar cualquier voz disponible en la biblioteca de ElevenLabs o tu propia voz si has creado un clon de tu propia voz.



