Converse com o DeepSeek R1 usando o ElevenLabs Conversational AI
- Escrito por
- Thor Schaeff
- Publicado
- Última atualização
OuvirOuça este artigo
Todo mundo tem falado sobre o DeepSeek ultimamente, mas ninguém parou para perguntar: como seria a voz do DeepSeek se ele pudesse falar? É aí que podemos usar a IA Conversacional da ElevenLabs para tornar possível conversar com o DeepSeek R1.
A IA Conversacional da ElevenLabs é uma plataforma para implantar agentes de voz conversacionais personalizados em tempo real. Um dos principais benefícios da plataforma é sua flexibilidade, que permite conectar diferentes LLMs de acordo com suas necessidades.

A opção LLM personalizado funciona com qualquer provedor de API compatível com OpenAI, desde que o modelo seja compatível com uso de ferramentas/chamadas de função. Em nossa documentação, você encontra guias para GroqCloud, Together AI, e Cloudflare. Para a demonstração a seguir, usaremos o Cloudflare.
Estamos usando o modelo DeepSeek-R1-Distill-Qwen-32B, um modelo derivado do DeepSeek-R1 e baseado no Qwen2.5. Ele supera o OpenAI-o1-mini em vários benchmarks, alcançando novos resultados de ponta para modelos densos.
O principal motivo de usarmos a versão derivada é que as versões puras ainda não funcionam de forma confiável com chamadas de função. Na verdade, o modelo de raciocínio R1 ainda não oferece suporte a chamadas de função! Você pode acompanhar esta issue para se manter atualizado sobre o progresso.
Comece a usar a IA Conversacional da ElevenLabs
O processo de conectar um LLM personalizado é bem simples e começa com a criação de um agente. Neste projeto, usaremos o modelo de Tutor de Matemática. Se você só quer saber como o DeepSeek soa, temos uma demonstração do agente que você pode testar por conta própria.
Para começar, acesse a página do app de IA Conversacional da ElevenLabs e crie um novo Agente de IA chamado “DeepSeeker”. Selecione o modelo de Tutor de Matemática, pois esse é um caso de uso em que o raciocínio do DeepSeek pode se destacar, e selecione “Criar agente”.
O modelo de matemática inclui um prompt de sistema que garante a leitura de números e equações em linguagem natural, em vez de como foram escritos pelo LLM. Por exemplo, dizemos a ele para escrever "Alfa vezes x ao quadrado é igual a 4" se a resposta do LLM for "ax^2=4".

Modelos de raciocínio geralmente explicam sua “cadeia de pensamento”, mas também podemos ampliar o prompt de sistema para garantir ainda mais uma boa explicação de matemática, especificando, por exemplo, que ele apresente o raciocínio da solução passo a passo. Você pode manter isso mais geral ou expandir o prompt para incluir exemplos específicos que ele possa usar como referência.
No entanto, se você realmente quiser ter uma ideia da personalidade do DeepSeek R1, pode criar um modelo em branco, pedir que o agente se apresente como DeepSeek AI e configurar o prompt de sistema para que ele responda a perguntas sobre diferentes assuntos.
Configure o DeepSeek R1 com o Cloudflare Workers AI
Em seguida, precisamos obter um endpoint de uma versão do DeepSeek R1 para usar com nosso agente. Neste exemplo, usaremos o Cloudflare, que disponibiliza o DeepSeek-R1-Distill-Qwen-32B em sua plataforma Workers AI para fins de avaliação, mas você também pode considerar outras opções de hospedagem, como fireworks.ai, GroqCloud, e together.ai
Primeiro, acesse dash.cloudflare.com e crie uma conta ou entre na sua. Na navegação, selecione IA > Workers AI e clique no widget “Use REST API”.

Para obter uma chave de API, clique em “Create a Workers AI API Token” e armazene-a com segurança.
Depois de obter sua chave de API, você pode testá-la imediatamente com uma solicitação curl. O Cloudflare oferece um endpoint de API compatível com OpenAI, o que torna isso muito prático. Neste ponto, anote o modelo e o endpoint completo — incluindo o ID da conta.
Por exemplo: https://api.cloudflare.com/client/v4/accounts/{ACCOUNT_ID}c/ai/v1/
curl https://api.cloudflare.com/client/v4/accounts/{ACCOUNT_ID}/ai/v1/chat/completions \ -X POST \ -H "Authorization: Bearer {API_TOKEN}" \ -d '{ "model": "@cf/deepseek-ai/deepseek-r1-distill-qwen-32b", "messages": [ {"role": "system", "content": "You are a helpful assistant."}, {"role": "user", "content": "How many Rs in the word Strawberry?"} ], "stream": false }'
Configure seu LLM personalizado na ElevenLabs
O próximo passo é adicionar esses detalhes ao seu agente na ElevenLabs. Primeiro, acesse seu Agente de IA DeepSeeker no app da ElevenLabs e, no final da página, adicione sua chave de API recém-criada como um segredo. Dê a ela um nome como CLOUDFLARE_AUTH_TOKEN e salve as alterações.

Em seguida, em LLM, selecione a opção LLM personalizado e informe o endpoint de API compatível com OpenAI do Cloudflare Workers AI: https://api.cloudflare.com/client/v4/accounts/{ACCOUNT_ID}/ai/v1
Substitua “{ACCOUNT_ID}” na URL pelo ID da sua conta exibido no Cloudflare.
Adicione o ID do modelo: @cf/deepseek-ai/deepseek-r1-distill-qwen-32b
Por fim, selecione o segredo que você acabou de criar.

Teste
Ótimo. Agora que tudo está configurado, clique em “Test AI agent” e faça um teste com o seguinte problema de matemática:
“Dois trens passam um pelo outro, um seguindo para leste e outro para oeste, a 65 mph e 85 mph. Quanto tempo levará até que estejam a 330 milhas de distância?”
Observação: se você não tiver configurado uma forma de pagamento, a API do Cloudflare Workers AI terá sua taxa limitada e poderá apresentar tempos de resposta maiores. Configure sua conta de cobrança antes de passar para produção. Isso pode não ser um problema em outras plataformas de hospedagem.
Conclusão
Criar agentes de IA conversacionais em tempo real com a plataforma de IA Conversacional da ElevenLabs permite que você reaja rapidamente ao lançamento de novos modelos, conectando LLMs personalizados por meio de qualquer provedor de API compatível com OpenAI.
Desde que o modelo que você queira usar seja compatível com OpenAI e ofereça suporte a chamadas de função, é possível integrá-lo a um agente de voz em tempo real. Isso pode incluir modelos que você ajustou em conjuntos de dados personalizados. Você também pode usar qualquer voz disponível na biblioteca da ElevenLabs — ou sua própria voz, caso tenha criado um clone da sua própria voz.


