Fluxo da conversa

Configure como seu assistente lida com tempos limite, interrupções e alternância de turnos durante as conversas.

Visão geral

As configurações de fluxo da conversa determinam como seu assistente lida com períodos de silêncio do usuário, interrupções durante a fala e o comportamento de alternância de turnos. Essas configurações ajudam a criar conversas mais naturais e podem ser personalizadas de acordo com seu caso de uso.

Duração máxima da conversa

A configuração Duração máxima da conversa limita o tempo total em que uma conversa pode permanecer ativa. Esse limite global começa quando a conversa é iniciada e é aplicado independentemente dos timeouts por turno. O padrão é 600 segundos (10 minutos). Você pode definir um valor de 60 a 7.200 segundos.

Configuração

Na CLI e na API, configure essa opção com o campo conversation_config.conversation.max_duration_seconds.

Abra seu agente no painel, acesse a aba Avançado e ajuste a Duração máxima da conversa em **Limites de chamada **. Salve suas alterações.

Conversas por mensagem no WhatsApp têm um timeout padrão de inatividade de 15 minutos, medido a partir da resposta mais recente do agente. Esse timeout pode encerrar uma conversa por mensagem antes da duração máxima configurada. Clientes Enterprise cujo caso de uso exija um timeout diferente devem entrar em contato com o suporte em support@elevenlabs.io.

Assumir o turno após o silêncio

A configuração Assumir o turno após o silêncio determina por quanto tempo seu assistente espera durante períodos de silêncio do usuário antes de assumir o próximo turno e solicitar uma resposta.

Configuração

O valor é especificado em segundos e deve estar entre 1 e 30 segundos. Na CLI e na API, configure essa opção com o campo conversation_config.turn.turn_timeout.

Abra seu agente no painel, acesse a aba Avançado e ajuste o valor de Assumir o turno após o silêncio. Salve suas alterações.

Configuração de assumir o turno após o silêncio

Escolha uma duração de timeout adequada ao seu caso de uso. Timeouts mais curtos criam conversas mais responsivas, mas podem interromper usuários que precisam de mais tempo para responder, resultando em uma conversa menos natural.

Boas práticas

  • Defina timeouts mais curtos (5 a 10 segundos) para conversas informais, nas quais se espera uma troca rápida
  • Use timeouts mais longos (10 a 30 segundos) quando os usuários puderem precisar de mais tempo para pensar ou formular respostas complexas
  • Considere o contexto do usuário: o atendimento ao cliente pode se beneficiar de timeouts mais curtos, enquanto o suporte técnico pode precisar de timeouts mais longos

Timeout suave

O timeout suave fornece feedback de áudio imediato quando o LLM demora mais do que o esperado para gerar uma resposta. Em vez de um silêncio constrangedor durante a espera, seu agente diz uma breve frase de preenchimento, como “Hmm…” ou “Deixe-me pensar…”, para manter o fluxo natural da conversa.

Este recurso é útil para:

  • Consultas complexas que exigem processamento mais longo pelo LLM
  • Lidar com latência variável de provedores de LLM
  • Criar conversas mais humanas com pausas naturais para pensar

Como funciona

  1. Quando o usuário termina de falar, o sistema começa a gerar uma resposta do LLM
  2. Um temporizador é iniciado com base na duração de timeout configurada
  3. Se a resposta do LLM chegar antes do timeout, nenhuma frase de preenchimento será dita
  4. Se o timeout for atingido antes de o LLM responder:
    • A mensagem de preenchimento configurada é dita imediatamente
    • O agente continua aguardando a resposta real
    • Quando estiver pronta, o agente diz a resposta completa do LLM

O timeout suave é acionado apenas uma vez por turno para evitar várias frases de preenchimento em sequência.

Configuração

Abra seu agente no painel, acesse a aba Avançado e ajuste as configurações de Timeout suave. Salve suas alterações.

Configurações de timeout suave

Duração do timeout

O tempo em segundos antes de a mensagem de preenchimento ser dita enquanto se aguarda a resposta do LLM.

ConfiguraçãoDescrição
Padrão-1 (desativado)
Intervalo0.5 a 8.0 segundos
Recomendado3.0 segundos

Comece com 3.0 segundos — tempo suficiente para evitar preenchimentos desnecessários em respostas rápidas e curto o bastante para evitar silêncios constrangedores.

Mensagem estática

Uma frase de preenchimento predefinida, dita quando o timeout suave é acionado.

ConfiguraçãoDescrição
Padrão"Hhmmmm...yeah."
Tamanho1–200 caracteres

Esta mensagem oferece suporte a:

  • Substituições de idioma: traduz-se automaticamente para outros idiomas configurados para seu agente
  • Substituições do cliente: pode ser personalizada por chamada via SDK

Mensagem gerada por LLM

Quando ativada, gera dinamicamente uma frase de preenchimento adequada ao contexto usando um LLM leve, em vez da mensagem estática.

ConfiguraçãoDescrição
Padrãofalse
FallbackUsa a mensagem estática se a geração falhar

O sistema usa o contexto recente da conversa (até 4 mensagens, 1.000 caracteres) para gerar preenchimentos relevantes como “Hmm…”, “Entendo…”, “Compreendido…”, “Certo…” ou “Tudo bem…”

Uma mensagem estática de fallback ainda é necessária ao usar mensagens geradas por LLM.

Boas práticas

  • Evite indicadores de tempo nas mensagens de preenchimento (por exemplo, “Um segundo…”) porque os tempos reais de resposta são imprevisíveis
  • Desative o timeout suave para bots de FAQ rápidos, cujas respostas são consistentemente ágeis

Interrupções

O tratamento de interrupções determina se os usuários podem interromper seu assistente enquanto ele fala.

Configuração

As configurações de interrupção podem ser definidas na aba Avançado do agente, em Eventos do cliente.

Para ativar interrupções, verifique se interrupção está selecionada como um evento do cliente.

Interrupções ativadas

Interrupção permitida

Interrupções desativadas

Interrupção ignorada

Desative as interrupções quando a transmissão completa das informações for crucial, como em avisos legais ou instruções de segurança.

Boas práticas para interrupções

  • Ative interrupções para fluxos de conversa naturais, nos quais se espera diálogo de ida e volta
  • Desative interrupções quando a conclusão da mensagem for essencial (por exemplo, termos e condições, informações de segurança)
  • Considere o contexto do seu caso de uso: o atendimento ao cliente pode se beneficiar de interrupções, enquanto a transmissão de informações pode não

Agilidade de turno

A agilidade de turno controla a rapidez com que seu assistente responde à entrada do usuário durante a conversa. Essa configuração determina o quanto o assistente está disposto a assumir turnos e começar a falar com base nos padrões de fala detectados.

Como funciona

O assistente agora inclui duas melhorias importantes para uma alternância de turnos mais natural:

  1. Geração de resposta mais rápida — O assistente começa a falar após receber palavras suficientes e uma vírgula do modelo de linguagem, em vez de esperar frases completas. Isso reduz a latência e cria conversas mais responsivas, especialmente quando o assistente tem respostas mais longas.

  2. Agilidade de turno configurável — Controle com que rapidez o assistente interpreta pausas ou padrões de fala como oportunidades para responder.

Configuração

Há três modos disponíveis:

  • Ávido — O assistente responde rapidamente à entrada do usuário, intervindo na primeira oportunidade. Ideal para conversas dinâmicas em que respostas imediatas são valorizadas.
  • Normal — Alternância de turnos equilibrada que funciona bem na maioria dos cenários de conversa. O assistente aguarda pausas naturais na conversa antes de responder.
  • Paciente — O assistente espera mais antes de assumir seu turno, dando aos usuários mais tempo para concluir seus pensamentos. Ideal para coletar informações detalhadas ou quando os usuários precisam de tempo para formular respostas.

Abra seu agente no painel, acesse as configurações de Agente e selecione o modo de agilidade de turno desejado. Salve suas alterações.

A agilidade de turno é especialmente eficaz quando combinada com workflows. Você pode ajustar dinamicamente a capacidade de resposta do assistente com base no contexto — fazendo com que ele intervenha mais rápido durante uma conversa informal ou espere mais ao coletar informações sensíveis, como números de telefone ou endereços de e-mail.

Boas práticas para agilidade de turno

  • Use o modo Ávido em cenários de atendimento ao cliente nos quais respostas rápidas melhoram a experiência do usuário
  • Use o modo Paciente ao coletar informações estruturadas, como números de telefone, endereços ou endereços de e-mail
  • Use o modo Normal como padrão para fluxos gerais de conversa
  • Combine com workflows para ajustar dinamicamente a agilidade de turno com base no contexto da conversa
  • Teste diferentes configurações no seu caso de uso específico para encontrar o equilíbrio ideal

Configurações recomendadas

  • Timeouts mais curtos (5 a 10 segundos) para interações responsivas - Ative interrupções para permitir que clientes façam perguntas - Agilidade de turno Ávida para conversas rápidas e responsivas
  • Timeouts moderados (10 a 15 segundos) para dar aos usuários tempo de reunir informações - Ative interrupções para um fluxo de conversa natural - Agilidade de turno Paciente ao coletar números de telefone, endereços ou endereços de e-mail
  • Timeouts mais longos (15 a 30 segundos) para permitir respostas complexas - Desative interrupções para garantir a transmissão completa de informações legais - Agilidade de turno Normal para manter um ritmo constante
  • Timeouts mais longos (10 a 30 segundos) para dar tempo de pensar e formular respostas - Ative interrupções para permitir que os alunos façam perguntas - Agilidade de turno Paciente para dar aos alunos tempo adequado para responder