O que é o Eleven v3?

Recomendamos migrar para o Eleven v4 e testá-lo com seu próprio conteúdo.

Recomendamos migrar para o Eleven v4 e testá-lo com seu próprio conteúdo. Muitas das técnicas de prompting do Eleven v4 também se aplicam ao Eleven v3.

Eleven v3 é um modelo de Text to Speech expressivo e com grande riqueza emocional. Ele produz falas naturais e realistas, com ampla variedade emocional e compreensão contextual em mais de 70 idiomas.

O Eleven v3 oferece:

  • Suporte a tags de áudio
    • emoções: [sad] [angry] [happily]
    • orientação de entrega: [whispers] [shouts]
    • reações não verbais: [laughs] [clears throat] [sighs]
  • Modo de diálogo para áudios naturais com vários locutores
  • Suporte a mais de 70 idiomas

Este modelo funciona bem para conversas entre personagens, narração de audiolivros e diálogos emocionais.

Você pode gerar com o v3 pela API usando nossos endpoints Criar fala e Transmitir fala, especificando o ID de modelo eleven_v3.

Você também pode usar nossos endpoints Criar diálogo e Transmitir diálogo para criar um diálogo natural com vários locutores.

Acesse os recursos abaixo para saber mais: