Como escolher o modelo certo

Este guia mostra como escolher o modelo ElevenLabs certo para seu caso de uso.

A ElevenLabs oferece uma variedade de modelos otimizados para diferentes requisitos. A escolha certa depende do seu caso de uso, dos requisitos de latência e das expectativas de qualidade. Consulte a referência de modelos para ver as especificações completas.

Por requisito

Qualidade

Use eleven_v4

O modelo principal com a maior fidelidade, expressão emocional mais rica e suporte mais amplo a idiomas.

Baixa latência

Use eleven_v4_turbo

Otimizado para aplicações em tempo real com latência de cerca de 100 ms.

Por caso de uso

Criação de conteúdo

Use eleven_v4

Ideal para conteúdo profissional, audiolivros e narração de vídeo.

Agentes conversacionais

Use eleven_v4_turbo para a entrega mais expressiva ou eleven_flash_v2_5 e eleven_flash_v2 para a menor latência.

Use o modelo 2.5 para suporte a idiomas além do inglês.

Otimizado para aplicações conversacionais em tempo real.

Transcrição

Use scribe_v2 para transcrição em lote, scribe_v2_medical para áudio médico e clínico ou scribe_v2_realtime para transcrição em tempo real.

Precisão de ponta em mais de 90 idiomas, com diarização de falantes e timestamps por palavra.

Modificador de voz

Use eleven_multilingual_sts_v2

Especializado em conversão de Speech-to-Speech.

Próximas etapas