Conheça o Scribe v2
- Publicado
OuvirOuça este artigo
O Scribe v2 foi desenvolvido para transcrição em lote, criação de legendas e legendagem em escala. Ele aprimora a estabilidade e a precisão do Scribe v1, lidando melhor com áudios longos, pausas, mudanças de tom e silêncios prolongados.

Enquanto o Scribe v2 Realtime é otimizado para latência ultrabaixa e casos de uso de agentes, o Scribe v2 é otimizado para gravações longas e complexas, mantendo a precisão com diversos locutores, sotaques e estilos de fala. O resultado são transcrições consistentemente confiáveis em uma ampla variedade de condições de áudio do mundo real.
O Scribe v2 alcança a menor taxa de erro de palavras já registrada em benchmarks padrão do setor.

Keyterm Prompting para transcrição com reconhecimento de contexto
O Keyterm Prompting vai além do Vocabulário Personalizado padrão ao usar o contexto da transcrição. Selecione até 100 palavras ou frases, e o Scribe v2 decidirá com precisão quando transcrever esses termos. Isso o torna ideal para áreas técnicas, nomes de marcas e linguagem específica de determinados setores.

Detecção integrada de entidades com timestamps precisos
O Scribe v2 inclui detecção nativa de entidades para análise estruturada de áudio.
Você pode selecionar até 56 categorias, incluindo informações de identificação pessoal, dados de saúde ou detalhes de pagamento. O Scribe v2 detectará automaticamente essas ocorrências e seus timestamps exatos na transcrição, facilitando a revisão, a ocultação ou o processamento de informações sensíveis em escala.
Saiba mais na documentação da API: https://elevenlabs.io/docs/developers/guides/cookbooks/speech-to-text/batch/entity-detection
Transcrição automática em vários idiomas
O Scribe v2 oferece suporte imediato a workflows inteligentes em vários idiomas.
Você pode enviar um áudio com vários idiomas em um único arquivo. O modelo detecta automaticamente cada idioma e o transcreve corretamente, sem segmentação ou configuração manual.
Recursos adicionais para workflows de produção
O Scribe v2 inclui recursos desenvolvidos para casos de uso empresariais e de desenvolvedores:
- Diarização inteligente de locutores para identificação clara e intuitiva de quem está falando
- Timestamps precisos por palavra para sincronização exata de legendas e experiências interativas
- Marcação dinâmica de áudio que detecta eventos não verbais, como risadas ou passos
- Pronto para empresas, com conformidade com SOC 2, ISO 27001, PCI DSS L1, HIPAA e LGPD, residência de dados na UE e na Índia e suporte ao modo de retenção zero
Scribe v2, agora no ElevenLabs Studio
O Scribe v2 agora é usado no ElevenLabs Studio para gerar legendas, captions e transcrições mais precisas, ajudando equipes que gerenciam grandes bibliotecas de áudio e vídeo em casos de uso de marketing, mídia, pesquisa, treinamento e conformidade.

Experimente agora: https://elevenlabs.io/app/studio
Desenvolva com a API
Com o Scribe v2, desenvolvedores e empresas podem automatizar pipelines de áudio complexos, aumentar a precisão em workflows globais de conteúdo e escalar com segurança, tendo controles completos de conformidade e residência de dados.

O Scribe v2 está disponível hoje pela nossa API e plataforma Creative.
Experimente agora: https://elevenlabs.io/app/speech-to-text
Leia a documentação: https://elevenlabs.io/docs/capabilities/speech-to-text
Cadastre-se aqui: https://elevenlabs.io/speech-to-text




