Conheça o Scribe v2
- Publicado
OuvirOuça este artigo
O Scribe v2 foi desenvolvido para transcrição em lote, criação de legendas e legendagem em escala. Ele aprimora a estabilidade e a precisão do Scribe v1, lidando melhor com áudios longos, pausas, mudanças de entonação e silêncios prolongados.

Enquanto o Scribe v2 Realtime é otimizado para latência ultrabaixa e casos de uso de agentes, o Scribe v2 é otimizado para gravações longas e complexas, mantendo a precisão entre diferentes falantes, sotaques e estilos de fala. O resultado são transcrições consistentemente confiáveis em diversas condições de áudio do mundo real.
O Scribe v2 alcança a menor taxa de erro de palavras registrada em benchmarks padrão do setor.

Prompting de termos-chave para transcrição com reconhecimento de contexto
O prompting de termos-chave vai além do Vocabulário Personalizado padrão ao usar o contexto da transcrição. Selecione até 100 palavras ou frases, e o Scribe v2 decidirá com precisão quando transcrever esses termos. Isso o torna ideal para áreas técnicas, nomes de marcas e linguagem específica de cada setor.

Detecção integrada de entidades com marcações de tempo precisas
O Scribe v2 inclui detecção nativa de entidades para análises estruturadas de áudio.
Você pode selecionar até 56 categorias, incluindo Informações de Identificação Pessoal, dados de saúde ou detalhes de pagamento. O Scribe v2 detectará automaticamente essas ocorrências e suas marcações de tempo exatas na transcrição, facilitando a revisão, a redação ou o processamento de informações confidenciais em escala.
Saiba mais na documentação da API: https://elevenlabs.io/docs/developers/guides/cookbooks/speech-to-text/batch/entity-detection
Transcrição automática em vários idiomas
O Scribe v2 oferece suporte nativo a workflows inteligentes em vários idiomas.
Você pode enviar um áudio com vários idiomas em um único arquivo. O modelo detecta automaticamente cada idioma e o transcreve corretamente, sem necessidade de segmentação ou configuração manual.
Recursos adicionais para workflows de produção
O Scribe v2 inclui um conjunto de recursos desenvolvido para casos de uso empresariais e de desenvolvedores:
- Diarização inteligente de falantes para identificar cada pessoa com clareza e de forma intuitiva
- Marcações de tempo precisas por palavra para sincronização exata de legendas e experiências interativas
- Marcação dinâmica de áudio que detecta eventos não verbais, como risadas ou passos
- Pronto para empresas, com conformidade com SOC 2, ISO 27001, PCI DSS L1, HIPAA e LGPD, residência de dados na UE e na Índia e suporte ao modo de retenção zero
Scribe v2, agora no ElevenLabs Studio
O Scribe v2 agora é usado no ElevenLabs Studio para criar legendas e transcrições mais precisas, ajudando equipes que gerenciam grandes acervos de áudio e vídeo em marketing, mídia, pesquisa, treinamento e conformidade.

Experimente agora: https://elevenlabs.io/app/studio
Desenvolva com a API
Com o Scribe v2, desenvolvedores e empresas podem automatizar pipelines de áudio complexos, aumentar a precisão em workflows globais de conteúdo e escalar com segurança, contando com controles completos de conformidade e residência de dados.

O Scribe v2 já está disponível pela nossa API e pela plataforma Creative.
Experimente agora: https://elevenlabs.io/app/speech-to-text
Leia a documentação: https://elevenlabs.io/docs/capabilities/speech-to-text
Cadastre-se aqui: https://elevenlabs.io/speech-to-text




