Apresentamos o Eleven v4Conheça o Eleven v4, nosso modelo mais expressivo até agora. Com 3x mais créditos incluídos no Creator+ até 12 de outubro

Pular para o conteúdo

Conheça o Scribe v2

Publicado

OuvirOuça este artigo

O Scribe v2 foi desenvolvido para transcrição em lote, criação de legendas e legendagem em escala. Ele aprimora a estabilidade e a precisão do Scribe v1, lidando melhor com áudios longos, pausas, mudanças de entonação e silêncios prolongados.

Introducing Scribe v2

Enquanto o Scribe v2 Realtime é otimizado para latência ultrabaixa e casos de uso de agentes, o Scribe v2 é otimizado para gravações longas e complexas, mantendo a precisão entre diferentes falantes, sotaques e estilos de fala. O resultado são transcrições consistentemente confiáveis em diversas condições de áudio do mundo real.


O Scribe v2 alcança a menor taxa de erro de palavras registrada em benchmarks padrão do setor.

Scribe v2 FLEURS benchmark

Prompting de termos-chave para transcrição com reconhecimento de contexto

O prompting de termos-chave vai além do Vocabulário Personalizado padrão ao usar o contexto da transcrição. Selecione até 100 palavras ou frases, e o Scribe v2 decidirá com precisão quando transcrever esses termos. Isso o torna ideal para áreas técnicas, nomes de marcas e linguagem específica de cada setor.

Scribe v2 keyterm prompting

Detecção integrada de entidades com marcações de tempo precisas

O Scribe v2 inclui detecção nativa de entidades para análises estruturadas de áudio.

Você pode selecionar até 56 categorias, incluindo Informações de Identificação Pessoal, dados de saúde ou detalhes de pagamento. O Scribe v2 detectará automaticamente essas ocorrências e suas marcações de tempo exatas na transcrição, facilitando a revisão, a redação ou o processamento de informações confidenciais em escala.

Saiba mais na documentação da API: https://elevenlabs.io/docs/developers/guides/cookbooks/speech-to-text/batch/entity-detection

Transcrição automática em vários idiomas

O Scribe v2 oferece suporte nativo a workflows inteligentes em vários idiomas.

Você pode enviar um áudio com vários idiomas em um único arquivo. O modelo detecta automaticamente cada idioma e o transcreve corretamente, sem necessidade de segmentação ou configuração manual.

Recursos adicionais para workflows de produção

O Scribe v2 inclui um conjunto de recursos desenvolvido para casos de uso empresariais e de desenvolvedores:

  • Diarização inteligente de falantes para identificar cada pessoa com clareza e de forma intuitiva
  • Marcações de tempo precisas por palavra para sincronização exata de legendas e experiências interativas
  • Marcação dinâmica de áudio que detecta eventos não verbais, como risadas ou passos
  • Pronto para empresas, com conformidade com SOC 2, ISO 27001, PCI DSS L1, HIPAA e LGPD, residência de dados na UE e na Índia e suporte ao modo de retenção zero

Scribe v2, agora no ElevenLabs Studio

O Scribe v2 agora é usado no ElevenLabs Studio para criar legendas e transcrições mais precisas, ajudando equipes que gerenciam grandes acervos de áudio e vídeo em marketing, mídia, pesquisa, treinamento e conformidade.

Scribe v2 in Studio

Experimente agora: https://elevenlabs.io/app/studio

Desenvolva com a API

Com o Scribe v2, desenvolvedores e empresas podem automatizar pipelines de áudio complexos, aumentar a precisão em workflows globais de conteúdo e escalar com segurança, contando com controles completos de conformidade e residência de dados.

Scribe v2 Keyterm prompting code snippet

O Scribe v2 já está disponível pela nossa API e pela plataforma Creative.

Experimente agora: https://elevenlabs.io/app/speech-to-text

Leia a documentação: https://elevenlabs.io/docs/capabilities/speech-to-text

Cadastre-se aqui: https://elevenlabs.io/speech-to-text

Artigos relacionados

Crie com o áudio de IA da mais alta qualidade