Pular para o conteúdo

Conheça o Scribe v2

Publicado

OuvirOuça este artigo

O Scribe v2 foi desenvolvido para transcrição em lote, criação de legendas e legendagem em escala. Ele aprimora a estabilidade e a precisão do Scribe v1, lidando melhor com áudios longos, pausas, mudanças de tom e silêncios prolongados.

Introducing Scribe v2

Enquanto o Scribe v2 Realtime é otimizado para latência ultrabaixa e casos de uso de agentes, o Scribe v2 é otimizado para gravações longas e complexas, mantendo a precisão com diversos locutores, sotaques e estilos de fala. O resultado são transcrições consistentemente confiáveis em uma ampla variedade de condições de áudio do mundo real.


O Scribe v2 alcança a menor taxa de erro de palavras já registrada em benchmarks padrão do setor.

Scribe v2 FLEURS benchmark

Keyterm Prompting para transcrição com reconhecimento de contexto

O Keyterm Prompting vai além do Vocabulário Personalizado padrão ao usar o contexto da transcrição. Selecione até 100 palavras ou frases, e o Scribe v2 decidirá com precisão quando transcrever esses termos. Isso o torna ideal para áreas técnicas, nomes de marcas e linguagem específica de determinados setores.

Scribe v2 keyterm prompting

Detecção integrada de entidades com timestamps precisos

O Scribe v2 inclui detecção nativa de entidades para análise estruturada de áudio.

Você pode selecionar até 56 categorias, incluindo informações de identificação pessoal, dados de saúde ou detalhes de pagamento. O Scribe v2 detectará automaticamente essas ocorrências e seus timestamps exatos na transcrição, facilitando a revisão, a ocultação ou o processamento de informações sensíveis em escala.

Saiba mais na documentação da API: https://elevenlabs.io/docs/developers/guides/cookbooks/speech-to-text/batch/entity-detection

Transcrição automática em vários idiomas

O Scribe v2 oferece suporte imediato a workflows inteligentes em vários idiomas.

Você pode enviar um áudio com vários idiomas em um único arquivo. O modelo detecta automaticamente cada idioma e o transcreve corretamente, sem segmentação ou configuração manual.

Recursos adicionais para workflows de produção

O Scribe v2 inclui recursos desenvolvidos para casos de uso empresariais e de desenvolvedores:

  • Diarização inteligente de locutores para identificação clara e intuitiva de quem está falando
  • Timestamps precisos por palavra para sincronização exata de legendas e experiências interativas
  • Marcação dinâmica de áudio que detecta eventos não verbais, como risadas ou passos
  • Pronto para empresas, com conformidade com SOC 2, ISO 27001, PCI DSS L1, HIPAA e LGPD, residência de dados na UE e na Índia e suporte ao modo de retenção zero

Scribe v2, agora no ElevenLabs Studio

O Scribe v2 agora é usado no ElevenLabs Studio para gerar legendas, captions e transcrições mais precisas, ajudando equipes que gerenciam grandes bibliotecas de áudio e vídeo em casos de uso de marketing, mídia, pesquisa, treinamento e conformidade.

Scribe v2 in Studio

Experimente agora: https://elevenlabs.io/app/studio

Desenvolva com a API

Com o Scribe v2, desenvolvedores e empresas podem automatizar pipelines de áudio complexos, aumentar a precisão em workflows globais de conteúdo e escalar com segurança, tendo controles completos de conformidade e residência de dados.

Scribe v2 Keyterm prompting code snippet

O Scribe v2 está disponível hoje pela nossa API e plataforma Creative.

Experimente agora: https://elevenlabs.io/app/speech-to-text

Leia a documentação: https://elevenlabs.io/docs/capabilities/speech-to-text

Cadastre-se aqui: https://elevenlabs.io/speech-to-text

Artigos relacionados

Crie com o áudio de IA da mais alta qualidade