Apresentamos o Eleven v4Conheça o Eleven v4, nosso modelo mais expressivo até agora. Com 3x mais créditos incluídos no Creator+ até 12 de outubro

Pular para o conteúdo

Scribe v2 acaba de receber uma atualização

Escrito por
Joe Reeve
Publicado

OuvirOuça este artigo

Estamos lançando a redação integrada de entidades, melhorias na transcrição de idiomas índicos com inglês, um novo modo No Verbatim e a expansão dos keyterms para até 1.000 termos.

Essas melhorias dão aos desenvolvedores mais controle sobre privacidade, precisão multilíngue, qualidade das transcrições e precisão específica de cada área.

Nova redação de entidades no Scribe v2

Agora, o Scribe v2 pode detectar e ocultar automaticamente entidades sensíveis nas transcrições, incluindo nomes, números de cartão de crédito, números de seguridade social e outras informações de identificação pessoal.

A redação ocorre durante a transcrição. Os dados sensíveis são removidos antes de chegarem ao seu armazenamento ou sistemas posteriores.

  • Redação completa: substitui entidades por [REDACTED];
  • Categorizada: substitui pelo tipo de entidade, por exemplo, [CREDIT_CARD];
  • Enumerada: substitui por um rótulo categorizado e numerado, por exemplo, [CREDIT_CARD_1].

Isso ajuda as equipes a compartilhar transcrições com mais facilidade e oferece suporte a fluxos de trabalho de tratamento de dados em áreas como saúde, finanças e atendimento ao cliente.

Observação: a redação é automatizada e pode não identificar ou remover todas as informações sensíveis. Revise os resultados antes de depender deles.

Alternância precisa entre idiomas índicos e inglês

Em toda a Índia, as pessoas frequentemente misturam inglês com hindi, télugo, canarês e outros idiomas índicos. Muitos sistemas de transcrição transliteram palavras em inglês para escritas índicas, gerando transcrições que não refletem como as pessoas realmente se comunicam.

O Scribe v2 transcreve palavras em inglês em inglês, independentemente do idioma ao redor. Isso funciona automaticamente, sem necessidade de configurar o idioma. Não importa se você informa inglês, hindi ou nenhum código de idioma: as palavras em inglês permanecem no alfabeto latino.

Isso vale para os idiomas índicos em geral, não apenas para hindi e inglês. Se uma pessoa alternar entre télugo e inglês ou entre canarês e inglês, as partes em inglês serão transcritas corretamente.

Modo No Verbatim para transcrições limpas

Estamos lançando o modo No Verbatim, uma configuração de transcrição que remove automaticamente palavras de preenchimento, como "um" e "uh", além de frases repetidas e gagueira.

O resultado é uma transcrição limpa e fácil de ler, sem edição manual nem pós-processamento.

O modo No Verbatim é ideal para anotações de reuniões, legendas e qualquer workflow em que o objetivo seja um registro escrito bem acabado, em vez de uma captura bruta de cada som.

Keyterms ampliados para 1.000

Agora, os keyterms aceitam até 1.000 palavras e frases por transcrição, acima do limite anterior de 100.

Isso dá às equipes que trabalham com vocabulários técnicos extensos, catálogos de produtos ou terminologia específica de cada área mais recursos para orientar o modelo a fazer transcrições precisas.

Os keyterms continuam considerando o contexto. O modelo usa o áudio ao redor para determinar se um keyterm se aplica, em vez de inserir termos indiscriminadamente. Com 1.000 termos, isso representa 10 vezes a capacidade anterior.

Observação: solicitações com mais de 100 keyterms têm uma unidade mínima faturável de 20 segundos.

Disponível agora

Esses recursos já estão disponíveis na API e na interface do Scribe v2.

Leia a documentação:
https://elevenlabs.io/docs/cookbooks/speech-to-text/quickstart

Experimente no app:
https://elevenlabs.io/app/speech-to-text

Artigos relacionados

Crie com o áudio de IA da mais alta qualidade