Detecção de entidades
Detecção de entidades
Este guia mostra como usar a detecção de entidades com a API de Speech to Text.
Guia prático · Pressupõe que você concluiu o guia de início rápido do Speech to Text .
Visão geral
A detecção de entidades é um recurso que permite detectar palavras e frases específicas na transcrição, fornecendo seus timestamps exatos. Isso é útil para detectar números de cartão de crédito, nomes, condições médicas ou números de seguridade social, que podem então ser ocultados.
Quando ativado, o modelo detecta tipos específicos de entidade na transcrição e fornece seus timestamps exatos.
Por exemplo, o áudio a seguir:
Gera a seguinte transcrição quando especificamos "pii" (informações de identificação pessoal) como o tipo de entidade:
O resultado mostra as entidades de informações de identificação pessoal detectadas na transcrição, com seus timestamps exatos.
Como integrar a detecção de entidades
A detecção de entidades é integrada à API de Speech to Text ao passar o parâmetro entity_detection para o método convert.
Tipos de entidade
Os seguintes tipos de entidade são compatíveis com a detecção. Você pode detectar grupos inteiros usando as palavras-chave de categoria pii, phi, pci, other ou offensive_language, ou especificar tipos de entidade individuais pelo rótulo. Para detectar todos os tipos de entidade, use a categoria all.
PII (Informações de Identificação Pessoal)
PHI (Informações de Saúde Protegidas)
PCI (Setor de Cartões de Pagamento)
Outras entidades
Linguagem ofensiva
Redação de entidades
Além de detectar entidades, você pode ocultá-las do texto da transcrição com o
parâmetro entity_redaction. Ele aceita o mesmo formato que entity_detection: all, uma
palavra-chave de categoria ou uma lista de tipos específicos de entidade. Os tipos ocultados devem ser um subconjunto dos
tipos detectados.
Quando a redação está ativada, o texto da entidade correspondente é substituído por um marcador tanto no
texto da transcrição quanto na saída por palavra, e o campo entities não é retornado na
resposta.
O parâmetro entity_redaction_mode controla o formato do marcador:
A detecção e a redação de entidades não são compatíveis com o estilo de saída multicanal combined.