エンティティ検出
エンティティ検出
このガイドでは、スピーチtoテキストAPIでエンティティ検出を使用する方法を説明します。
ハウツーガイド · スピーチtoテキストの クイックスタートを完了していることを前提としています。
概要
エンティティ検出は、文字起こし内の特定の単語やフレーズを検出し、その正確なタイムスタンプを提供する機能です。クレジットカード番号、氏名、病状、社会保障番号(SSN)などを検出し、後でマスキングする場合に便利です。
有効にすると、モデルは文字起こし内の特定のエンティティタイプを検出し、その正確なタイムスタンプを提供します。
たとえば、次のオーディオの場合です。
エンティティタイプとして"pii"(個人識別情報)を指定すると、次の文字起こしが出力されます。
結果には、文字起こしで検出されたPIIエンティティと、その正確なタイムスタンプが表示されます。
エンティティ検出を統合する
エンティティ検出は、convertメソッドにentity_detectionパラメータを渡すことでスピーチtoテキストAPIに統合できます。
エンティティタイプ
以下のエンティティタイプを検出できます。カテゴリキーワードのpii、phi、pci、other、offensive_languageを使うとグループ全体を検出でき、ラベルを指定すると個別のエンティティタイプを検出できます。すべてのエンティティタイプを検出するには、allカテゴリを使用します。
PII(個人を特定できる情報)
PHI(保護対象保健情報)
PCI(決済カード業界)
その他のエンティティ
不快な表現
エンティティのマスキング
エンティティを検出するだけでなく、entity_redactionパラメータを使用して文字起こしテキストからマスキングできます。このパラメータには、entity_detectionと同じ形式(all、カテゴリキーワード、または特定のエンティティタイプのリスト)を指定できます。マスキングするタイプは、検出するタイプのサブセットである必要があります。
マスキングを有効にすると、一致したエンティティテキストは文字起こしテキストと単語レベルの出力の両方でマーカーに置き換えられ、レスポンスではentitiesフィールドが返されません。
entity_redaction_modeパラメータは、マーカーの形式を制御します。
エンティティの検出とマスキングは、combinedマルチチャンネル出力スタイルではサポートされていません。