Entitätserkennung
Entitätserkennung
Diese Anleitung zeigt Ihnen, wie Sie die Entitätserkennung mit der Speech to Text API nutzen.
Anleitung · Setzt voraus, dass Sie den Speech to Text Schnellstart abgeschlossen haben.
Überblick
Die Entitätserkennung ermöglicht es Ihnen, bestimmte Wörter und Phrasen im Transkript zu erkennen und ihre exakten Zeitstempel bereitzustellen. Das ist nützlich, um Kreditkartennummern, Namen, medizinische Diagnosen oder Sozialversicherungsnummern zu erkennen, die anschließend geschwärzt werden können.
Wenn sie aktiviert ist, erkennt das Modell bestimmte Entitätstypen im Transkript und liefert ihre exakten Zeitstempel.
Zum Beispiel erzeugt das folgende Audio:
Folgendes Transkript, wenn wir "pii" (personenbezogene Daten) als Entitätstyp angeben:
Das Ergebnis zeigt die im Transkript erkannten PII-Entitäten mit ihren exakten Zeitstempeln.
Entitätserkennung integrieren
Die Entitätserkennung wird in die Speech to Text API integriert, indem Sie den Parameter entity_detection an die Methode convert übergeben.
Entitätstypen
Die folgenden Entitätstypen werden für die Erkennung unterstützt. Sie können ganze Gruppen mit den Kategorie-Schlüsselwörtern pii, phi, pci, other oder offensive_language erkennen oder einzelne Entitätstypen über ihr Label angeben. Um alle Entitätstypen zu erkennen, verwenden Sie die Kategorie all.
PII (personenbezogene Daten)
PHI (geschützte Gesundheitsinformationen)
PCI (Zahlungskartenbranche)
Andere Entitäten
Anstößige Sprache
Entitäten schwärzen
Neben der Erkennung von Entitäten können Sie diese mit dem Parameter
entity_redaction aus dem Transkripttext schwärzen. Er akzeptiert dasselbe Format wie
entity_detection: all, ein Kategorie-Schlüsselwort oder eine Liste spezifischer
Entitätstypen. Die geschwärzten Typen müssen eine Teilmenge der erkannten Typen sein.
Wenn die Schwärzung aktiviert ist, wird übereinstimmender Entitätstext sowohl im
Transkripttext als auch in der Ausgabe auf Wortebene durch eine Markierung ersetzt. Das
Feld entities wird nicht in der Antwort zurückgegeben.
Der Parameter entity_redaction_mode steuert das Markierungsformat:
Entitätserkennung und -schwärzung werden mit dem mehrkanaligen Ausgabestil combined nicht unterstützt.