Keyterm-Prompting
Keyterm-Prompting
In diesem Leitfaden erfahren Sie, wie Sie Keyterm-Prompting mit der Speech-to-Text-API verwenden.
Anleitung · Setzt voraus, dass Sie den Speech to Text- Schnellstart abgeschlossen haben.
Überblick
Keyterm Prompting ist mit Scribe v2, Scribe v2 Medical (Batch) und Scribe v2 Realtime verfügbar und mit zusätzlichen Kosten verbunden. Detaillierte Preisinformationen finden Sie auf der API-Preisseite.
Keyterm Prompting ermöglicht es Ihnen, Wörter oder Ausdrücke hervorzuheben, damit das Modell diese bevorzugt transkribiert. Das ist nützlich für bestimmte Wörter oder Sätze, die in der Audiodatei nicht häufig vorkommen, etwa Produktnamen, Namen oder andere spezifische Begriffe. Keyterms sind leistungsfähiger als gewichtete Keywords oder benutzerdefinierte Vokabulare anderer Modelle, da sie den Kontext nutzen, um zu entscheiden, ob ein Begriff transkribiert werden soll.
Wenn Ihr Unternehmensname beispielsweise kein gebräuchlicher Ausdruck ist oder eine besondere Schreibweise oder Aussprache hat, können Sie mit Keyterms sicherstellen, dass das Modell ihn korrekt transkribiert. Betrachten Sie die folgende Audiodatei:
Ohne Keyterm Prompting könnte das Modell den obigen Text wie folgt transkribieren:
Dabei wird der Unternehmensname falsch geschrieben. Mit Keyterm Prompting können Sie sicherstellen, dass das Modell den obigen Text mit der korrekten Schreibweise transkribiert:
Kontext
Das Modell kann den Kontext nutzen, um zu bestimmen, ob ein Begriff transkribiert werden soll. Wenn Sie den Keyterm „ElevenLabs“ angeben, wird die obige Audiodatei erwartungsgemäß transkribiert. Dennoch kann das Modell anhand des Kontexts auch Folgendes korrekt transkribieren:
Daraus ergibt sich folgende Transkription:
Batch-Transkription
Keyterm Prompting ist in die Batch-Speech-to-Text-API integriert. Übergeben Sie dazu den Parameter keyterms an die Methode convert.
Echtzeit-Streaming
Keyterm Prompting ist auch für die Echtzeit-Speech-to-Text-WebSocket-API verfügbar. Übergeben Sie beim Verbinden den Parameter keyterms.
Wenn Sie die WebSocket-API direkt verwenden, übergeben Sie Keyterms als Abfrageparameter: