Speech to Text-Schnellstart
Speech to Text-Schnellstart
Diese Anleitung zeigt Ihnen, wie Sie gesprochene Audiodaten mit der Speech to Text API in Text umwandeln.
Verwenden Sie den ElevenLabs-Speech-to-Text-Skill, um Audio mit Ihrem KI-Coding-Assistenten zu transkribieren:
Dieses Tutorial zeigt die Verwendung der Batch Speech to Text API. Eine Anleitung zur Verwendung der Echtzeit-Spracherkennung finden Sie in den Anleitungen zum clientseitigen Streaming oder serverseitigen Streaming.
Speech to Text API verwenden
API-Key erstellen
Erstellen Sie hier im Dashboard einen API-Schlüssel, den Sie für den sicheren Zugriff auf die API verwenden.
Speichern Sie den Schlüssel als verwaltetes Secret und übergeben Sie ihn je nach Präferenz an die SDKs entweder als Umgebungsvariable über eine .env-Datei oder direkt in der Konfiguration Ihrer App.
SDK installieren
SDK
CLI
Wir verwenden außerdem die Bibliothek dotenv, um unseren API-Schlüssel aus einer Umgebungsvariable zu laden.
API-Anfrage stellen
SDK
CLI
Erstellen Sie eine neue Datei namens example.py oder example.mts, je nach gewählter Sprache, und fügen Sie den folgenden Code hinzu:
Führen Sie den Code anschließend aus:
Die Transkription der Audiodatei sollte in der Konsole ausgegeben werden.
Setzen Sie für medizinische und klinische Audiodaten model_id auf scribe_v2_medical. Die Anfragestruktur
ist dieselbe wie bei scribe_v2, und die Abrechnung erfolgt zum gleichen Preis. Siehe Scribe v2
Medical.