Speech to Text
Überblick
Mit Speech to Text können Sie gesprochene Audiodateien mit modernster Genauigkeit in Text transkribieren. Dank automatischer Spracherkennung können Sie Audio in zahlreichen Sprachen transkribieren.
Transkript erstellen
Audio hochladen
Navigieren Sie im ElevenLabs-Dashboard zur Seite Speech to Text und klicken Sie auf „Dateien transkribieren“. Im Dialog können Sie eine Audio- oder Videodatei zur Transkription hochladen.

Optionen auswählen
-
Wählen Sie die primäre Sprache des Audios aus, wenn Sie sie kennen. Sie können die Einstellung auf „Erkennen“ lassen; alle Sprachen im Audio werden dann automatisch erkannt.
-
Wählen Sie mit dem Umschalter „Audioereignisse taggen“, ob Audioereignisse wie Lachen oder Applaus markiert werden sollen.
-
Mit Keyterm-Prompting können Sie bis zu 1.000 Wörter oder Ausdrücke hinzufügen, damit das Modell diese bevorzugt transkribiert. Das ist hilfreich für bestimmte Wörter oder Sätze, die im Audio nicht häufig vorkommen, etwa Produktnamen, Namen oder andere spezifische Begriffe.
Wenn Sie bereit sind, klicken Sie zum Senden auf „Dateien hochladen“.
Ergebnisse anzeigen
Klicken Sie im mittleren Bereich auf den Namen der hochgeladenen Audiodatei, um die Ergebnisse anzuzeigen. Sie können auf ein Wort klicken, um die Audiowiedergabe an dieser Stelle zu starten.
Klicken Sie oben rechts auf „Exportieren“, um die Ergebnisse in verschiedenen Formaten herunterzuladen.
Transkript-Editor
Nachdem Sie ein Transkript erstellt haben, können Sie es in unserem Transkript-Editor bearbeiten. Erfahren Sie in dieser Anleitung mehr darüber.