Echtzeit-Ereignisreferenz

Referenz der Ereignisse, die von der Echtzeit-Spracherkennung API empfangen werden

Referenz · Listet alle Ereignisse auf, die an die und von der Echtzeit-Spracherkennung-WebSocket- API gesendet bzw. empfangen werden.

Weitere Informationen zur API und ihren Optionen finden Sie in der API-Referenz für die Echtzeit-Spracherkennung API.

committed_transcript ist das stabile, finale Ereignis für jedes Segment. Die öffentliche API gibt kein separates final_transcript-Ereignis aus.

Gesendete Ereignisse

EreignisBeschreibungVerwendung
input_audio_chunkAudiodaten zur Transkription sendenKontinuierlich beim Audio-Streaming

Empfangene Ereignisse

EreignisBeschreibungEmpfangszeitpunkt
session_startedBestätigt die Verbindung und gibt die Sitzungskonfiguration zurückUnmittelbar nach Aufbau der WebSocket-Verbindung
partial_transcriptLive-Transkriptaktualisierung für das laufende Segment. Spätere partielle Transkripte ersetzen frühereWährend der Audioverarbeitung, bevor ein Commit ausgeführt wird
committed_transcriptAbgeschlossenes Transkript für ein Segment. Dies ist der stabile, finale Text des Segments und ändert sich nichtNach einem Commit (manuell oder durch VAD ausgelöst)
committed_transcript_with_timestampsAbgeschlossenes Transkript mit Zeitstempeln auf Wortebene und erkanntem language_codeWird nach dem abgeschlossenen Transkript gesendet. Nur empfangen, wenn include_timestamps=true oder include_language_detection=true in den Abfrageparametern enthalten ist
committed_transcript_entitiesIm abgeschlossenen Transkriptsegment erkannte Entitäten mit Zeichen-OffsetsWird kurz nach jedem abgeschlossenen Transkript gesendet. Nur empfangen, wenn entity_detection in den Abfrageparametern enthalten ist
edited_transcriptBearbeitete Version des abgeschlossenen Transkriptsegments zusammen mit dem ursprünglichen abgeschlossenen TextWird kurz nach jedem abgeschlossenen Transkript gesendet. Nur empfangen, wenn transcript_edit in den Abfrageparametern enthalten ist

Fehlerbehandlung

Wenn ein Fehler auftritt, wird vor dem Schließen der WebSocket-Verbindung eine Fehlermeldung zurückgegeben.

FehlertypBeschreibung
auth_errorBeim Authentifizieren der Anfrage ist ein Fehler aufgetreten. Prüfen Sie Ihren API-Key
quota_exceededSie haben Ihr Nutzungskontingent überschritten
transcriber_errorBeim Transkribieren des Audios ist ein Fehler aufgetreten.
input_errorBeim Verarbeiten des Audio-Chunks ist ein Fehler aufgetreten. Wahrscheinlich aufgrund eines ungültigen Eingabeformats oder ungültiger Parameter
invalid_requestDie Verbindungsparameter wurden abgelehnt. Prüfen Sie die Abfrageparameter anhand der API-Referenz
errorEin allgemeiner Serverfehler
commit_throttledDer Commit wurde aufgrund zu vieler Commit-Anfragen in kurzer Zeit gedrosselt
unaccepted_termsSie haben die Nutzungsbedingungen für Scribe nicht akzeptiert. Prüfen und akzeptieren Sie die Allgemeinen Geschäftsbedingungen im ElevenLabs-Dashboard
rate_limitedIhre Anfragen werden begrenzt. Reduzieren Sie die Anzahl der Anfragen in kurzer Zeit
queue_overflowDie Verarbeitungswarteschlange ist voll. Senden Sie weniger Anfragen in kurzer Zeit
resource_exhaustedDie Serverressourcen sind ausgelastet. Versuchen Sie es später erneut
session_time_limit_exceededDie maximale Sitzungsdauer wurde erreicht. Starten Sie eine neue Sitzung oder führen Sie ein Upgrade Ihres Abonnements durch
chunk_size_exceededDer Audio-Chunk ist zu groß. Verringern Sie die Chunk-Größe
insufficient_audio_activitySie haben nicht genügend Audioaktivität gesendet, um die Verbindung aufrechtzuerhalten