React SDK
useScribe: transkrypcja mowy na tekst w czasie rzeczywistym w React
Przegląd Scribe i jego możliwości znajdziesz w przeglądzie Speech to Text overview. Instrukcje krok po kroku znajdziesz w sekcji Client-side streaming.
Instalacja
Użyj umiejętności ElevenLabs speech-to-text, aby transkrybować audio za pomocą asystenta AI do kodowania:
@elevenlabs/react ponownie eksportuje wszystko z @elevenlabs/client, więc nie musisz instalować
obu pakietów.
Użycie
Oto minimalny działający przykład, który łączy się z Scribe i wyświetla transkrypcję w czasie rzeczywistym:
Pobieranie tokenu
Scribe wymaga tokenu jednorazowego do uwierzytelniania. Utwórz endpoint API na serwerze:
Twój klucz API ElevenLabs jest poufny. Nigdy nie udostępniaj go klientowi. Zawsze generuj token na serwerze.
Opcje hooka
Skonfiguruj hook za pomocą domyślnych opcji i callbacków:
Opcje połączenia
Opcje VAD
Te opcje określają, kiedy transkrypcje są automatycznie zatwierdzane przy użyciu strategii zatwierdzania VAD.
Opcje audio
Obiekt microphone przyjmuje:
Opcje działania
Callbacki
Wszystkie callbacki zdarzeń są opcjonalne i można je przekazać jako opcje hooka:
- onConnect - handler wywoływany po ustanowieniu połączenia WebSocket.
- onDisconnect - handler wywoływany po zamknięciu połączenia WebSocket.
- onSessionStarted - handler wywoływany po rozpoczęciu sesji Scribe.
- onPartialTranscript - handler wywoływany z pośrednimi wynikami transkrypcji. Otrzymuje
{ text: string }. - onCommittedTranscript - handler wywoływany z ukończonymi wynikami transkrypcji. Otrzymuje
{ text: string }. - onCommittedTranscriptWithTimestamps - handler wywoływany z ukończonymi wynikami transkrypcji, w tym czasem na poziomie słów. Otrzymuje
{ text: string; words?: { start: number; end: number }[] }. - onError - ogólny handler wszystkich błędów. Otrzymuje
Error | Event. - onAuthError - handler wywoływany przy błędach uwierzytelniania. Otrzymuje
{ error: string }.
Callbacki błędów
Ogólny callback onError uruchamia się przy wszystkich błędach. Dostępne są też konkretne callbacki błędów, które pozwalają je obsługiwać bardziej szczegółowo. Wszystkie konkretne callbacki błędów otrzymują { error: string }.
Tryb mikrofonu
Przesyłaj audio bezpośrednio z mikrofonu użytkownika:
Ręczny tryb audio (transkrypcja pliku)
Transkrybuj nagrane wcześniej pliki audio:
Zwracane wartości
Stan
- status - bieżący stan połączenia:
"disconnected","connecting","connected","transcribing"lub"error". - isConnected - wartość logiczna wskazująca, czy połączono.
- isTranscribing - wartość logiczna wskazująca, czy transkrypcja jest aktywna.
- partialTranscript - bieżący częściowy (pośredni) ciąg transkrypcji.
- committedTranscripts - tablica obiektów
TranscriptSegment(zobacz niżej). - error - bieżący komunikat błędu lub
null.
Każdy zatwierdzony segment transkrypcji ma następującą strukturę:
Metody
connect(options?)
Połącz z Scribe. Opcje podane tutaj zastępują domyślne opcje hooka:
disconnect()
Rozłącz i zwolnij zasoby:
sendAudio(audioBase64, options?)
Wyślij dane audio (tylko tryb ręczny):
Pole previousText można wysłać tylko w pierwszym fragmencie audio sesji. Wysłanie go w
kolejnych fragmentach powoduje błąd.
commit()
Ręcznie zatwierdź bieżącą transkrypcję:
clearTranscripts()
Usuń wszystkie transkrypcje ze stanu:
getConnection()
Pobierz instancję bazowego połączenia:
Strategie zatwierdzania
Określ, kiedy transkrypcje są zatwierdzane:
Więcej informacji znajdziesz w Transcripts and commit strategies.
Pełny przykład
Oto pełny przykład komponentu React używającego hooka useScribe ze strategią zatwierdzania opartą na VAD: