Przedstawiamy Scribe v2
- Opublikowano
PosłuchajPosłuchaj tego artykułu
Scribe v2 stworzono do transkrypcji wsadowej, tworzenia napisów i podpisów na dużą skalę. Jest stabilniejszy i dokładniejszy niż Scribe v1, lepiej radzi sobie z długimi nagraniami, pauzami, zmianami tonu i długą ciszą.

Scribe v2 Realtime jest zoptymalizowany pod kątem ultraniskich opóźnień i zastosowań dla agentów, a Scribe v2 — pod kątem długich i złożonych nagrań. Zachowuje dokładność niezależnie od mówców, akcentów i stylów wypowiedzi. Dzięki temu zapewnia niezawodne transkrypcje w szerokim zakresie rzeczywistych warunków audio.
Scribe v2 osiąga najniższy współczynnik błędów słów w standardowych benchmarkach branżowych.

Keyterm Prompting: transkrypcja uwzględniająca kontekst
Keyterm Prompting wykracza poza standardowe Custom Vocabulary, bo uwzględnia kontekst transkrypcji. Wybierz do 100 słów lub fraz, a Scribe v2 precyzyjnie określi, kiedy je zapisać. To świetne rozwiązanie dla terminów technicznych, nazw marek i języka branżowego.

Wbudowane wykrywanie encji z dokładnymi znacznikami czasu
Scribe v2 oferuje natywne wykrywanie encji do uporządkowanej analizy audio.
Możesz wybrać do 56 kategorii, w tym dane umożliwiające identyfikację osoby, dane zdrowotne i informacje o płatnościach. Scribe v2 automatycznie wykryje te elementy oraz ich dokładne znaczniki czasu w transkrypcji, co ułatwia przeglądanie, redagowanie i przetwarzanie wrażliwych informacji na dużą skalę.
Dowiedz się więcej z dokumentacji API: https://elevenlabs.io/docs/developers/guides/cookbooks/speech-to-text/batch/entity-detection
Automatyczna transkrypcja w wielu językach
Scribe v2 obsługuje inteligentne workflow w wielu językach od razu po uruchomieniu.
Możesz przesłać jeden plik audio zawierający wiele języków. Model automatycznie rozpozna każdy z nich i poprawnie go transkrybuje — bez ręcznego dzielenia nagrania czy konfiguracji.
Dodatkowe funkcje dla workflow produkcyjnych
Scribe v2 oferuje funkcje dla firm i deweloperów:
- Inteligentna diarizacja mówców z czytelnym, intuicyjnym oznaczaniem osób
- Dokładne znaczniki czasu dla każdego słowa, które ułatwiają synchronizację napisów i tworzenie interaktywnych doświadczeń
- Dynamiczne tagowanie audio wykrywające zdarzenia pozamowne, takie jak śmiech czy kroki
- Gotowość dla firm: zgodność z SOC 2, ISO 27001, PCI DSS L1, HIPAA i RODO, rezydencja danych w UE i Indiach oraz obsługa trybu bez retencji danych
Scribe v2 już w ElevenLabs Studio
Scribe v2 jest teraz dostępny w ElevenLabs Studio, zapewniając dokładniejsze napisy, podpisy i transkrypcje. Wspiera zespoły zarządzające dużymi bibliotekami audio i wideo w marketingu, mediach, badaniach, szkoleniach i obszarze zgodności.

Wypróbuj teraz: https://elevenlabs.io/app/studio
Twórz z API
Dzięki Scribe v2 deweloperzy i firmy mogą automatyzować złożone procesy audio, zwiększać dokładność globalnych workflow treści i bezpiecznie skalować działania z pełną zgodnością oraz kontrolą rezydencji danych.

Scribe v2 jest już dostępny przez nasze API i platformę Creative.
Wypróbuj teraz: https://elevenlabs.io/app/speech-to-text
Przeczytaj dokumentację: https://elevenlabs.io/docs/capabilities/speech-to-text
Zarejestruj się tutaj: https://elevenlabs.io/speech-to-text




