Przedstawiamy Scribe v2
- Opublikowano
PosłuchajPosłuchaj tego artykułu
Scribe v2 stworzono do transkrypcji wsadowej, tworzenia napisów i podpisów na dużą skalę. Jest stabilniejszy i dokładniejszy niż Scribe v1, lepiej radzi sobie z długimi nagraniami, pauzami, zmianami tonu i długą ciszą.

Scribe v2 Realtime zoptymalizowano pod kątem bardzo niskich opóźnień i zastosowań agentów, a Scribe v2 — pod kątem długich i złożonych nagrań. Utrzymuje wysoką dokładność dla różnych mówców, akcentów i stylów wypowiedzi. Rezultat to niezawodne transkrypcje w szerokim zakresie rzeczywistych warunków audio.
Scribe v2 osiąga najniższy współczynnik błędów słów odnotowany w branżowych testach porównawczych.

Keyterm Prompting: transkrypcja uwzględniająca kontekst
Keyterm Prompting wykracza poza standardowe Custom Vocabulary, korzystając z kontekstu transkrypcji. Wybierz do 100 słów lub fraz, a Scribe v2 precyzyjnie określi, kiedy je zapisać. Dzięki temu świetnie sprawdza się w dziedzinach technicznych, przy nazwach marek i języku branżowym.

Wbudowane wykrywanie encji z dokładnymi znacznikami czasu
Scribe v2 oferuje natywne wykrywanie encji do uporządkowanej analizy audio.
Możesz wybrać do 56 kategorii obejmujących dane umożliwiające identyfikację osoby, dane zdrowotne i informacje o płatnościach. Scribe v2 automatycznie wykryje te dane oraz ich dokładne znaczniki czasu w transkrypcji, ułatwiając sprawdzanie, redagowanie i przetwarzanie wrażliwych informacji na dużą skalę.
Więcej w dokumentacji API: https://elevenlabs.io/docs/developers/guides/cookbooks/speech-to-text/batch/entity-detection
Automatyczna transkrypcja wielojęzyczna
Scribe v2 od razu obsługuje inteligentne workflow wielojęzyczne.
Możesz przesłać jeden plik audio zawierający wiele języków. Model automatycznie wykryje każdy z nich i poprawnie go transkrybuje — bez ręcznego dzielenia materiału ani konfiguracji.
Dodatkowe funkcje dla workflow produkcyjnych
Scribe v2 oferuje funkcje stworzone z myślą o firmach i deweloperach:
- Inteligentna diarizacja mówców zapewniająca jasne i intuicyjne oznaczanie mówców
- Dokładne znaczniki czasu na poziomie słów do precyzyjnego dopasowywania napisów i interaktywnych doświadczeń
- Dynamiczne tagowanie audio wykrywające zdarzenia inne niż mowa, takie jak śmiech czy kroki
- Gotowość dla firm: zgodność z SOC 2, ISO 27001, PCI DSS L1, HIPAA i RODO, przechowywanie danych w UE i Indiach oraz obsługa trybu bez retencji danych
Scribe v2 już w ElevenLabs Studio
Scribe v2 jest już używany w ElevenLabs Studio do dokładniejszego tworzenia napisów, podpisów i transkrypcji. Wspiera zespoły zarządzające dużymi bibliotekami audio i wideo w marketingu, mediach, badaniach, szkoleniach i obszarach zgodności.

Wypróbuj teraz: https://elevenlabs.io/app/studio
Twórz z API
Dzięki Scribe v2 deweloperzy i firmy mogą automatyzować złożone procesy audio, zwiększać dokładność w globalnych workflow treści i bezpiecznie skalować działania z pełną zgodnością oraz kontrolą lokalizacji danych.

Scribe v2 jest już dostępny przez nasze API i platformę Creative.
Wypróbuj teraz: https://elevenlabs.io/app/speech-to-text
Przeczytaj dokumentację: https://elevenlabs.io/docs/capabilities/speech-to-text
Zarejestruj się tutaj: https://elevenlabs.io/speech-to-text




