Przejdź do treści

Przedstawiamy Scribe v2

Opublikowano

PosłuchajPosłuchaj tego artykułu

Scribe v2 stworzono do transkrypcji wsadowej, tworzenia napisów i podpisów na dużą skalę. Jest stabilniejszy i dokładniejszy niż Scribe v1, lepiej radzi sobie z długimi nagraniami, pauzami, zmianami tonu i długą ciszą.

Introducing Scribe v2

Scribe v2 Realtime jest zoptymalizowany pod kątem ultraniskich opóźnień i zastosowań dla agentów, a Scribe v2 — pod kątem długich i złożonych nagrań. Zachowuje dokładność niezależnie od mówców, akcentów i stylów wypowiedzi. Dzięki temu zapewnia niezawodne transkrypcje w szerokim zakresie rzeczywistych warunków audio.


Scribe v2 osiąga najniższy współczynnik błędów słów w standardowych benchmarkach branżowych.

Scribe v2 FLEURS benchmark

Keyterm Prompting: transkrypcja uwzględniająca kontekst

Keyterm Prompting wykracza poza standardowe Custom Vocabulary, bo uwzględnia kontekst transkrypcji. Wybierz do 100 słów lub fraz, a Scribe v2 precyzyjnie określi, kiedy je zapisać. To świetne rozwiązanie dla terminów technicznych, nazw marek i języka branżowego.

Scribe v2 keyterm prompting

Wbudowane wykrywanie encji z dokładnymi znacznikami czasu

Scribe v2 oferuje natywne wykrywanie encji do uporządkowanej analizy audio.

Możesz wybrać do 56 kategorii, w tym dane umożliwiające identyfikację osoby, dane zdrowotne i informacje o płatnościach. Scribe v2 automatycznie wykryje te elementy oraz ich dokładne znaczniki czasu w transkrypcji, co ułatwia przeglądanie, redagowanie i przetwarzanie wrażliwych informacji na dużą skalę.

Dowiedz się więcej z dokumentacji API: https://elevenlabs.io/docs/developers/guides/cookbooks/speech-to-text/batch/entity-detection

Automatyczna transkrypcja w wielu językach

Scribe v2 obsługuje inteligentne workflow w wielu językach od razu po uruchomieniu.

Możesz przesłać jeden plik audio zawierający wiele języków. Model automatycznie rozpozna każdy z nich i poprawnie go transkrybuje — bez ręcznego dzielenia nagrania czy konfiguracji.

Dodatkowe funkcje dla workflow produkcyjnych

Scribe v2 oferuje funkcje dla firm i deweloperów:

  • Inteligentna diarizacja mówców z czytelnym, intuicyjnym oznaczaniem osób
  • Dokładne znaczniki czasu dla każdego słowa, które ułatwiają synchronizację napisów i tworzenie interaktywnych doświadczeń
  • Dynamiczne tagowanie audio wykrywające zdarzenia pozamowne, takie jak śmiech czy kroki
  • Gotowość dla firm: zgodność z SOC 2, ISO 27001, PCI DSS L1, HIPAA i RODO, rezydencja danych w UE i Indiach oraz obsługa trybu bez retencji danych

Scribe v2 już w ElevenLabs Studio

Scribe v2 jest teraz dostępny w ElevenLabs Studio, zapewniając dokładniejsze napisy, podpisy i transkrypcje. Wspiera zespoły zarządzające dużymi bibliotekami audio i wideo w marketingu, mediach, badaniach, szkoleniach i obszarze zgodności.

Scribe v2 in Studio

Wypróbuj teraz: https://elevenlabs.io/app/studio

Twórz z API

Dzięki Scribe v2 deweloperzy i firmy mogą automatyzować złożone procesy audio, zwiększać dokładność globalnych workflow treści i bezpiecznie skalować działania z pełną zgodnością oraz kontrolą rezydencji danych.

Scribe v2 Keyterm prompting code snippet

Scribe v2 jest już dostępny przez nasze API i platformę Creative.

Wypróbuj teraz: https://elevenlabs.io/app/speech-to-text

Przeczytaj dokumentację: https://elevenlabs.io/docs/capabilities/speech-to-text

Zarejestruj się tutaj: https://elevenlabs.io/speech-to-text

Podobne artykuły

Twórz z najwyższej jakości audio AI