Poznaj Eleven v4Poznaj Eleven v4, nasz najbardziej emocjonalny model. 3× więcej kredytów w planie Creator+ do 12 października

Przejdź do treści

Przedstawiamy Scribe v2

Opublikowano

PosłuchajPosłuchaj tego artykułu

Scribe v2 stworzono do transkrypcji wsadowej, tworzenia napisów i podpisów na dużą skalę. Jest stabilniejszy i dokładniejszy niż Scribe v1, lepiej radzi sobie z długimi nagraniami, pauzami, zmianami tonu i długą ciszą.

Introducing Scribe v2

Scribe v2 Realtime zoptymalizowano pod kątem bardzo niskich opóźnień i zastosowań agentów, a Scribe v2 — pod kątem długich i złożonych nagrań. Utrzymuje wysoką dokładność dla różnych mówców, akcentów i stylów wypowiedzi. Rezultat to niezawodne transkrypcje w szerokim zakresie rzeczywistych warunków audio.


Scribe v2 osiąga najniższy współczynnik błędów słów odnotowany w branżowych testach porównawczych.

Scribe v2 FLEURS benchmark

Keyterm Prompting: transkrypcja uwzględniająca kontekst

Keyterm Prompting wykracza poza standardowe Custom Vocabulary, korzystając z kontekstu transkrypcji. Wybierz do 100 słów lub fraz, a Scribe v2 precyzyjnie określi, kiedy je zapisać. Dzięki temu świetnie sprawdza się w dziedzinach technicznych, przy nazwach marek i języku branżowym.

Scribe v2 keyterm prompting

Wbudowane wykrywanie encji z dokładnymi znacznikami czasu

Scribe v2 oferuje natywne wykrywanie encji do uporządkowanej analizy audio.

Możesz wybrać do 56 kategorii obejmujących dane umożliwiające identyfikację osoby, dane zdrowotne i informacje o płatnościach. Scribe v2 automatycznie wykryje te dane oraz ich dokładne znaczniki czasu w transkrypcji, ułatwiając sprawdzanie, redagowanie i przetwarzanie wrażliwych informacji na dużą skalę.

Więcej w dokumentacji API: https://elevenlabs.io/docs/developers/guides/cookbooks/speech-to-text/batch/entity-detection

Automatyczna transkrypcja wielojęzyczna

Scribe v2 od razu obsługuje inteligentne workflow wielojęzyczne.

Możesz przesłać jeden plik audio zawierający wiele języków. Model automatycznie wykryje każdy z nich i poprawnie go transkrybuje — bez ręcznego dzielenia materiału ani konfiguracji.

Dodatkowe funkcje dla workflow produkcyjnych

Scribe v2 oferuje funkcje stworzone z myślą o firmach i deweloperach:

  • Inteligentna diarizacja mówców zapewniająca jasne i intuicyjne oznaczanie mówców
  • Dokładne znaczniki czasu na poziomie słów do precyzyjnego dopasowywania napisów i interaktywnych doświadczeń
  • Dynamiczne tagowanie audio wykrywające zdarzenia inne niż mowa, takie jak śmiech czy kroki
  • Gotowość dla firm: zgodność z SOC 2, ISO 27001, PCI DSS L1, HIPAA i RODO, przechowywanie danych w UE i Indiach oraz obsługa trybu bez retencji danych

Scribe v2 już w ElevenLabs Studio

Scribe v2 jest już używany w ElevenLabs Studio do dokładniejszego tworzenia napisów, podpisów i transkrypcji. Wspiera zespoły zarządzające dużymi bibliotekami audio i wideo w marketingu, mediach, badaniach, szkoleniach i obszarach zgodności.

Scribe v2 in Studio

Wypróbuj teraz: https://elevenlabs.io/app/studio

Twórz z API

Dzięki Scribe v2 deweloperzy i firmy mogą automatyzować złożone procesy audio, zwiększać dokładność w globalnych workflow treści i bezpiecznie skalować działania z pełną zgodnością oraz kontrolą lokalizacji danych.

Scribe v2 Keyterm prompting code snippet

Scribe v2 jest już dostępny przez nasze API i platformę Creative.

Wypróbuj teraz: https://elevenlabs.io/app/speech-to-text

Przeczytaj dokumentację: https://elevenlabs.io/docs/capabilities/speech-to-text

Zarejestruj się tutaj: https://elevenlabs.io/speech-to-text

Podobne artykuły

Twórz z najwyższej jakości audio AI