Poznaj Eleven v4Poznaj Eleven v4, nasz najbardziej emocjonalny model. 3× więcej kredytów w planie Creator+ do 12 października

Przejdź do treści

Scribe v2 właśnie dostał aktualizację

Opublikowano

PosłuchajPosłuchaj tego artykułu

Wprowadzamy wbudowane maskowanie encji, lepszą transkrypcję mieszanego języka indyjskiego i angielskiego, nowy tryb No Verbatim oraz obsługę do 1000 kluczowych terminów.

Te ulepszenia dają deweloperom większą kontrolę nad prywatnością, dokładnością w wielu językach, jakością transkrypcji i precyzją w konkretnych branżach.

Nowe maskowanie encji w Scribe v2

Scribe v2 automatycznie wykrywa i maskuje w transkrypcjach wrażliwe encje, w tym imiona i nazwiska, numery kart kredytowych, numery ubezpieczenia społecznego i inne dane umożliwiające identyfikację.

Maskowanie odbywa się podczas transkrypcji. Wrażliwe dane są usuwane, zanim trafią do twojego magazynu danych lub systemów przetwarzających je dalej.

  • Pełne maskowanie: zastępuje encje symbolem [REDACTED];
  • Według kategorii: zastępuje typem encji, np. [CREDIT_CARD];
  • Numerowane: zastępuje etykietą z kategorią i numerem, np. [CREDIT_CARD_1].

Ułatwia to zespołom udostępnianie transkrypcji i wspiera workflow związane z obsługą danych w takich obszarach jak opieka zdrowotna, finanse i obsługa klienta.

Uwaga: maskowanie jest automatyczne i może nie wykryć ani nie usunąć wszystkich wrażliwych informacji. Sprawdź wyniki, zanim na nich polegasz.

Dokładne przełączanie między językami indyjskimi a angielskim

W całych Indiach ludzie często mieszają angielski z hindi, telugu, kannada i innymi językami indyjskimi. Wiele systemów transkrypcji transliteruje angielskie słowa na pisma indyjskie, przez co transkrypcje nie odzwierciedlają prawdziwego sposobu komunikacji.

Scribe v2 zapisuje angielskie słowa po angielsku, niezależnie od języka otoczenia. Działa to automatycznie, bez konfiguracji języka. Niezależnie od tego, czy podasz kod angielskiego, hindi czy żadnego języka, angielskie słowa pozostaną w alfabecie łacińskim.

Dotyczy to wszystkich języków indyjskich, nie tylko połączenia hindi i angielskiego. Jeśli osoba mówiąca przełącza się między telugu a angielskim lub kannada a angielskim, angielskie fragmenty są transkrybowane poprawnie.

Tryb No Verbatim dla czystych transkrypcji

Wprowadzamy tryb No Verbatim — ustawienie transkrypcji, które automatycznie usuwa słowa wypełniające, takie jak „um” i „uh”, a także powtórzenia i jąkanie.

Efektem jest czysta, czytelna transkrypcja bez ręcznej edycji i postprodukcji.

Tryb No Verbatim dobrze sprawdza się w notatkach ze spotkań, napisach i każdym workflow, w którym liczy się dopracowany zapis, a nie surowe uchwycenie każdego dźwięku.

Promptowanie kluczowymi terminami rozszerzone do 1000

Promptowanie kluczowymi terminami obsługuje teraz do 1000 słów i fraz na transkrypcję — wcześniej limit wynosił 100.

Daje to zespołom pracującym z dużym słownictwem technicznym, katalogami produktów lub terminologią branżową więcej możliwości, by pomóc modelowi tworzyć dokładne transkrypcje.

Promptowanie kluczowymi terminami nadal uwzględnia kontekst. Model analizuje otaczające audio, by ustalić, czy dany termin ma zastosowanie, zamiast wstawiać go bezrefleksyjnie. Limit 1000 terminów oznacza 10 razy większą pojemność niż wcześniej.

Uwaga: dla żądań z ponad 100 kluczowymi terminami minimalna jednostka rozliczeniowa wynosi 20 sekund.

Dostępne już teraz

Te funkcje są już dostępne w API i interfejsie Scribe v2.

Przeczytaj dokumentację:
https://elevenlabs.io/docs/cookbooks/speech-to-text/quickstart

Wypróbuj w aplikacji:
https://elevenlabs.io/app/speech-to-text

Podobne artykuły

Twórz z najwyższej jakości audio AI