Hoppa till innehållet

Vi presenterar Scribe v2

Publicerad

LyssnaLyssna på den här artikeln

Scribe v2 är byggd för batchtranskribering, undertexter och bildtexter i stor skala. Den förbättrar stabiliteten och precisionen hos Scribe v1, med bättre hantering av långt ljudmaterial, pauser, tonlägesförändringar och längre tystnader.

Introducing Scribe v2

Medan Scribe v2 Realtime är optimerad för ultralåg latens och användningsfall för agenter är Scribe v2 optimerad för långa och komplexa inspelningar och bibehåller precisionen för olika talare, accenter och sätt att tala. Resultatet är konsekvent tillförlitliga transkriptioner under en mängd olika ljudförhållanden i verkligheten.


Scribe v2 uppnår den lägsta felkvoten för ord som har uppmätts i branschstandardiserade riktmärken.

Scribe v2 FLEURS benchmark

Keyterm Prompting för kontextmedveten transkribering

Keyterm Prompting går längre än standardfunktionen Custom Vocabulary genom att använda transkriptionens kontext. Välj upp till 100 ord eller fraser, så avgör Scribe v2 exakt när dessa termer ska transkriberas. Det gör funktionen väl lämpad för tekniska områden, varumärken och branschspecifikt språk.

Scribe v2 keyterm prompting

Inbyggd identifiering av entiteter med exakta tidsstämplar

Scribe v2 har inbyggd identifiering av entiteter för strukturerad ljudanalys.

Du kan välja upp till 56 kategorier inom personuppgifter, hälsodata eller betalningsuppgifter. Scribe v2 identifierar automatiskt dessa förekomster och deras exakta tidsstämplar i din transkription, vilket gör det enklare att granska, maskera eller bearbeta känslig information i stor skala.

Läs mer i API-dokumentationen: https://elevenlabs.io/docs/developers/guides/cookbooks/speech-to-text/batch/entity-detection

Automatisk transkribering på flera språk

Scribe v2 stöder smarta arbetsflöden för flera språk direkt.

Du kan skicka ljud som innehåller flera språk i en och samma fil. Modellen identifierar automatiskt varje språk och transkriberar det korrekt, utan manuell segmentering eller konfiguration.

Fler funktioner för produktionsarbetsflöden

Scribe v2 innehåller funktioner som är utformade för företag och utvecklare:

  • Smart talardiarisering för tydlig och intuitiv märkning av talare
  • Exakta tidsstämplar på ordnivå för korrekt synkronisering av undertexter och interaktiva upplevelser
  • Dynamisk ljudtaggning som identifierar händelser utan tal, till exempel skratt eller fotsteg
  • Redo för företag med efterlevnad av SOC 2, ISO 27001, PCI DSS L1, HIPAA och GDPR, dataresidens i EU och Indien samt stöd för nollagringsläge

Scribe v2, nu i ElevenLabs Studio

Scribe v2 används nu i ElevenLabs Studio för mer exakta undertexter, bildtexter och transkriptioner. Det hjälper team som hanterar stora bibliotek med ljud och video inom marknadsföring, media, forskning, utbildning och regelefterlevnad.

Scribe v2 in Studio

Prova nu: https://elevenlabs.io/app/studio

Bygg med API:t

Med Scribe v2 kan utvecklare och företag automatisera komplexa ljudflöden, förbättra precisionen i globala innehållsarbetsflöden och skala säkert med full efterlevnad och kontroll över dataresidens.

Scribe v2 Keyterm prompting code snippet

Scribe v2 finns tillgänglig i dag via vårt API och vår Creative-plattform.

Prova nu: https://elevenlabs.io/app/speech-to-text

Läs dokumentationen: https://elevenlabs.io/docs/capabilities/speech-to-text

Registrera dig här: https://elevenlabs.io/speech-to-text

Liknande artiklar

Skapa med AI-ljud av högsta kvalitet