Vi presenterar Scribe v2
- Publicerad
LyssnaLyssna på den här artikeln
Scribe v2 är byggd för batchtranskribering, undertexter och bildtexter i stor skala. Den förbättrar stabiliteten och precisionen hos Scribe v1, med bättre hantering av långt ljudmaterial, pauser, tonlägesförändringar och längre tystnader.

Medan Scribe v2 Realtime är optimerad för ultralåg latens och användningsfall för agenter är Scribe v2 optimerad för långa och komplexa inspelningar och bibehåller precisionen för olika talare, accenter och sätt att tala. Resultatet är konsekvent tillförlitliga transkriptioner under en mängd olika ljudförhållanden i verkligheten.
Scribe v2 uppnår den lägsta felkvoten för ord som har uppmätts i branschstandardiserade riktmärken.

Keyterm Prompting för kontextmedveten transkribering
Keyterm Prompting går längre än standardfunktionen Custom Vocabulary genom att använda transkriptionens kontext. Välj upp till 100 ord eller fraser, så avgör Scribe v2 exakt när dessa termer ska transkriberas. Det gör funktionen väl lämpad för tekniska områden, varumärken och branschspecifikt språk.

Inbyggd identifiering av entiteter med exakta tidsstämplar
Scribe v2 har inbyggd identifiering av entiteter för strukturerad ljudanalys.
Du kan välja upp till 56 kategorier inom personuppgifter, hälsodata eller betalningsuppgifter. Scribe v2 identifierar automatiskt dessa förekomster och deras exakta tidsstämplar i din transkription, vilket gör det enklare att granska, maskera eller bearbeta känslig information i stor skala.
Läs mer i API-dokumentationen: https://elevenlabs.io/docs/developers/guides/cookbooks/speech-to-text/batch/entity-detection
Automatisk transkribering på flera språk
Scribe v2 stöder smarta arbetsflöden för flera språk direkt.
Du kan skicka ljud som innehåller flera språk i en och samma fil. Modellen identifierar automatiskt varje språk och transkriberar det korrekt, utan manuell segmentering eller konfiguration.
Fler funktioner för produktionsarbetsflöden
Scribe v2 innehåller funktioner som är utformade för företag och utvecklare:
- Smart talardiarisering för tydlig och intuitiv märkning av talare
- Exakta tidsstämplar på ordnivå för korrekt synkronisering av undertexter och interaktiva upplevelser
- Dynamisk ljudtaggning som identifierar händelser utan tal, till exempel skratt eller fotsteg
- Redo för företag med efterlevnad av SOC 2, ISO 27001, PCI DSS L1, HIPAA och GDPR, dataresidens i EU och Indien samt stöd för nollagringsläge
Scribe v2, nu i ElevenLabs Studio
Scribe v2 används nu i ElevenLabs Studio för mer exakta undertexter, bildtexter och transkriptioner. Det hjälper team som hanterar stora bibliotek med ljud och video inom marknadsföring, media, forskning, utbildning och regelefterlevnad.

Prova nu: https://elevenlabs.io/app/studio
Bygg med API:t
Med Scribe v2 kan utvecklare och företag automatisera komplexa ljudflöden, förbättra precisionen i globala innehållsarbetsflöden och skala säkert med full efterlevnad och kontroll över dataresidens.

Scribe v2 finns tillgänglig i dag via vårt API och vår Creative-plattform.
Prova nu: https://elevenlabs.io/app/speech-to-text
Läs dokumentationen: https://elevenlabs.io/docs/capabilities/speech-to-text
Registrera dig här: https://elevenlabs.io/speech-to-text




