Zum Inhalt springen

Scribe v2 vorgestellt

Veröffentlicht

AnhörenArtikel anhören

Scribe v2 ist für Batch-Transkription, Untertitel und Closed Captions im großen Maßstab entwickelt. Es verbessert die Stabilität und Genauigkeit von Scribe v1 und verarbeitet lange Audioinhalte, Pausen, Tonwechsel und längere Stille besser.

Introducing Scribe v2

Während Scribe v2 Realtime für extrem niedrige Latenz und Agenten-Anwendungsfälle optimiert ist, ist Scribe v2 für lange und komplexe Aufnahmen ausgelegt. Es behält die Genauigkeit über verschiedene Sprecher, Akzente und Sprechstile hinweg bei. Das Ergebnis sind durchgehend zuverlässige Transkripte unter unterschiedlichsten realen Audiobedingungen.


Scribe v2 erzielt die niedrigste Wortfehlerrate, die bisher in branchenüblichen Benchmarks gemessen wurde.

Scribe v2 FLEURS benchmark

Keyterm Prompting für kontextbasierte Transkription

Keyterm Prompting geht über das standardmäßige Custom Vocabulary hinaus und nutzt den Kontext des Transkripts. Wählen Sie bis zu 100 Wörter oder Begriffe aus, und Scribe v2 entscheidet präzise, wann diese transkribiert werden sollen. Damit eignet es sich besonders für technische Fachgebiete, Markennamen und branchenspezifische Sprache.

Scribe v2 keyterm prompting

Integrierte Entitätserkennung mit präzisen Zeitstempeln

Scribe v2 umfasst eine native Entitätserkennung für strukturierte Audioanalysen.

Sie können bis zu 56 Kategorien aus den Bereichen personenbezogene Daten, Gesundheitsdaten und Zahlungsinformationen auswählen. Scribe v2 erkennt diese Instanzen und ihre exakten Zeitstempel in Ihrem Transkript automatisch. So können Sie sensible Informationen im großen Maßstab einfacher prüfen, schwärzen oder verarbeiten.

Mehr erfahren Sie in der API-Dokumentation: https://elevenlabs.io/docs/developers/guides/cookbooks/speech-to-text/batch/entity-detection

Automatische mehrsprachige Transkription

Scribe v2 unterstützt intelligente mehrsprachige Workflows ohne zusätzliche Einrichtung.

Sie können eine einzelne Audiodatei mit mehreren Sprachen senden. Das Modell erkennt jede Sprache automatisch und transkribiert sie korrekt – ohne manuelle Segmentierung oder Konfiguration.

Zusätzliche Funktionen für Produktions-Workflows

Scribe v2 umfasst Funktionen für Unternehmens- und Entwickleranwendungsfälle:

  • Intelligente Sprecherdiarisierung für klare, intuitive Sprecherkennzeichnung
  • Präzise Zeitstempel auf Wortebene für genaue Untertitelausrichtung und interaktive Erlebnisse
  • Dynamisches Audio-Tagging, das nichtsprachliche Ereignisse wie Lachen oder Schritte erkennt
  • Unternehmenstauglich durch Konformität mit SOC 2, ISO 27001, PCI DSS L1, HIPAA und DSGVO, Datenresidenz in der EU und Indien sowie Unterstützung für den Zero-Retention-Modus

Scribe v2 jetzt in ElevenLabs Studio

Scribe v2 wird jetzt in ElevenLabs Studio für präzisere Untertitel, Closed Captions und Transkriptionen eingesetzt. Es unterstützt Teams, die große Audio- und Videobibliotheken für Marketing, Medien, Forschung, Schulungen und Compliance verwalten.

Scribe v2 in Studio

Jetzt testen: https://elevenlabs.io/app/studio

Mit der API entwickeln

Mit Scribe v2 können Entwickler und Unternehmen komplexe Audio-Pipelines automatisieren, die Genauigkeit globaler Content-Workflows verbessern und sicher unter vollständiger Einhaltung von Compliance- und Datenresidenzvorgaben skalieren.

Scribe v2 Keyterm prompting code snippet

Scribe v2 ist ab heute über unsere API und Creative-Plattform verfügbar.

Jetzt testen: https://elevenlabs.io/app/speech-to-text

Dokumentation lesen: https://elevenlabs.io/docs/capabilities/speech-to-text

Hier registrieren: https://elevenlabs.io/speech-to-text

Ähnliche Artikel

Erstellen Sie mit hochwertiger KI-Audio