Zum Inhalt springen

Scribe v2 vorgestellt

Veröffentlicht

AnhörenArtikel anhören

Scribe v2 wurde für Batch-Transkription, Untertitel und Captions in großem Maßstab entwickelt. Es verbessert die Stabilität und Genauigkeit von Scribe v1 und verarbeitet lange Audioinhalte, Pausen, Tonwechsel und längere Stille zuverlässiger.

Introducing Scribe v2

Während Scribe v2 Realtime für extrem niedrige Latenz und Agenten-Anwendungsfälle optimiert ist, wurde Scribe v2 für lange und komplexe Aufnahmen entwickelt. Es bleibt bei unterschiedlichen Sprechern, Akzenten und Sprechweisen präzise. Das Ergebnis sind zuverlässig konsistente Transkripte unter verschiedensten realen Audiobedingungen.


Scribe v2 erreicht die niedrigste Wortfehlerrate, die je in branchenüblichen Benchmarks gemessen wurde.

Scribe v2 FLEURS benchmark

Keyterm Prompting für kontextbasierte Transkription

Keyterm Prompting nutzt den Kontext des Transkripts und geht damit über Standard Custom Vocabulary hinaus. Wählen Sie bis zu 100 Wörter oder Phrasen aus. Scribe v2 entscheidet präzise, wann diese Begriffe transkribiert werden. Das eignet sich besonders für technische Fachgebiete, Markennamen und branchenspezifische Sprache.

Scribe v2 keyterm prompting

Integrierte Entitätserkennung mit präzisen Zeitstempeln

Scribe v2 bietet native Entitätserkennung für strukturierte Audioanalysen.

Sie können bis zu 56 Kategorien für personenbezogene Daten, Gesundheitsdaten oder Zahlungsdetails auswählen. Scribe v2 erkennt diese Angaben und ihre exakten Zeitstempel automatisch im Transkript. So können Sie sensible Informationen einfacher prüfen, schwärzen oder in großem Maßstab verarbeiten.

Mehr dazu in der API-Dokumentation: https://elevenlabs.io/docs/developers/guides/cookbooks/speech-to-text/batch/entity-detection

Automatische Transkription mehrsprachiger Audiodateien

Scribe v2 unterstützt intelligente mehrsprachige Workflows direkt ab Werk.

Sie können Audiodateien mit mehreren Sprachen in einer einzigen Datei senden. Das Modell erkennt jede Sprache automatisch und transkribiert sie korrekt – ohne manuelle Segmentierung oder Konfiguration.

Weitere Funktionen für Produktions-Workflows

Scribe v2 umfasst Funktionen für Unternehmen und Entwickler:

  • Intelligente Sprecherdiarisierung für klare, intuitive Sprecherkennzeichnungen
  • Präzise Zeitstempel auf Wortebene für genaue Untertitelausrichtung und interaktive Erlebnisse
  • Dynamische Audio-Tagging-Funktion zur Erkennung nichtsprachlicher Ereignisse wie Lachen oder Schritte
  • Bereit für Unternehmen: Konformität mit SOC 2, ISO 27001, PCI DSS L1, HIPAA und DSGVO, Datenresidenz in der EU und Indien sowie Unterstützung für den Zero-Retention-Modus

Scribe v2, jetzt in ElevenLabs Studio

Scribe v2 wird jetzt in ElevenLabs Studio für präzisere Untertitel, Captions und Transkriptionen eingesetzt. Es unterstützt Teams, die große Audio- und Videobibliotheken für Marketing, Medien, Forschung, Schulungen und Compliance verwalten.

Scribe v2 in Studio

Jetzt testen: https://elevenlabs.io/app/studio

Mit der API entwickeln

Mit Scribe v2 können Entwickler und Unternehmen komplexe Audio-Pipelines automatisieren, die Genauigkeit globaler Content-Workflows verbessern und sicher skalieren – mit umfassenden Compliance- und Datenresidenzkontrollen.

Scribe v2 Keyterm prompting code snippet

Scribe v2 ist ab heute über unsere API und Creative-Plattform verfügbar.

Jetzt testen: https://elevenlabs.io/app/speech-to-text

Dokumentation lesen: https://elevenlabs.io/docs/capabilities/speech-to-text

Hier registrieren: https://elevenlabs.io/speech-to-text

Ähnliche Artikel

Erstellen Sie mit hochwertiger KI-Audio