Scribe v2 vorgestellt
- Veröffentlicht
AnhörenArtikel anhören
Scribe v2 wurde für Batch-Transkription, Untertitel und Captions in großem Maßstab entwickelt. Es verbessert die Stabilität und Genauigkeit von Scribe v1 und verarbeitet lange Audioinhalte, Pausen, Tonwechsel und längere Stille zuverlässiger.

Während Scribe v2 Realtime für extrem niedrige Latenz und Agenten-Anwendungsfälle optimiert ist, wurde Scribe v2 für lange und komplexe Aufnahmen entwickelt. Es bleibt bei unterschiedlichen Sprechern, Akzenten und Sprechweisen präzise. Das Ergebnis sind zuverlässig konsistente Transkripte unter verschiedensten realen Audiobedingungen.
Scribe v2 erreicht die niedrigste Wortfehlerrate, die je in branchenüblichen Benchmarks gemessen wurde.

Keyterm Prompting für kontextbasierte Transkription
Keyterm Prompting nutzt den Kontext des Transkripts und geht damit über Standard Custom Vocabulary hinaus. Wählen Sie bis zu 100 Wörter oder Phrasen aus. Scribe v2 entscheidet präzise, wann diese Begriffe transkribiert werden. Das eignet sich besonders für technische Fachgebiete, Markennamen und branchenspezifische Sprache.

Integrierte Entitätserkennung mit präzisen Zeitstempeln
Scribe v2 bietet native Entitätserkennung für strukturierte Audioanalysen.
Sie können bis zu 56 Kategorien für personenbezogene Daten, Gesundheitsdaten oder Zahlungsdetails auswählen. Scribe v2 erkennt diese Angaben und ihre exakten Zeitstempel automatisch im Transkript. So können Sie sensible Informationen einfacher prüfen, schwärzen oder in großem Maßstab verarbeiten.
Mehr dazu in der API-Dokumentation: https://elevenlabs.io/docs/developers/guides/cookbooks/speech-to-text/batch/entity-detection
Automatische Transkription mehrsprachiger Audiodateien
Scribe v2 unterstützt intelligente mehrsprachige Workflows direkt ab Werk.
Sie können Audiodateien mit mehreren Sprachen in einer einzigen Datei senden. Das Modell erkennt jede Sprache automatisch und transkribiert sie korrekt – ohne manuelle Segmentierung oder Konfiguration.
Weitere Funktionen für Produktions-Workflows
Scribe v2 umfasst Funktionen für Unternehmen und Entwickler:
- Intelligente Sprecherdiarisierung für klare, intuitive Sprecherkennzeichnungen
- Präzise Zeitstempel auf Wortebene für genaue Untertitelausrichtung und interaktive Erlebnisse
- Dynamische Audio-Tagging-Funktion zur Erkennung nichtsprachlicher Ereignisse wie Lachen oder Schritte
- Bereit für Unternehmen: Konformität mit SOC 2, ISO 27001, PCI DSS L1, HIPAA und DSGVO, Datenresidenz in der EU und Indien sowie Unterstützung für den Zero-Retention-Modus
Scribe v2, jetzt in ElevenLabs Studio
Scribe v2 wird jetzt in ElevenLabs Studio für präzisere Untertitel, Captions und Transkriptionen eingesetzt. Es unterstützt Teams, die große Audio- und Videobibliotheken für Marketing, Medien, Forschung, Schulungen und Compliance verwalten.

Jetzt testen: https://elevenlabs.io/app/studio
Mit der API entwickeln
Mit Scribe v2 können Entwickler und Unternehmen komplexe Audio-Pipelines automatisieren, die Genauigkeit globaler Content-Workflows verbessern und sicher skalieren – mit umfassenden Compliance- und Datenresidenzkontrollen.

Scribe v2 ist ab heute über unsere API und Creative-Plattform verfügbar.
Jetzt testen: https://elevenlabs.io/app/speech-to-text
Dokumentation lesen: https://elevenlabs.io/docs/capabilities/speech-to-text
Hier registrieren: https://elevenlabs.io/speech-to-text


