- Lovable
- Veed model
- Synthesia
- Stripe
- Perplexity
- Twilio
最高精度のリアルタイム文字起こし
Scribe v2 Realtimeは、厳しい音声環境や多様なアクセントでも約150msの低遅延で業界最高水準の文字起こし精度を実現します。
あらゆるシーンに対応
ノイズ環境やBGM、強いアクセント、低音質でも正確に文字起こし。
リアルタイム性能に特化した音声認識
Scribe v1を基盤にしたScribe v2 Realtimeは、アクセントや話し方、環境を問わず約150msの低遅延と高精度を実現。

Agentsや音声アプリ向けに最適化
Scribe v2 Realtimeは、会話型エージェントやミーティングアシスタント、音声アプリなど、スピードと精度が求められる開発者向けに設計されています。
低遅延を実現する予測型文字起こし
Scribe v2 Realtimeは、予測型文字起こしで次に来る単語や句読点を先読みし、リアルタイムで高精度な文字起こしを可能にします。
音声アクティビティ検出
音声の開始・終了を検出し、音声を正確に区切ることでスムーズかつ効率的なリアルタイム文字起こしを実現します。
手動コミットコントロール
デベロッパーが文字起こしの確定タイミングを自由にコントロール可能。カスタムストリーミングや精度調整に最適です。
複数のオーディオフォーマット対応
PCM(8~48kHz)やμ-lawエンコーディングに対応し、電話・ブラウザ・スタジオなど幅広い環境で利用できます。
あらゆる用途に最適化されたモデル
大量処理向けのScribe v2と、低遅延用途向けのScribe v2 Realtime
90以上の言語と多様なアクセントの音声を文字起こし
アクセントや方言、録音環境を問わず高い精度を実現します。
languageCodeを変更して各言語をプレビュー
import { useScribe } from "@elevenlabs/react";
const scribe = useScribe({
modelId: "scribe_v2_realtime",
languageCode: , // 言語を設定
onSessionStarted: () =>
console.log("Session started"),
onPartialTranscript: (data) =>
console.log("Partial:", data.text)
});世界をリードする企業やブランドに導入
ニーズに合わせた柔軟な料金プラン
スタートアップからエンタープライズチームまで拡張できる料金設計で、最高水準の精度と応答性を体験してください。
1時間あたり$0.28~
年間ビジネスプランの場合




