スピーチtoテキスト クイックスタート
スピーチtoテキスト クイックスタート
話されたオーディオをテキストに変換する方法を学びましょう。
このガイドでは、スピーチtoテキストAPIを使用して音声をテキストに変換する方法を説明します。
ElevenLabs speech-to-text skillを使用すると、AIコーディングアシスタントから音声を文字起こしできます。
このチュートリアルでは、バッチスピーチtoテキストAPIの使用方法を紹介します。リアルタイムスピーチtoテキストAPIの使用方法については、 クライアントサイドストリーミングまたは サーバーサイドストリーミングのガイドを参照してください。
スピーチtoテキストAPIを使用する
APIキーを作成する
ダッシュボードでAPIキーを作成し、安全にAPIへアクセスするために使用します。
キーは管理されたシークレットとして保存し、好みに応じて.envファイルによる環境変数として、またはアプリの設定で直接SDKに渡してください。
.env
APIリクエストを送信する
SDK
CLI
使用する言語に応じて、example.pyまたはexample.mtsという新しいファイルを作成し、次のコードを追加します。
次に、実行します。
コンソールに音声ファイルの文字起こしが出力されます。
医療・臨床音声では、model_idをscribe_v2_medicalに設定してください。リクエスト形式はscribe_v2と同じで、料金も同額です。Scribe v2
Medicalを参照してください。