ElevenLabs MCPのご紹介
- 執筆者
- Louis Jordan
- 公開日
聴くこの記事を聴く
2026年8月17日更新:以下の記事では、初代ElevenLabs MCPのインテグレーションについて説明しています。その後、より高いセキュリティ、簡単な統合、使いやすさを実現するElevenLabsホストの新しいMCPサーバーをリリースしました。詳細はこちらをご覧ください。新しいElevenLabsホストMCPは、Claudeコネクターディレクトリからインストールできます。
はじめに
ランチを注文してくれる音声エージェントを作ってみたいと思ったことはありませんか?会議を文字起こししてくれるエージェントはどうでしょう?あるいは、自分の声でメールを読み上げてくれるエージェントは?公式のElevenLabs Model Context Protocol(MCP)サーバーなら、今すぐ実現できます。
MCPサーバーを使えば、ローカルツールを通じてAIタスクをオーケストレーションできます。Claude、Cursor、カスタムスクリプトのどれを使う場合でも、会話型AI音声エージェントの構築、アウトバウンド通話、音声の文字起こし、オーディオの生成を、すべてシンプルなAPI呼び出しで行えます。
この記事では、GitHubリポジトリを使ってMCPサーバーを始める方法と、セットアップ後にできることの例をいくつか紹介します。
Introducing the official ElevenLabs MCP server.
— ElevenLabs (@elevenlabsio) April 7, 2025
Give Claude and Cursor access to the entire ElevenLabs AI audio platform via simple text prompts.
You can even spin up voice agents to perform outbound calls for you — like ordering pizza. pic.twitter.com/H0OttYgXZn
Some examples:
— ElevenLabs (@elevenlabsio) April 7, 2025
- Text to Speech: Read aloud content or create audiobooks.
- Speech to Text: Transcribe audio and video into text.
- Voice Designer: Create custom AI voices.
- Conversational AI: Build dynamic voice agents and make outbound calls. pic.twitter.com/dObTzlliZ7
ElevenLabs MCPサーバーとは?
ElevenLabs MCPサーバーは、大規模言語モデルにコンテキストを提供し、ElevenLabs AIオーディオプラットフォーム全体へアクセスできるようにするElevenLabs APIの抽象化レイヤーです。リクエストをElevenLabsのクラウドAPIへ転送する、デベロッパー向けのローカルインターフェースとして機能します。音声を生成したいですか?声をクローンしたいですか?ファイルからオーディオを文字起こししたいですか?MCPサーバーはマシン上で直接動作し、必要な機能をすべて手元で使えるようにします。
MCPサーバーは、Claude Desktop、Cursor、その他のAIネイティブな開発環境と完全に互換性があります。音声エージェントを起動し、システムプロンプトで動作を定義して、アウトバウンド通話を実行できます。すべてIDEやAIアシスタント内で完結します。
サーバーはローカルで動作し、マシン上のワークフローを管理します。同時に、ElevenLabsのクラウドAPIと安全に通信し、オーディオ生成、ボイスクローン、文字起こしを実行します。そのため、実験的な機能のテストにも最適です。データ、フロー、体験は自分で管理できます。接続して、すぐに開発を始めましょう。
インストール後は、ElevenLabs MCPサーバーを使って、話し、聞き、理解する実用的なアプリケーションを構築できます。シンプルなプロンプトとAPI呼び出しで、ElevenLabs AIオーディオプラットフォームのすべての機能を活用できます。たとえば、MCPサーバーを使えば、ピザの注文、予約、見込み客へのフォローアップなどのアウトバウンド通話を行う音声エージェントを作成できます。
ほかにも、次のようなユースケースが考えられます。
- 「フィルム・ノワールの探偵のように話し、クラシック映画に関する質問に答えられるAIエージェントを作成して」
- 「賢く古代から生きるドラゴンのキャラクター向けに、3種類の音声バリエーションを生成して。お気に入りの声を選んでボイスライブラリに追加する」
- 「この自分の声の録音を、中世の騎士のような声に変換して」
- 「密林の中で雷雨が起こり、動物たちが天候に反応するサウンドスケープを作成して」
- 「この音声をテキストに変換し、話者を識別してから、それぞれに固有の声を使って再び音声に変換して」
ElevenLabs MCPサーバーの始め方

公式ElevenLabs MCPサーバーは、数分でセットアップして使い始められます。音声エージェントを構築する場合も、ローカルでオーディオ処理ツールをテストする場合も、以下の手順で始められます。
- ElevenLabsアカウントに登録:登録して、無料または有料アカウントを作成します。テキスト読み上げ、ボイスクローン、オーディオ文字起こしのツールを含む、ElevenLabs AIオーディオプラットフォーム全体を利用できます。テキスト読み上げ、ボイスクローン、オーディオ文字起こし。
- APIキーを生成:ログイン後、アカウント設定に移動して新しいAPIキーを生成します。ローカルMCPサーバーからElevenLabsのサービスへのリクエストを認証するために必要です。
- 公式MCPサーバーリポジトリをクローン:公式ElevenLabs MCP GitHubリポジトリにアクセスし、ローカルマシンにクローンします。このリポジトリには、サーバーをローカルで実行して実験を始めるために必要なものがすべて含まれています。
- 依存関係をインストール:リポジトリのREADMEにあるインストールガイドに従ってください。必要なPythonパッケージのインストールとランタイム環境の設定を行います。APIキーとデフォルト設定用の環境変数の構成も必要になる場合があります。
- MCPサーバーをローカルで実行:すべてのインストールが完了したら、用意されているCLIコマンドでサーバーを起動します。MCPサーバーが立ち上がり、オーディオ生成、音声文字起こし、会話型AIのエンドポイントを公開します。
- Claude、Cursor、またはCLIで接続:Claude DesktopやCursorなどのツールを接続し、コマンドラインプロンプトまたはHTTP呼び出しでMCPサーバーとやり取りします。AIアシスタントとElevenLabsプラットフォームの間で、シームレスなワークフローを実現できます。エージェントを起動して、「ピザを注文して」や「このPDFを読み上げて」といったプロンプトを出してみましょう。
- 実験して構築:サーバーの起動後は、ローカル環境からオーディオ生成、ボイスクローン、ファイルの文字起こし、アウトバウンド通話を行う音声エージェントの作成ができます。リポジトリに用意されている例を使うか、独自のワークフローを構築してみましょう。
まとめ
公式ElevenLabs MCPサーバーは、音声AIに取り組むデベロッパーにとっての転換点です。初めて、ローカルマシンからオーケストレーションされたElevenLabs AIオーディオプラットフォームの全機能にアクセスできます。
制限されたワークフローはもう必要ありません。Claude DesktopやCursorなど、お気に入りの開発環境とシームレスに統合する、高速で柔軟かつフル機能のオーディオツールを利用できます。
次世代の音声エージェントを構築する場合も、最先端のオーディオ処理を試してみたい場合も、MCPサーバーなら自由に創作できます。素晴らしいものを作る準備はできていますか?
登録して、今すぐElevenLabsを始めましょう。




