Elevenミュージック

ElevenLabsで、自然言語プロンプトを使ってあらゆるスタイルのスタジオ品質の音楽を作成する方法を学びましょう。

概要

Elevenミュージックは、自然言語のプロンプトであらゆるスタイルのスタジオ品質の音楽を生成するテキストto音楽モデルです。意図を理解し、目的に基づいてコンテキストを認識した完全なオーディオを生成するよう設計されています。このモデルは自然言語と音楽用語の両方を理解し、最先端の機能を提供します。

  • ジャンル、スタイル、構成を完全にコントロール
  • ボーカルあり、またはインストゥルメンタルのみ
  • 英語、スペイン語、ドイツ語、日本語などを含む多言語対応
  • 個別セクションまたは曲全体のサウンドと歌詞を編集

サンプルをお聞きください。

レーベル、出版社、アーティストとの協力により制作されたElevenミュージックは、映画やテレビからポッドキャスト、SNSビデオ、広告、ゲームまで、ほぼすべての商用利用が許諾されています。各プランでサポートされる利用方法の詳細は、音楽利用規約をご覧ください。

オーディオ参照

オーディオ参照では、短いオーディオトラックをアップロードして、新しいMusic v2またはv2.5生成のスタイルやサウンドを誘導できます。これにより、テキストプロンプトに加えて、モデルにクリエイティブな参照を提供できます。

オーディオ参照を使用するには、Music>Generationsに移動し、Promptセクションの**+ Reference**ボタンでオーディオ参照を追加します。

一般的に使用されるオーディオ形式で、最大約30秒の参照トラックをアップロードできます。アップロードされたすべての参照は、使用前に著作権コンプライアンスの審査を受けます。

オーディオ参照は、生成されるトラックの全体的なサウンド、プロダクションスタイル、楽器編成、テンポ、ムードなどの特性に影響を与えます。アップロードしたオーディオをコピーまたはリミックスするものではなく、結果は新たに生成された楽曲です。

オーディオ参照は、類似したスタイルやサウンドへと生成を導くことを目的としています。ジャンル変換向けには 設計されていません。たとえば、ジャズトラックをアップロードしてラップ バージョンをリクエストしても、信頼性の高い結果が得られない場合があります。

オーディオ参照は、すべての有料プランでMusic v2およびv2.5に利用できます。

Music Finetunes

ElevenLabs Musicモデルを独自のサウンドに微調整できます。Music Finetunesでは、独自のオーディオでモデルを微調整できます。所有する著作権に抵触しないトラックをアップロードすることで、スタイル、音響アイデンティティ、ブランドを一貫して反映するパーソナライズされた音楽モデルを作成できます。

標準の音楽生成でも高品質なトラックを生成できますが、出力は楽器編成、テクスチャ、プロダクションスタイル、雰囲気において大きく異なる場合があります。Finetunesは、特定のオーディオアイデンティティに基づいた生成を実現します。トレーニング後、Finetuneで生成するすべてのトラックは、データセットのトーン、構成、個性を反映しつつ、新しくオリジナルな楽曲であり続けます。

Finetunesは、AI音楽生成における次の3つの主要な課題に対応します。

  • ブランドはプロンプトだけで独自のサウンドを構築できない
  • クリエイターはプロジェクト間で自分のスタイルを確実に再現できない
  • 新しいアイデアを探求するミュージシャンは、自身の作品群らしさを感じられる出力を求めている

トラックを使って微調整することで、作成するカスタムFinetuneは、楽器編成、テンポ、プロダクションスタイル、音色、ボーカルの特徴にわたるスタイルパターンを捉えます。

仕組み

  • 著作権に抵触しないトラックをアップロードすると、著作権コンプライアンスを自動審査します
  • Finetuneは約5~10分で使用可能になります
  • ElevenCreative内でカスタムFinetuneを使って音楽を生成します

条件を満たすエンタープライズのお客様は、第三者による著作権審査なしに、完全に所有・管理する独自の知的財産を使って 微調整できます。この機能は、独占的に所有するカタログを持つ組織向けに 設計されています。この機能を有効にするには、アカウントマネージャーにお問い合わせください。

厳選されたFinetunes

カスタムトレーニングに加えて、ElevenCreativeには、ElevenLabsが世界中のジャンルとスタイルで作成した厳選Finetunesが含まれています。例:

  • アフロハウスビーツ
  • レゲトン
  • アラビックグルーヴ
  • 70年代カンボジアロック
  • 80年代ヌーディスコリバイバル
  • モーツァルト風交響曲

これらは対象となる加入者にすぐに利用できます。アップロードは不要です。

利用方法

Elevenミュージックは現在ElevenLabsのウェブサイトで利用できます。Music APIは有料加入者向けに提供されており、Agents Platformとのインテグレーションも近日公開予定です。

レーベル、出版社、アーティストとの協力により制作されたElevenミュージックは、映画やテレビからポッドキャスト、SNSビデオ、広告、ゲームまで、ほぼすべての商用利用が許諾されています。各プランでサポートされる利用方法の詳細は、音楽利用規約をご覧ください。

主なポイント

Music v2.5は、最も高度な音楽モデルです。Music v2を基盤に、オーディオ品質とプロンプトへの追従性を改善し、コンポジションプラン、オーディオ 参照、インペインティングを含む同じワークフローをサポートします。Elevenミュージックインターフェースのモデルドロップダウンで選択するか、APIで model_id="music_v2_5"を渡してください。Music v2も引き続き利用できます。

Music v2はElevenLabsの次世代AI音楽モデルで、Music v1と比べてプロンプトへの追従性、 楽曲構成、プロンプト理解、多言語出力、ボーカル表現が向上しています。新機能には 次のものがあります。

  • 短いアップロード済みトラックで生成を誘導するオーディオ参照
  • セクションごとの長尺楽曲構成
  • トラック途中でのジャンル遷移
  • 高速ラップや密度の高い歌詞パターンを含む、より速く複雑なボーカル表現
  • インペインティングの改善
  • トラック内に埋め込まれたサウンドエフェクト

Music v1は移行期間中も引き続き利用できます。UIではMusic v2が新しいデフォルトモデルです。 API生成では、移行期間中はMusic v1がデフォルトモデルのままです。その後は、Music v2がUIとAPIの両方で デフォルトになります。Music v1を廃止する際は、少なくとも数か月前に お知らせします。

UIで生成済みの曲の特定セクションを選択すると、トラックの残りの部分に影響を与えずに そのセクションだけを再生成できます。v2ではインペインティングの品質が改善されています。

生成される音楽の最短時間は3秒、最長時間は5分です。

はい。詳細はデベロッパークイックスタートをご覧ください。

はい。Elevenミュージックは、映画やテレビから ポッドキャスト、SNSビデオ、広告、ゲームまで、ほぼすべての商用利用が許諾されています。各プランで サポートされる利用方法の詳細は、音楽利用規約 をご覧ください。

生成オーディオは、MP3(44.1kHz、128~192kbps)およびWAV形式で利用できます。

オーディオ参照では、最大約30秒のトラックをアップロードして、新しい Music v2またはv2.5生成のスタイルやサウンドを誘導できます。アップロードしたトラックはプロンプトとともにクリエイティブなガイダンスとして使用され、すべてのアップロードは 著作権コンプライアンスの審査を受けます。

オーディオ参照は、リミックスやジャンル変換のツールではありません。サウンド、ムード、 楽器編成、プロダクションスタイルなどの特性を誘導します。リクエストする出力がアップロードした参照と大きく 異なる場合、たとえばジャズの参照を使ってラップトラックをリクエストする場合などは、結果の信頼性が低くなることがあります。