音楽インペインティング
音楽インペインティング
既存の楽曲セクションを編集・結合する
music_v2またはmusic_v2_5モデルによる音楽インペインティングでは、曲の特定部分を変更しながら、残りの部分はそのまま維持できます。生成した曲を保存してから、コンポジションプラン内でその一部を参照することで、変更せずに維持したり、再生成したり、元のオーディオをもとに新しいオーディオを条件付けしたりできます。
仕組み
music_v2またはmusic_v2_5のコンポジションプランは、チャンクを順番に並べたリストです。チャンクには次の2種類があります。
- 生成チャンク:
textとスタイルに基づいて新しいオーディオを生成します。セクションの再生成や新しい素材の追加に使用します。 - オーディオ参照チャンク:保存された曲の一部を変更せずに挿入します。既存の曲のセクションをそのまま維持するために使用します。
クイックスタート
条件付け
生成チャンクは、conditioning_refを使用して保存済みオーディオの一部を条件として指定できます。モデルは参照元の音楽的特性に近づけながら、チャンクを再生成します。condition_strength(low、medium、high、またはxhigh)で、チャンクが参照にどの程度厳密に従うかを制御します。
最初のチャンクは、それ以降のすべてのチャンクの生成に影響します。曲全体を参照に基づいて
条件付けするには、最初のチャンクからconditioning_refを適用してください。
条件付け参照の長さは最大30秒(30,000ms)です。
コンテキスト追従性
各生成チャンクにはcontext_adherenceレベルがあり、隣接するチャンクにどの程度厳密に従うかを制御します。
high(デフォルト):周囲のチャンクとの一貫性を維持します。維持したオーディオと再生成したオーディオ間を滑らかに遷移させるために使用します。medium:一貫性と創造性の自由度のバランスを取ります。low:チャンクをコンテキストからより自由に逸脱させ、創造性を高めます。
例
1つのセクションを編集する
映画予告編を生成し、アウトロだけを別の歌詞で再生成します。
曲を延長する
既存の曲に新しいイントロとアウトロを追加します。
シームレスなループを作成する
音楽フレーズを生成し、同じスライスを2回繰り返す間をつなぐ「グルー」チャンクを使ってループを作成します。
類似した曲を生成する
既存の曲の短いスライスをもとに、音楽的な特徴を引き継いだまったく新しい曲を生成します。最初のチャンクは後続するすべてのチャンクに影響するため、最初のチャンクにconditioning_refを適用すると、保存済みオーディオを参照するのがそのチャンクだけであっても、生成全体の方向性が決まります。
チャンクリファレンス
music_v2プランには最大30個のチャンクを含められます。各チャンクは、生成チャンクまたはオーディオ参照チャンクのいずれかです。
生成チャンク
最初のチャンクのスタイルは、全体のトーンとジャンルを決めるため、最も重要です。方向性が定まるまで、 初期のチャンクには少なくとも6~7個のスタイルを設定してください。