ボイスデザイン
ボイスデザイン
テキストプロンプトから音声を作成します。
ヘッダー
xi-api-key
クエリパラメータ
output_format
生成されたオーディオの出力形式。
リクエスト
This endpoint expects an object.
voice_description
作成する音声に使用する説明。
text
生成するテキスト。テキストの長さは100~1000文字である必要があります。
auto_generate_text
音声説明に適したテキストを自動生成するかどうか。
loudness
生成される音声の音量レベルを制御します。-1が最も小さく、1が最も大きく、0はおよそ-24 LUFSに相当します。
quality
品質を高くすると音声出力は向上しますが、バリエーションは少なくなります。
seed
音声生成を制御する乱数。同じ入力で同じシードを使用すると、同じ音声が生成されます。
guidance_scale
AIがプロンプトにどの程度厳密に従うかを制御します。値が低いほどAIはより自由に創造性を発揮でき、値が高いほどプロンプトに厳密に従います。値が高いと、音声が不自然またはロボットのように聞こえることがあります。Guidance Scaleが低い場合は、より長く詳細なプロンプトを使用することをおすすめします。
should_enhance
AIを使用して音声説明をより詳細にし、音声生成の品質を向上させるかどうか。有効にすると、システムは簡単なプロンプトをより詳細な音声説明へ自動的に展開します。デフォルトはFalseです
レスポンス
成功レスポンス。
previews
生成された音声のプレビュー。
text
音声のプレビューに使用するテキストです。
エラー
409
Conflict Error
422
Unprocessable Entity Error