음성 리믹스
음성 리믹스
경로 매개변수
헤더
쿼리 매개변수
요청
음성에 적용할 변경 사항에 대한 설명입니다.
생성할 텍스트입니다. 텍스트 길이는 100자에서 1000자 사이여야 합니다.
음성 설명에 적합한 텍스트를 자동으로 생성할지 여부입니다.
생성된 음성의 볼륨 레벨을 제어합니다. -1은 가장 작고, 1은 가장 크며, 0은 약 -24 LUFS에 해당합니다.
음성 생성을 제어하는 난수입니다. 동일한 입력에 동일한 시드를 사용하면 동일한 음성이 생성됩니다.
AI가 프롬프트를 얼마나 엄격하게 따를지 제어합니다. 값이 낮을수록 AI가 창의성을 발휘할 여지가 커지고, 값이 높을수록 프롬프트를 더 엄격하게 따릅니다. 값이 높으면 음성이 부자연스럽거나 로봇처럼 들릴 수 있습니다. Guidance Scale이 낮을 때는 더 길고 자세한 프롬프트를 사용하는 것이 좋습니다.
Determines whether the Text to Voice previews should be included in the response. If true, only the generated IDs will be returned which can then be streamed via the /v1/text-to-voice/:generated_voice_id/stream endpoint.
리믹싱 세션 ID입니다.
이러한 생성을 첨부할 리믹싱 세션 반복의 ID입니다. 제공하지 않으면 새 반복이 생성됩니다.
음성 샘플 생성 시 프롬프트와 참조 오디오 간의 균형을 제어합니다. 0은 프롬프트 영향이 거의 없음을, 1은 참조 오디오 영향이 거의 없음을 의미합니다. eleven_ttv_v3 모델 사용 시에만 지원됩니다.
응답
성공 응답
생성된 음성의 미리보기입니다.
음성을 미리 듣는 데 사용되는 텍스트입니다.