Music v2 소개
이제 ElevenLabs API를 통해 Music v2를 사용할 수 있습니다. 새 모델을 사용하려면 음악 생성, 음악 스트리밍, 상세 음악 생성, 음악 업로드에서 model_id를 music_v2로 설정하세요. Music v2는 GenerationChunk 및 AudioRefChunk 세그먼트로 구성된 청크 기반 작곡 플랜을 도입하여 프롬프트 기반 music_v1 흐름보다 구조, 속도 및 편곡을 더욱 세밀하게 제어할 수 있습니다.
생성 및 업로드 요청에 music_v2 작곡 플랜을 사용하거나, 작곡 플랜 엔드포인트를 통해 먼저 플랜을 생성하세요. 요청 및 응답 본문은 v1 또는 v2 플랜 형태를 모두 허용하므로 엔드포인트별로 마이그레이션할 수 있습니다. MusicPrompt는 music_v1에서만 계속 사용할 수 있습니다.
- 업로드 타임스탬프: 음악 업로드는 선택적
with_timestamps를 허용하며, 응답에words_timestamps가 포함될 수 있습니다.
ElevenAgents
- 대화 평가 실행:
RunConversationEvaluationsRequest를 사용하여 완료된 대화에 대해 단일 평가 기준을 다시 실행하는 대화 평가 실행 엔드포인트(POST /v1/convai/conversations/{conversation_id}/analysis/evaluations/run)가 추가되었습니다. - 워크플로 진입 동작: 워크플로 재정의 에이전트 노드에 하위 에이전트가 먼저 말할지 또는 사용자 입력을 기다릴지 제어하는 선택적
entry_behavior(generate_immediately,wait_for_user,auto)가 추가되었습니다. - 프로시저 종료 시스템 도구: 일치하는 오류 상태와 함께
end_procedure시스템 도구 구성이 추가되었습니다.start_procedure도구의 오류 상태에는already_active가 추가되었습니다. - 전송 TTS 재정의:
AgentTransfer, 워크플로 독립형 에이전트 노드 및 성공한transfer_to_agent도구 결과에 전송 후 클라이언트 측 TTS 재정의를 유지하는 선택적preserve_client_tts_overrides(부울)가 추가되었습니다. - 상호작용 예산 enum:
InteractionBudget에서async가 제거되고5_minutes,10_minutes,1_hour가 추가되었습니다. 여전히async를 참조하는 구성 또는 SDK enum을 업데이트하세요. - 사용자 지정 가드레일 모델 선택: 사용자 지정 가드레일 구성에 Gemini, Claude 및 GPT 변형을 포함하는 선택적
model이 추가되었습니다. 가드레일 구성에는 선택적history_message_count(정수)도 추가되었습니다. - 전화번호 목록 필터: 전화번호 목록에 가져온 번호를 필터링하는 선택적
provider,agent_id,branch_id쿼리 매개변수가 추가되었습니다. - WhatsApp 계정 필터링: WhatsApp 계정 목록에 할당된 에이전트별로 계정을 필터링하는 선택적
agent_id쿼리 매개변수가 추가되었습니다. - 토픽 기간 필터: 에이전트 대화 토픽 가져오기에 토픽 탐색 결과의 범위를 제한하는 선택적
from_unix_secs및to_unix_secs쿼리 매개변수가 추가되었습니다. - SIP 코덱 구성: 아웃바운드 SIP 트렁크 요청 및 응답 모델에 선택적
enabled_codecs(MediaCodecenum)가 추가되었습니다. - 메모리 도구 유형: 메모리 도구 오류 처리를 위한
LoadableMemoryEntry및LoadMemoryEntryToolErrorStatus스키마가 추가되었습니다. - 에이전트 테스트 배치 제한: 에이전트 테스트 연결, 실행 및 재제출 요청 스키마에서 연결 가능한 최대 테스트 수가 1000개에서 5000개로 늘어났습니다.
- 음소 태그 지원: 에이전트 TTS 설정에 V3 SSML 음소 처리를 선택적으로 활성화하는
enable_phoneme_tags(부울)가 추가되었습니다. - 배열 스키마 생략 재정의: 배열 JSON 스키마 속성에 선택적
is_omitted(다른 값 소스와 상호 배타적)가 추가되었습니다.ConstantSchemaOverride는 배열 상수 값을 사용할 수 있습니다. - 전송 오류 컨텍스트: 번호 전송 오류 페이로드에 선택적
agent_message(문자열)가 포함될 수 있습니다.
워크스페이스
- 서비스 계정 API 키 업데이트: 서비스 계정 API 키 업데이트는 더 이상 요청 본문이 필요하지 않습니다. 편집 필드는
permissions및character_limit을 포함하여no_update와 null 허용name을 통한 부분 업데이트를 지원합니다. - 사용량 시간대 버킷화: 워크스페이스 제품별 시간 경과 사용량 요청에 명확해진
interval_seconds버킷 규칙과 함께 선택적time_zone(IANA 시간대 문자열)이 추가되었습니다. - 기록 소스 필터: 기록 목록 및 세부 정보
source필터에Flows가 추가되었습니다.
ElevenCreative Studio
- 프로젝트 음성 참조: 프로젝트 모델, 챕터 TTS 노드, 음성 목록 및 음성 통계에서 표준 음성 필드가
project_voice_ref_id로 변경되었습니다. 기존voice_id필드는 호환성을 위해 더 이상 사용되지 않는 읽기 전용 미러로 응답에 유지됩니다.
음성 텍스트 변환
- 화자 라이브러리 화자 분리: 음성을 텍스트로 변환에 배치 전사의 화자 분리를 위한 선택적
use_speaker_library(부울, 기본값false)가 추가되었습니다.
음성
- 공유 음성 정렬: 공유 음성 목록의
sort쿼리 매개변수에 명시적 enum,created_date기본값 및 업데이트된 설명이 추가되었습니다.
SDK 릴리스
JavaScript SDK
- v2.53.0 - 대화 평가 재실행 지원, music v2 작곡 플랜 유니온, 워크플로
entry_behavior, 전화번호 및 WhatsApp 목록 필터, 토픽 기간 매개변수, 알림 스키마 업데이트, 스튜디오project_voice_ref_id필드 및 확장된 에이전트 테스트 배치 제한을 포함한 최신 OpenAPI 스키마를 기반으로 재생성되었습니다.
Python SDK
- v2.53.0 - 대화 평가 재실행 지원, music v2 작곡 플랜, 워크플로 진입 동작 및 프로시저 종료 도구, 전화 통신 필터 매개변수, 알림 및 서비스 계정 부분 업데이트 모델, 스튜디오 음성 참조 필드를 포함한 최신 OpenAPI 스키마를 기반으로 재생성되었습니다.
패키지
- @elevenlabs/client@1.11.0 - Unity SDK WebGL 브리지를 위한
@elevenlabs/client/internal/unity하위 경로 내보내기가 추가되어MediaDeviceInput,MediaDeviceOutput, 연결 연결 도우미 및 WebRTC 어댑터 유형을 제공합니다. - @elevenlabs/client@1.11.1, @elevenlabs/react@1.6.7, @elevenlabs/react-native@1.2.7, @elevenlabs/convai-widget-core@0.14.2 및 @elevenlabs/convai-widget-embed@0.14.2 -
@elevenlabs/client@1.11.1및@elevenlabs/types@0.14.1에 맞춰 의존성을 정렬했습니다. - @elevenlabs/types@0.14.1 - 라이선스 검사기 호환성을 위해
package.json에"license": "MIT"를 추가했습니다.
iOS SDK
- v3.2.1 - 싱가포르 데이터 레지던시 지원을 추가하고 WebRTC 세션에
singlePeerConnection을 활성화했습니다.
API
API 변경 사항 보기
새 엔드포인트
ElevenAgents
- 대화 평가 실행 -
POST /v1/convai/conversations/{conversation_id}/analysis/evaluations/run- 요청 본문은 단일 평가 기준을 다시 실행하기 위해
RunConversationEvaluationsRequest를 사용합니다.
- 요청 본문은 단일 평가 기준을 다시 실행하기 위해
업데이트된 엔드포인트
ElevenAgents
- 전화번호 목록 -
GET /v1/convai/phone-numbers- 선택적
provider,agent_id,branch_id쿼리 매개변수가 추가되었습니다.
- 선택적
- 에이전트 대화 토픽 가져오기 -
GET /v1/convai/agents/{agent_id}/topics- 선택적
from_unix_secs및to_unix_secs쿼리 매개변수가 추가되었습니다.
- 선택적
- WhatsApp 계정 목록 -
GET /v1/convai/whatsapp-accounts- 선택적
agent_id쿼리 매개변수가 추가되었습니다.
- 선택적
음악
- 음악 생성, 상세 음악 생성, 음악 스트리밍 및 음악 업로드
- 지원되는
model_id값에music_v2가 추가되었습니다. - 업로드에 선택적
with_timestamps가 추가되었으며 응답에words_timestamps가 포함될 수 있습니다.
- 지원되는
음성 텍스트 변환
- 음성을 텍스트로 변환 -
POST /v1/speech-to-text- 선택적
use_speaker_library쿼리 매개변수(부울, 기본값false)가 추가되었습니다.
- 선택적
음성
- 공유 음성 목록 -
GET /v1/shared-voices- 이제
sort쿼리 매개변수는created_date를 기본값으로 하는 명시적 enum을 사용합니다.
- 이제
스키마 변경 사항
ElevenAgents
- 워크플로 재정의 에이전트 노드
- 선택적
entry_behaviorenum(generate_immediately,wait_for_user,auto)이 추가되었습니다.
- 선택적
- 시스템 도구
end_procedure도구 구성 및 오류 상태가 추가되었습니다.
- 전송 및 상호작용 스키마
- 전송 및 전송 도구 결과에 선택적
preserve_client_tts_overrides가 추가되었습니다. InteractionBudget에서async가 제거되고5_minutes,10_minutes,1_hour가 추가되었습니다.
- 전송 및 전송 도구 결과에 선택적
- 가드레일 및 TTS
- 사용자 지정 가드레일에 선택적
model및history_message_count가 추가되었습니다. - 에이전트 TTS 설정에 선택적
enable_phoneme_tags가 추가되었습니다.
- 사용자 지정 가드레일에 선택적
- 전화 통신
- SIP 트렁크 모델에 선택적
enabled_codecs(MediaCodecenum)가 추가되었습니다.
- SIP 트렁크 모델에 선택적
- 메모리 및 코드 도구
LoadableMemoryEntry및LoadMemoryEntryToolErrorStatus가 추가되었습니다.
- 에이전트 테스트
- 실행 및 재제출 요청의 연결된 테스트 제한이 1000개에서 5000개로 늘어났습니다.
- 도구 JSON 스키마 속성
- 배열 속성에 선택적
is_omitted가 추가되었습니다.
- 배열 속성에 선택적
워크스페이스
- 서비스 계정
- API 키 PATCH는
no_update센티널을 통한 부분 업데이트를 지원합니다.
- API 키 PATCH는
- 사용량 및 기록
- 제품별 시간 경과 사용량에 선택적
time_zone이 추가되었습니다. - 기록
source필터에Flows가 추가되었습니다.
- 제품별 시간 경과 사용량에 선택적
음악
- 작곡 플랜
music_v2용 청크 기반CompositionPlan,GenerationChunk,AudioRefChunk가 추가되었습니다.- 요청 및 응답 본문은 v1 또는 v2 플랜 형태의
anyOf를 허용합니다.
ElevenCreative Studio
- 프로젝트 음성 모델
- 표준 음성 참조로
project_voice_ref_id가 추가되었습니다. - 더 이상 사용되지 않는 읽기 전용
voice_id미러가 응답에 유지됩니다.
- 표준 음성 참조로