Music v2 소개

이제 ElevenLabs API를 통해 Music v2를 사용할 수 있습니다. 새 모델을 사용하려면 음악 생성, 음악 스트리밍, 상세 음악 생성, 음악 업로드에서 model_id를 music_v2로 설정하세요. Music v2는 GenerationChunk 및 AudioRefChunk 세그먼트로 구성된 청크 기반 작곡 플랜을 도입하여 프롬프트 기반 music_v1 흐름보다 구조, 속도 및 편곡을 더욱 세밀하게 제어할 수 있습니다.

생성 및 업로드 요청에 music_v2 작곡 플랜을 사용하거나, 작곡 플랜 엔드포인트를 통해 먼저 플랜을 생성하세요. 요청 및 응답 본문은 v1 또는 v2 플랜 형태를 모두 허용하므로 엔드포인트별로 마이그레이션할 수 있습니다. MusicPrompt는 music_v1에서만 계속 사용할 수 있습니다.

  • 업로드 타임스탬프: 음악 업로드는 선택적 with_timestamps를 허용하며, 응답에 words_timestamps가 포함될 수 있습니다.

ElevenAgents

  • 대화 평가 실행: RunConversationEvaluationsRequest를 사용하여 완료된 대화에 대해 단일 평가 기준을 다시 실행하는 대화 평가 실행 엔드포인트(POST /v1/convai/conversations/{conversation_id}/analysis/evaluations/run)가 추가되었습니다.
  • 워크플로 진입 동작: 워크플로 재정의 에이전트 노드에 하위 에이전트가 먼저 말할지 또는 사용자 입력을 기다릴지 제어하는 선택적 entry_behavior(generate_immediately, wait_for_user, auto)가 추가되었습니다.
  • 프로시저 종료 시스템 도구: 일치하는 오류 상태와 함께 end_procedure 시스템 도구 구성이 추가되었습니다. start_procedure 도구의 오류 상태에는 already_active가 추가되었습니다.
  • 전송 TTS 재정의: AgentTransfer, 워크플로 독립형 에이전트 노드 및 성공한 transfer_to_agent 도구 결과에 전송 후 클라이언트 측 TTS 재정의를 유지하는 선택적 preserve_client_tts_overrides(부울)가 추가되었습니다.
  • 상호작용 예산 enum: InteractionBudget에서 async가 제거되고 5_minutes, 10_minutes, 1_hour가 추가되었습니다. 여전히 async를 참조하는 구성 또는 SDK enum을 업데이트하세요.
  • 사용자 지정 가드레일 모델 선택: 사용자 지정 가드레일 구성에 Gemini, Claude 및 GPT 변형을 포함하는 선택적 model이 추가되었습니다. 가드레일 구성에는 선택적 history_message_count(정수)도 추가되었습니다.
  • 전화번호 목록 필터: 전화번호 목록에 가져온 번호를 필터링하는 선택적 provider, agent_id, branch_id 쿼리 매개변수가 추가되었습니다.
  • WhatsApp 계정 필터링: WhatsApp 계정 목록에 할당된 에이전트별로 계정을 필터링하는 선택적 agent_id 쿼리 매개변수가 추가되었습니다.
  • 토픽 기간 필터: 에이전트 대화 토픽 가져오기에 토픽 탐색 결과의 범위를 제한하는 선택적 from_unix_secs 및 to_unix_secs 쿼리 매개변수가 추가되었습니다.
  • SIP 코덱 구성: 아웃바운드 SIP 트렁크 요청 및 응답 모델에 선택적 enabled_codecs(MediaCodec enum)가 추가되었습니다.
  • 메모리 도구 유형: 메모리 도구 오류 처리를 위한 LoadableMemoryEntry 및 LoadMemoryEntryToolErrorStatus 스키마가 추가되었습니다.
  • 에이전트 테스트 배치 제한: 에이전트 테스트 연결, 실행 및 재제출 요청 스키마에서 연결 가능한 최대 테스트 수가 1000개에서 5000개로 늘어났습니다.
  • 음소 태그 지원: 에이전트 TTS 설정에 V3 SSML 음소 처리를 선택적으로 활성화하는 enable_phoneme_tags(부울)가 추가되었습니다.
  • 배열 스키마 생략 재정의: 배열 JSON 스키마 속성에 선택적 is_omitted(다른 값 소스와 상호 배타적)가 추가되었습니다. ConstantSchemaOverride는 배열 상수 값을 사용할 수 있습니다.
  • 전송 오류 컨텍스트: 번호 전송 오류 페이로드에 선택적 agent_message(문자열)가 포함될 수 있습니다.

워크스페이스

  • 서비스 계정 API 키 업데이트: 서비스 계정 API 키 업데이트는 더 이상 요청 본문이 필요하지 않습니다. 편집 필드는 permissions 및 character_limit을 포함하여 no_update와 null 허용 name을 통한 부분 업데이트를 지원합니다.
  • 사용량 시간대 버킷화: 워크스페이스 제품별 시간 경과 사용량 요청에 명확해진 interval_seconds 버킷 규칙과 함께 선택적 time_zone(IANA 시간대 문자열)이 추가되었습니다.
  • 기록 소스 필터: 기록 목록 및 세부 정보 source 필터에 Flows가 추가되었습니다.

ElevenCreative Studio

  • 프로젝트 음성 참조: 프로젝트 모델, 챕터 TTS 노드, 음성 목록 및 음성 통계에서 표준 음성 필드가 project_voice_ref_id로 변경되었습니다. 기존 voice_id 필드는 호환성을 위해 더 이상 사용되지 않는 읽기 전용 미러로 응답에 유지됩니다.

음성 텍스트 변환

  • 화자 라이브러리 화자 분리: 음성을 텍스트로 변환에 배치 전사의 화자 분리를 위한 선택적 use_speaker_library(부울, 기본값 false)가 추가되었습니다.

음성

  • 공유 음성 정렬: 공유 음성 목록의 sort 쿼리 매개변수에 명시적 enum, created_date 기본값 및 업데이트된 설명이 추가되었습니다.

SDK 릴리스

JavaScript SDK

  • v2.53.0 - 대화 평가 재실행 지원, music v2 작곡 플랜 유니온, 워크플로 entry_behavior, 전화번호 및 WhatsApp 목록 필터, 토픽 기간 매개변수, 알림 스키마 업데이트, 스튜디오 project_voice_ref_id 필드 및 확장된 에이전트 테스트 배치 제한을 포함한 최신 OpenAPI 스키마를 기반으로 재생성되었습니다.

Python SDK

  • v2.53.0 - 대화 평가 재실행 지원, music v2 작곡 플랜, 워크플로 진입 동작 및 프로시저 종료 도구, 전화 통신 필터 매개변수, 알림 및 서비스 계정 부분 업데이트 모델, 스튜디오 음성 참조 필드를 포함한 최신 OpenAPI 스키마를 기반으로 재생성되었습니다.

패키지

iOS SDK

  • v3.2.1 - 싱가포르 데이터 레지던시 지원을 추가하고 WebRTC 세션에 singlePeerConnection을 활성화했습니다.

API

새 엔드포인트

ElevenAgents

  • 대화 평가 실행 - POST /v1/convai/conversations/{conversation_id}/analysis/evaluations/run
    • 요청 본문은 단일 평가 기준을 다시 실행하기 위해 RunConversationEvaluationsRequest를 사용합니다.

업데이트된 엔드포인트

ElevenAgents

  • 전화번호 목록 - GET /v1/convai/phone-numbers
    • 선택적 provider, agent_id, branch_id 쿼리 매개변수가 추가되었습니다.
  • 에이전트 대화 토픽 가져오기 - GET /v1/convai/agents/{agent_id}/topics
    • 선택적 from_unix_secs 및 to_unix_secs 쿼리 매개변수가 추가되었습니다.
  • WhatsApp 계정 목록 - GET /v1/convai/whatsapp-accounts
    • 선택적 agent_id 쿼리 매개변수가 추가되었습니다.

음악

음성 텍스트 변환

  • 음성을 텍스트로 변환 - POST /v1/speech-to-text
    • 선택적 use_speaker_library 쿼리 매개변수(부울, 기본값 false)가 추가되었습니다.

음성

  • 공유 음성 목록 - GET /v1/shared-voices
    • 이제 sort 쿼리 매개변수는 created_date를 기본값으로 하는 명시적 enum을 사용합니다.

스키마 변경 사항

ElevenAgents

  • 워크플로 재정의 에이전트 노드
    • 선택적 entry_behavior enum(generate_immediately, wait_for_user, auto)이 추가되었습니다.
  • 시스템 도구
    • end_procedure 도구 구성 및 오류 상태가 추가되었습니다.
  • 전송 및 상호작용 스키마
    • 전송 및 전송 도구 결과에 선택적 preserve_client_tts_overrides가 추가되었습니다.
    • InteractionBudget에서 async가 제거되고 5_minutes, 10_minutes, 1_hour가 추가되었습니다.
  • 가드레일 및 TTS
    • 사용자 지정 가드레일에 선택적 model 및 history_message_count가 추가되었습니다.
    • 에이전트 TTS 설정에 선택적 enable_phoneme_tags가 추가되었습니다.
  • 전화 통신
    • SIP 트렁크 모델에 선택적 enabled_codecs(MediaCodec enum)가 추가되었습니다.
  • 메모리 및 코드 도구
    • LoadableMemoryEntry 및 LoadMemoryEntryToolErrorStatus가 추가되었습니다.
  • 에이전트 테스트
    • 실행 및 재제출 요청의 연결된 테스트 제한이 1000개에서 5000개로 늘어났습니다.
  • 도구 JSON 스키마 속성
    • 배열 속성에 선택적 is_omitted가 추가되었습니다.

워크스페이스

  • 서비스 계정
    • API 키 PATCH는 no_update 센티널을 통한 부분 업데이트를 지원합니다.
  • 사용량 및 기록
    • 제품별 시간 경과 사용량에 선택적 time_zone이 추가되었습니다.
    • 기록 source 필터에 Flows가 추가되었습니다.

음악

  • 작곡 플랜
    • music_v2용 청크 기반 CompositionPlan, GenerationChunk, AudioRefChunk가 추가되었습니다.
    • 요청 및 응답 본문은 v1 또는 v2 플랜 형태의 anyOf를 허용합니다.

ElevenCreative Studio

  • 프로젝트 음성 모델
    • 표준 음성 참조로 project_voice_ref_id가 추가되었습니다.
    • 더 이상 사용되지 않는 읽기 전용 voice_id 미러가 응답에 유지됩니다.