음악

  • Music Finetunes API: Music Finetunes를 관리할 수 있는 API 지원이 추가되었습니다. 5개의 엔드포인트에서 업로드한 오디오로 Finetune을 생성하고, 액세스 가능한 Finetune 목록을 조회하고, 학습 상태를 확인하고, 메타데이터 및 공개 범위를 업데이트하거나 Finetune을 삭제할 수 있습니다. 이제 모든 음악 생성 SDK 메서드에서 finetune_id를 제공합니다.

ElevenAgents

  • 외부 대화 참조 확인: Slack 메시지 URL 또는 Zendesk 티켓 URL을 대화로 확인하는 GET /v1/convai/conversations/resolve가 추가되었습니다. 요청에는 agent_id 및 reference 쿼리 매개변수(문자열)가 필요합니다.
  • 에이전트 지식 베이스 쿼리: 에이전트의 지식 베이스에 대해 읽기 전용 RAG 쿼리를 수행하는 POST /v1/convai/agents/{agent_id}/knowledge-base/rag-query가 추가되었습니다. 요청에는 query(문자열)가 필요하고 선택적 branch_id(문자열)를 허용하며, 문서, 청크, 텍스트, 벡터 거리 메타데이터를 포함한 순위별 청크를 반환합니다. 이 엔드포인트는 생성된 SDK에서 제외됩니다.
  • 지식 베이스 콘텐츠 형식: 지식 베이스 파일, 텍스트 및 URL 응답에 선택적 content_format (html | markdown, 기본값 html)이 추가되었습니다.
  • 에이전트 음성 구성: TTS 재정의 스키마에 클라이언트에서 재정의 가능한 선택적 model_id (TTSConversationalModel)가 추가되었습니다. enable_phoneme_tags의 기본값이 false에서 true로 변경됩니다.
  • 더 빨라진 백업 LLM 캐스케이드: cascade_timeout_seconds의 기본값이 8초에서 4초로 변경됩니다. 허용 범위는 2~15초로 유지됩니다.
  • 도구 매개변수 값 소스: 이제 객체 도구 매개변수에서 기존 스칼라 및 배열 제어와 동일하게 dynamic_variable, constant_value, is_omitted를 사용할 수 있습니다. 상수 스키마 재정의는 이제 임의의 배열과 객체를 허용합니다.
  • 전체 응답 가드레일: 사용자 지정 가드레일에 전체 비 TTS 응답을 한 번 평가하는 선택적 evaluate_full_response_only(boolean, 기본값 false)가 추가되었습니다. 이 옵션에는 차단 모드가 필요합니다.
  • Twilio 통화 녹음: 전화 통신 통화 구성에 선택적 twilio_call_recording_enabled(boolean, 기본값 false)가 추가되었습니다. 녹음은 연결된 Twilio 계정에 저장되며 다른 제공업체에서는 이 설정이 무시됩니다.
  • 위젯 파일 업로드 텍스트: 위젯 텍스트 구성에 파일 첨부 및 제거, 업로드 실패, 지원되지 않는 유형, 파일 크기 초과, 파일 수 제한, 입력 표시기를 위한 선택적 라벨과 오류 메시지가 추가되었습니다.
  • 지식 베이스 동기화 상태: 지식 베이스 파일 응답에 선택적 auto_sync_info 및 refresh_status (FileRefreshStatus)가 추가되었습니다. 폴더 응답에는 폴더가 아닌 문서의 재귀적 수(최대 1000)인 필수 document_count(정수)가 추가되었습니다.
  • 대화 텍스트 검색 필터: 대화 메시지 텍스트 검색에 선택적 exclude_statuses 및 termination_reasons 배열 쿼리 매개변수가 추가되었습니다.
  • LLM 옵션: 에이전트 LLM 구성에 gpt-5.6-sol, gpt-5.6-terra, gpt-5.6-luna가 추가되었습니다. LLMReasoningEffort에 max가 추가되었습니다.
  • WhatsApp 입력 표시기: WhatsApp 계정 요청 및 응답 스키마에 선택적 enable_typing_indicator(boolean)가 추가되었습니다.

음성 텍스트 변환

  • 일회용 일괄 인증: 음성을 텍스트로 변환에 API 키 또는 bearer 인증의 대안으로 선택적 token(문자열)이 추가되었습니다. POST /v1/single-use-token/batch_scribe로 일회용 토큰을 생성할 수 있으며, 15분 후 만료됩니다.
  • Realtime 클라이언트 안정성: 이제 @elevenlabs/client는 RealtimeEvents.ERROR를 통해 마이크 설정 및 잘못된 서버 오류를 보고하고, 설정 실패 및 연결 종료 후 마이크 리소스를 해제하며, 소켓 해제 후 늦게 도착한 마이크 프레임을 삭제합니다.

텍스트 음성 변환

  • 보관된 발음 사전: 발음 사전 목록에 선택적 include_archived(boolean, 기본값 true)가 추가되었습니다.

워크스페이스

  • 웹훅 이벤트 구독: 워크스페이스 웹훅 업데이트 요청에 voice_library_removal_notice, speech_to_text, agent_qa를 포함하는 선택적 events (WorkspaceWebhookEventType[])가 추가되었습니다. 웹훅 응답은 구독한 이벤트 목록을 반환할 수 있습니다.
  • 사용량 분석 차원: 워크스페이스 사용량 가져오기의 group_by 값에 surface 및 actor가 추가되었습니다.
  • 서비스 계정 한도 삭제: 서비스 계정 API 키 업데이트는 "no_update" 및 정수 값과 함께 월간 문자 한도를 제거하는 character_limit: "clear"를 허용합니다.
  • 알림 웹훅 참조: 알림 웹훅 알리미 스키마는 이제 url, method, headers를 포함하는 대신 필수 webhook_id(문자열)로 워크스페이스 웹훅을 식별합니다.

SDK 릴리스

JavaScript SDK

  • v2.59.0 - Music Finetunes를 나열, 생성, 가져오기, 업데이트, 삭제하는 music.finetunes 메서드가 추가되었습니다. 또한 대화 참조 확인, 보관된 발음 사전 필터링, 일회용 음성 텍스트 변환 토큰이 추가되었습니다.

Python SDK

  • v2.59.0 - 최신 API 스키마의 Music Finetunes 및 대화 참조 확인 기능이 추가되었습니다. OnPremInitiationData에도 서명된 통화 후 웹훅을 위한 선택적 hmac_secret을 포함하는 유형 지정 post_call_transcription_webhook 및 post_call_audio_webhook 구성이 추가되었습니다.

패키지

Android SDK

  • v0.11.1 - R8 및 ProGuard가 text, type과 같은 발신 WebSocket 및 WebRTC 이벤트 필드를 난독화하지 않도록 했습니다.

CLI

  • @elevenlabs/cli@0.5.6 - 기본 에이전트 템플릿이 제거된 elevenlabs ASR 제공업체 대신 scribe_realtime을 사용하도록 업데이트되었습니다. 최소 템플릿은 계속 서버 기본값을 사용합니다.

API

새 엔드포인트

음악

  • Music Finetunes 목록 - GET /v1/music/finetunes
    • 커서 페이지네이션, 공개 범위 및 생성자 필터, 생성 시간 또는 이름 기준 정렬을 지원합니다.
  • Music Finetune 생성 - POST /v1/music/finetunes
    • name 및 primary_genre가 필요합니다.
    • 최대 50개의 오디오 파일, 태그, 공개 범위 및 model_id를 허용합니다.
  • Music Finetune 가져오기 - GET /v1/music/finetunes/{finetune_id}
  • Music Finetune 업데이트 - PATCH /v1/music/finetunes/{finetune_id}
    • name, tags, primary_genre 또는 visibility를 업데이트합니다.
  • Music Finetune 삭제 - DELETE /v1/music/finetunes/{finetune_id}

ElevenAgents

  • GET /v1/convai/conversations/resolve
    • agent_id(문자열) 및 reference(문자열) 쿼리 매개변수가 필요합니다.
    • GetConversationResponseModel을 반환합니다.
  • POST /v1/convai/agents/{agent_id}/knowledge-base/rag-query
    • 요청 본문에 query(문자열)가 필요합니다.
    • 선택적 branch_id(문자열) 쿼리 매개변수를 허용합니다.
    • AgentKnowledgeBaseRagQueryResponseModel을 반환합니다.
    • 생성된 SDK에서 제외됩니다.

업데이트된 엔드포인트

ElevenAgents

  • 대화 메시지 텍스트 검색 - GET /v1/convai/conversations/messages/text-search
    • 선택적 exclude_statuses 및 termination_reasons 배열 쿼리 매개변수가 추가되었습니다.

음성 텍스트 변환

  • 음성을 텍스트로 변환 - POST /v1/speech-to-text
    • 일회용 일괄 Scribe 토큰을 위한 선택적 token(문자열) 쿼리 매개변수가 추가되었습니다.

텍스트 음성 변환

  • 발음 사전 목록 - GET /v1/pronunciation-dictionaries
    • 선택적 include_archived(boolean, 기본값 true) 쿼리 매개변수가 추가되었습니다.

워크스페이스

스키마 변경 사항

ElevenAgents

  • ElevenAgents 지식 베이스 응답 스키마에 선택적 content_format (html | markdown, 기본값 html)이 추가되었습니다.
  • 지식 베이스 파일 응답에 선택적 auto_sync_info 및 refresh_status (FileRefreshStatus)가 추가되었습니다.
  • 지식 베이스 폴더 응답에 필수 document_count(정수)가 추가되었습니다.
  • 에이전트 TTS 재정의 스키마에 선택적 model_id (TTSConversationalModel)가 추가되었습니다.
  • 에이전트 TTS enable_phoneme_tags의 기본값이 이제 false 대신 true입니다.
  • 백업 LLM cascade_timeout_seconds의 기본값이 이제 8초 대신 4초입니다.
  • 에이전트 LLM 구성에 gpt-5.6-sol, gpt-5.6-terra, gpt-5.6-luna가 추가되었으며, LLMReasoningEffort에 max가 추가되었습니다.
  • 사용자 지정 가드레일에 선택적 evaluate_full_response_only(boolean, 기본값 false)가 추가되었습니다.
  • 전화 통신 통화 구성에 선택적 twilio_call_recording_enabled(boolean, 기본값 false)가 추가되었습니다.
  • 객체 도구 매개변수에 dynamic_variable, constant_value, is_omitted가 추가되었으며, 상수 재정의는 임의의 배열 및 객체 값을 허용합니다.
  • 위젯 텍스트 구성에 선택적 파일 업로드 및 입력 표시기 라벨이 추가되었습니다.
  • WhatsApp 계정 스키마에 선택적 enable_typing_indicator(boolean)가 추가되었습니다.
  • 시뮬레이션 및 테스트 스키마에 AutoGenerationMetadata 및 SimulationLibrarySettings가 추가되었습니다.

음악

  • Music Finetune 요청, 응답, 페이지네이션, 공개 범위, 생성자, 상태 및 실패 사유 스키마가 추가되었습니다.
  • 모든 음악 생성 요청 스키마는 생성된 SDK에 finetune_id를 제공합니다.

워크스페이스

  • 워크스페이스 웹훅 요청 및 응답 스키마에 선택적 events (WorkspaceWebhookEventType[])가 추가되었습니다.
  • 알림 웹훅 알리미 스키마는 url, method, headers 대신 필수 webhook_id(문자열)를 사용합니다.