For AI agents: a documentation index is available at the root level at /llms.txt. Append /llms.txt to any URL for a page-level index, or .md for the markdown version of any page.
LogoLogo
연결
블로그고객센터API 요금가입하기
개요ElevenCreativeElevenAgentsElevenAPIReception.aiAPI 레퍼런스변경 로그고객센터
로그인
개요ElevenCreativeElevenAgentsElevenAPIReception.aiAPI 레퍼런스변경 로그고객센터
연결
블로그고객센터API 요금가입하기
이 페이지에서
  • 2026년 10월 5일
  • ElevenAgents
  • SDK 릴리스
  • API
  • 새 엔드포인트
  • 업데이트된 엔드포인트
  • 2026년 9월 28일
  • Eleven v4 및 Eleven v4 Turbo
  • 음성-텍스트 변환
  • ElevenAgents
  • Flows
  • Text to Dialogue
  • SDK 릴리스
  • API
  • 새 엔드포인트
  • 업데이트된 엔드포인트
  • 2026년 9월 23일
  • 이미지 & 비디오
  • 2026년 9월 21일
  • ElevenAgents
  • 이미지 및 비디오
  • Speech Engine
  • 텍스트 음성 변환
  • SDK 릴리스
  • API
  • 새 엔드포인트
  • 업데이트된 엔드포인트
  • 스키마 변경 사항
  • 2026년 9월 14일
  • ElevenAgents
  • 음악
  • SDK 릴리스
  • API
  • 새 엔드포인트
  • 업데이트된 엔드포인트
  • 스키마 변경 사항
  • 2026년 9월 11일
  • Scribe v2 Medical
  • 2026년 9월 7일
  • ElevenAgents
  • 워크스페이스
  • SDK 릴리스
  • API
  • 새 엔드포인트
  • 업데이트된 엔드포인트
  • 스키마 변경 사항
  • 2026년 8월 31일
  • ElevenAgents
  • 음악
  • 더빙
  • SDK 릴리스
  • API
  • 업데이트된 엔드포인트
  • 스키마 변경 사항
  • 2026년 8월 24일
  • ElevenLabs CLI
  • 절차
  • ElevenAgents
  • SDK 릴리스
  • API
  • 새 엔드포인트
  • 업데이트된 엔드포인트
  • 스키마 변경 사항
  • 2026년 8월 22일
  • MCP 서버

변경 로그

October 5, 2026
October 5, 2026

September 28, 2026
September 28, 2026

September 23, 2026
September 23, 2026

September 21, 2026
September 21, 2026

September 14, 2026
September 14, 2026

September 11, 2026
September 11, 2026

September 7, 2026
September 7, 2026

August 31, 2026
August 31, 2026

August 24, 2026
August 24, 2026

August 22, 2026
August 22, 2026
이전 게시물
다음
구축됨
로그인

ElevenAgents

  • 구조화된 절차는 저장 및 게시 시 컴파일됩니다: 이제 에이전트 업데이트 및 에이전트 초안 생성이 구조화된 절차를 자동으로 컴파일하고 검증합니다. 더 이상 통합에서 컴파일 엔드포인트를 호출하거나 생성된 워크플로를 수동으로 업데이트할 필요가 없습니다. 유효하지 않은 절차는 400 procedure_validation_failed로 절차별 오류를 반환합니다. 구조화된 절차가 없는 에이전트는 영향을 받지 않습니다.
  • 절차 컴파일 엔드포인트는 레거시입니다: 절차 컴파일은 레거시로 표시되며 새 통합에서 사용하면 안 됩니다. 기존 호출자에게는 계속 제공됩니다.
  • 병합 제안: 병합 제안은 알파 버전으로 제공됩니다. 팀은 에이전트 브랜치에 대한 제안을 열고, 구성 변경 사항과 테스트 결과를 검토하며, 댓글이나 승인 결정을 남기고, 승인된 변경 사항을 대상 브랜치에 병합할 수 있습니다. 병합 제안을 참조하세요.

SDK 릴리스

JavaScript SDK

  • v2.71.0 - 에이전트 병합 제안, 배포 기록, 테스트 호출 취소, Speech Engine 복제용 클라이언트를 추가했습니다. 또한 트리아지 티켓 우선순위 및 정렬, 배치 통화 내보내기 제한, gpt-6.1-sol, claude-sonnet-5-5, Eleven v4 에이전트 음성 모델 및 최신 에이전트 구성 타입을 추가했습니다.

Python SDK

  • v2.71.0 - 에이전트 병합 제안, 배포 기록, 테스트 호출 취소, Speech Engine 복제용 클라이언트를 추가했습니다. 또한 트리아지 티켓 우선순위 및 정렬, 배치 통화 내보내기 제한, gpt-6.1-sol, claude-sonnet-5-5, Eleven v4 에이전트 음성 모델 및 최신 에이전트 구성 타입을 추가했습니다.

Swift SDK

  • v3.4.0 - 이제 동적 변수가 대화 시작 데이터로 전송될 때 네이티브 JSON 타입을 유지합니다.

패키지

  • @elevenlabs/client@1.26.0, @elevenlabs/react@1.16.0, @elevenlabs/react-native@1.2.28, @elevenlabs/types@0.24.0 - transcriptEdit, edited_transcript 이벤트, React의 onEditedTranscript 콜백을 통해 실시간 음성-텍스트 변환 트랜스크립트 편집을 추가했습니다. 이제 React는 filterBackgroundAudio를 실시간 세션으로 전달합니다. 클라이언트는 MessagePayload도 내보내며, 중복 에이전트 답변을 방지하기 위해 안정적인 응답 ID를 사용합니다.
  • @elevenlabs/convai-widget-core@0.18.3 및 @elevenlabs/convai-widget-embed@0.18.3 - 첨부 파일만 있는 답변을 포함해 에이전트 메시지 첨부 파일의 이미지 미리 보기와 다운로드 링크를 추가했습니다. 안정적인 응답 ID가 중복 답변을 방지하며, 이제 텍스트 전용 대화에서는 채팅 종료 툴팁이 있는 중지 컨트롤을 사용합니다.

API

API 변경 사항 보기

새 엔드포인트

ElevenAgents

  • 병합 제안 생성 - POST /v1/convai/agents/{agent_id}/merge-proposals - 필수 source_branch_id, target_branch_id, title 필드와 선택적 설명, 검토자 ID, 트리아지 티켓 ID로 제안을 생성합니다.
  • 병합 제안 나열 - GET /v1/convai/agents/{agent_id}/merge-proposals - 상태, 소스 브랜치, 대상 브랜치, 텍스트 필터 및 커서 페이지네이션으로 제안을 나열합니다.
  • 병합 제안 가져오기 - GET /v1/convai/agents/{agent_id}/merge-proposals/{merge_proposal_id} - 제안과 검토, 댓글, 결과 세부 정보를 조회합니다.
  • 병합 제안 업데이트 - PATCH /v1/convai/agents/{agent_id}/merge-proposals/{merge_proposal_id} - 제목, 설명 또는 요청된 검토자를 업데이트하거나 병합하지 않고 닫습니다.
  • 병합 제안 검토 - POST /v1/convai/agents/{agent_id}/merge-proposals/{merge_proposal_id}/reviews - 선택적 댓글과 함께 approved 또는 changes_requested 결정을 제출합니다.
  • 병합 제안에 댓글 달기 - POST /v1/convai/agents/{agent_id}/merge-proposals/{merge_proposal_id}/comments - 최대 4,096자의 Markdown 댓글을 추가합니다.
  • 병합 제안 병합 - POST /v1/convai/agents/{agent_id}/merge-proposals/{merge_proposal_id}/merge - 소스 브랜치를 병합하고, 필요에 따라 강제 충돌 해결 및 소스 브랜치 보관을 제어합니다.
  • 에이전트 배포 나열 - GET /v1/convai/agents/{agent_id}/deployments - 페이지 기반 페이지네이션으로 현재 및 과거 브랜치 트래픽 분할을 나열합니다.
  • 테스트 호출 취소 - POST /v1/convai/test-invocations/{test_invocation_id}/cancel - 실행 중인 테스트 호출을 취소합니다.

Speech Engine

  • Speech Engine 복제 - POST /v1/speech-engine/{speech_engine_id}/duplicate - Speech Engine을 복제하고, 선택적으로 사본에 새 name을 할당합니다.

업데이트된 엔드포인트

ElevenAgents

  • 에이전트 생성, 에이전트 가져오기, 에이전트 업데이트
    • LLM 열거형에 gpt-6.1-sol 및 claude-sonnet-5-5를 추가했습니다.
    • 대화형 TTS 모델 옵션에 eleven_v4 및 eleven_v4_turbo를 추가했습니다. 기본값은 eleven_flash_v2에서 eleven_v4_turbo로 변경되었습니다.
    • 에이전트 전송 및 독립형 워크플로 에이전트 노드에 전송 후 기본 음성, TTS 모델 및 음성 설정을 유지하는 선택적 preserve_voice_settings(불리언, 기본값 false)를 추가했습니다.
    • 턴 건너뛰기 도구 구성에 선택적 wait_timeout_secs(숫자, 기본값 -1)를 추가했습니다. 값이 -1이면 발신자가 말할 때까지 에이전트가 무음 상태를 유지합니다.
    • 통화 후 웹훅 구성에 JSON 트랜스크립션 웹훅에서 턴별 트랜스크립트를 생략하는 선택적 exclude_transcript(불리언, 기본값 false)를 추가했습니다.
    • 대화 기록 수정 구성에 근거를 수정하는 동안 선택한 추출 값을 유지하는 선택적 excluded_data_collection_ids(문자열 배열, 최대 50개)를 추가했습니다.
    • 이제 클라이언트 도구 response_timeout_secs는 expects_response가 활성화된 경우 무기한 대기하도록 -1을 허용합니다.
  • 티켓 나열
    • low, medium, high, urgent 값을 포함하는 선택적 priorities(배열)를 추가했습니다.
    • created_at 및 priority 값을 갖는 sort_by를 추가했으며, 기본값은 created_at입니다.
    • 이제 티켓 응답에는 title, nullable priority, priority_changes 배열이 필요합니다. 티켓 생성 및 업데이트 요청에서 priority를 설정할 수 있으며, 티켓 상태에 cancelled가 추가되었습니다.
  • 도구 나열 - 에이전트의 기본 브랜치에서 참조되는 도구를 반환하는 선택적 nullable used_by_agent_id(문자열)를 추가했습니다.
  • 배치 통화 결과 내보내기 - 첫 번째 수신자만 열 미리 보기로 내보내는 선택적 nullable limit(정수, 최소 1)를 추가했습니다.
  • 테스트 호출 나열 및 테스트 호출 가져오기
    • 테스트 호출 요약에 필수 cancelled_count(정수) 및 선택적 cancelled(불리언, 기본값 false)를 추가했습니다.
    • 테스트 실행 상태에 cancelled를 추가했습니다.
  • 대화 세부 정보 가져오기 - 트랜스크립트 항목에 user_turn_timeout 및 skip_turn_wait_elapsed 값을 갖는 선택적 nullable platform_event를 추가했습니다.
  • 에이전트 버전 메타데이터 가져오기 - 기본 브랜치에 병합된 변경 사항을 게시한 사람을 설명하는 배열인 선택적 nullable merged_authors를 추가했습니다.
  • 크롤 작업 가져오기 - 지원 중단된 max_depth 응답 필드를 제거했습니다.

Eleven v4 및 Eleven v4 Turbo

이제 Eleven v4 및 Eleven v4 Turbo를 사용할 수 있습니다. Eleven v4는 90개 이상의 언어에서 더 높은 품질과 표현력이 풍부한 음성, 향상된 음성 복제를 제공합니다. Eleven v4 Turbo는 실시간 애플리케이션을 위한 동일한 모델 제품군으로, 중앙값 추론 지연 시간은 약 100ms입니다.

콘텐츠 제작 및 장문 오디오에는 Text to Dialogue API를 통해 eleven_v4를 사용하세요. 에이전트 및 인터랙티브 애플리케이션에는 Text to Dialogue WebSocket을 통해 eleven_v4_turbo를 사용하세요.

Eleven v4 개요

두 모델 변형, 음성 복제 동작, 설정 및 지원 언어를 비교하세요.

Text to Dialogue API

Eleven v4로 고품질 대화를 생성하세요.

실시간 스트리밍

WebSocket 연결을 통해 Eleven v4 Turbo 대화를 스트리밍하세요.

음성-텍스트 변환

  • 트랜스크립트 편집: 이제 배치 및 실시간 트랜스크립션에서 최대 2,000자의 자연어 편집 지시문을 받을 수 있습니다. 배치 응답은 edited_transcript에 결과를 반환하며, 실시간 세션은 edited_transcript 이벤트를 내보냅니다. 호환되지 않는 기능, 응답 처리 및 가격은 배치 및 실시간 가이드를 참조하세요.

ElevenAgents

  • 에이전트 모델: 지원되는 에이전트 LLM 옵션에 gpt-6-sol, gpt-6-luna, glm-52, deepseek-v41-flash, claude-opus-5, claude-opus-5-5를 추가했습니다.
  • 에이전트 테스트 사용량: 테스트 호출 요약에 총 크레딧 및 USD 가격을 포함할 수 있습니다. 개별 테스트 실행에는 크레딧 및 과금 내역을 포함할 수 있습니다.

Flows

  • 템플릿 API: 게시된 Flows 템플릿을 나열하고 검색하며, 템플릿 실행을 시작하고 실행 결과를 조회하는 엔드포인트를 추가했습니다. 실행은 게시된 버전을 대상으로 할 수 있으며, 최종 결과를 구성된 웹훅으로 전송할 수 있습니다.

Text to Dialogue

  • 생성 연속성: Text to Dialogue 요청에서 이전 또는 이후 텍스트와 요청 ID를 사용해 여러 생성 간 연속성을 유지할 수 있습니다.
  • 프로페셔널 음성 모드: Text to Dialogue 요청에서 프로페셔널 음성 복제의 즉석 음성 복제 버전을 사용해 지연 시간을 줄이거나 표현력을 높일 수 있습니다.

SDK 릴리스

JavaScript SDK

  • v2.70.0 - 배치 및 실시간 음성-텍스트 변환 트랜스크립트 편집 타입, 테스트 호출 요약용 branchId 필터링 및 비용 필드, 지식 베이스 자동 검색, Text to Dialogue usePvcAsIvc, deepseek-v41-flash 에이전트 모델을 추가했습니다.

Python SDK

  • v2.70.0 - 배치 및 실시간 음성-텍스트 변환 트랜스크립트 편집 타입, 테스트 호출 요약용 branch_id 필터링 및 비용 필드, 지식 베이스 자동 검색, Text to Dialogue use_pvc_as_ivc, deepseek-v41-flash 에이전트 모델을 추가했습니다.

ElevenLabs CLI

  • v1.4.0 - 명시적 API 키를 사용하는 요청이 저장된 OAuth 자격 증명도 함께 전송하여 인증에 실패하던 문제를 수정했습니다. 피드백 명령 그룹에 설명을 추가하고, 생성된 에이전트 스킬에서 누락된 기능을 신고하는 방법을 추가했습니다. Flows 템플릿 엔드포인트 및 최신 스키마 타입으로 API 클라이언트를 다시 생성했습니다.

API

API 변경 사항 보기

새 엔드포인트

Flows

  • 템플릿 나열 - GET /v1/flows/templates - 게시된 템플릿과 실행 가능한 버전을 나열합니다.
  • 템플릿 가져오기 - GET /v1/flows/templates/{template_id} - 템플릿과 실행 가능한 버전을 조회합니다.
  • 템플릿 실행 생성 - POST /v1/flows/templates/{template_id}/runs - 입력 값, 선택적 버전 및 선택적 웹훅으로 템플릿 실행을 시작합니다.
  • 템플릿 실행 나열 - GET /v1/flows/templates/{template_id}/runs - 커서 페이지네이션 및 선택적 버전 필터링으로 템플릿 실행을 나열합니다.
  • 템플릿 실행 가져오기 - GET /v1/flows/templates/{template_id}/runs/{run_id} - 템플릿 실행과 출력 상태를 조회합니다.

업데이트된 엔드포인트

음성-텍스트 변환

  • 음성을 텍스트로 변환 - POST /v1/speech-to-text
    • 최대 2,000자의 자연어 편집 지시문을 받을 수 있는 선택적 nullable transcript_edit(문자열)를 추가했습니다.
    • 응답에 선택적 nullable edited_transcript를 추가했습니다. 편집에 성공하면 필수 kind: "transcript" 및 text 필드가 포함됩니다. 편집에 실패하면 필수 kind: "error", error_type: "edit_failed", message 필드가 포함됩니다.
  • 실시간 음성-텍스트 변환은 transcript_edit(문자열)를 수락하고 필수 text 및 edited_text 필드가 있는 edited_transcript 이벤트를 내보냅니다.

ElevenAgents

  • 에이전트 생성, 에이전트 가져오기, 에이전트 업데이트
    • LLM 열거형에 gpt-6-sol, gpt-6-luna, glm-52, deepseek-v41-flash, claude-opus-5, claude-opus-5-5를 추가했습니다.
    • 알림 모니터에 모니터의 알림 전송 여부를 제어하는 선택적 nullable enabled(불리언)를 추가했습니다.
  • 대화 나열 및 텍스트 검색
    • data_collection_params 및 dynamic_variable_params에 neq 및 in 연산자를 추가했습니다. in의 값은 파이프 구분 기호를 사용합니다.
    • evaluation_params는 결과 값으로 success, failure 또는 unknown을 허용합니다.
  • 스마트 검색 - GET /v1/convai/conversations/messages/smart-search
    • 선택적 nullable branch_id(문자열)를 추가했습니다.
  • 테스트 호출 나열 - GET /v1/convai/test-invocations
    • 선택적 nullable branch_id(문자열)를 추가했습니다.
    • 테스트 호출 요약에 선택적 nullable credits_used(정수) 및 total_price(숫자)를 추가했습니다.
  • 테스트 호출 가져오기 - GET /v1/convai/test-invocations/{test_invocation_id}
    • 개별 테스트 실행에 선택적 nullable credits_used(정수) 및 charging(ConversationChargingCommonModel)을 추가했습니다.
  • 대화 시뮬레이션 및 대화 스트림 시뮬레이션
    • 선택적 new_turns_limit 기본값을 10,000에서 100으로 변경하고 최대값을 100으로 설정했습니다.
  • 크롤 작업 생성 및 크롤 작업 가져오기
    • 자동 동기화 중 링크를 따라가 새로 발견된 페이지를 추가하는 선택적 auto_discover(불리언, 기본값 false)를 추가했습니다. 이를 사용하려면 enable_auto_sync: true가 필요합니다.
  • 지식 베이스 문서 새로 고침 - POST /v1/convai/knowledge-base/{documentation_id}/refresh
    • AutoSyncInfo에 새로 고침 시 새로 발견된 페이지를 크롤링하고 추가하는지 나타내는 선택적 auto_discover(불리언, 기본값 false)를 추가했습니다.
  • MCP 서버 도구 나열 - GET /v1/convai/mcp-servers/{mcp_server_id}/tools
    • 응답에 선택적 tool_approval_statuses(배열)를 추가했습니다. 각 항목에는 필수 tool_id(문자열)와 state(up_to_date, needs_review 또는 not_approved)가 포함되며, 선택적 승인 정책 및 승인된 정의 필드가 포함됩니다.

Text to Dialogue

  • 텍스트를 대화로 변환, 텍스트를 대화로 스트리밍, 타임스탬프와 함께 변환, 타임스탬프와 함께 스트리밍
    • 프로페셔널 음성 복제의 즉석 음성 복제 버전을 사용하는 선택적 use_pvc_as_ivc(불리언, 기본값 false)를 추가했습니다.
    • 생성 연속성을 위해 선택적 nullable previous_text 및 future_text(문자열, 최대 100자)와 previous_request_ids 및 next_request_ids(문자열 배열, 최대 3개 ID)를 추가했습니다.
    • 선택적 settings 객체에 nullable similarity(숫자, 0~1, 기본값 0.75)를 추가했습니다.

텍스트 음성 변환

  • 텍스트를 음성으로 변환, 텍스트를 음성으로 스트리밍, 타임스탬프와 함께 변환, 타임스탬프와 함께 스트리밍
    • 기존 use_pvc_as_ivc 필드는 더 이상 지원 중단되지 않습니다.

Flows

  • 이미지 생성 생성, 비디오 생성 생성, 템플릿 실행 생성
    • 이제 웹훅 대상에 명시적 type 구분자(all 또는 ids)가 필요합니다. 이전 기본값은 제거되었습니다.

보이스 디자인

  • 미리 보기에서 음성 생성, 음성 미리 보기 생성, 음성 디자인, 음성 리믹스
    • 미리 보기용 생성이 이미 진행 중인 경우 409 응답을 추가했습니다. 이 응답을 받은 후 요청을 다시 시도하세요.

워크스페이스

  • 서비스 계정 API 키 생성 - POST /v1/service-accounts/{service_account_user_id}/api-keys
    • 엔터프라이즈 서비스 계정 API 키를 위한 선택적 nullable tts_concurrency_limit, music_concurrency_limit, dubbing_concurrency_limit(정수)를 추가했습니다.
  • 서비스 계정 API 키 업데이트 - PATCH /v1/service-accounts/{service_account_user_id}/api-keys/{api_key_id}
    • 선택적 tts_concurrency_limit, music_concurrency_limit, dubbing_concurrency_limit를 추가했습니다. 각 필드는 정수, clear, no_update, null을 허용하며 기본값은 no_update입니다.

모델

  • 모델 나열 - GET /v1/models
    • 필수 max_characters_request_free_user 및 max_characters_request_subscribed_user를 지원 중단했습니다. 이 필드는 적용되지 않으므로 대신 maximum_text_length_per_request를 사용하세요.

이미지 & 비디오

  • Sora 2 및 Sora 2 Pro 지원 종료: OpenAI는 2026년 9월 24일 Sora API를 중단합니다. 두 모델은 이미지 & 비디오 모델 선택기에서 제거되었으며, 해당 날짜에 생성을 중단합니다. 기존 생성물은 기록에서 계속 사용할 수 있습니다. Sora 노드를 사용하는 Flows 및 템플릿은 다시 실행하려면 Gemini Omni 1.1 Flash와 같은 다른 비디오 모델로 전환해야 합니다.
  • Seedance 1.5 Pro 지원 중단: ByteDance는 2026년 11월 11일 Seedance 1.5 Pro를 종료합니다. 이 모델은 더 이상 새 생성에 제공되지 않으며 해당 날짜에 작동을 중단합니다. 대신 Seedance 2.0 모델을 사용하세요.

ElevenAgents

  • 병렬 도구 호출: 이제 에이전트 프롬프트 구성에 enable_parallel_tool_calls(불리언, 기본값 true)가 포함됩니다. 활성화하면 지원되는 모델은 한 턴에서 여러 도구를 실행할 수 있습니다.
  • 에이전트 모델: 에이전트 LLM 옵션에 gpt-6-astra를 추가했습니다.
  • 알림: 이제 에이전트 알림에서 PagerDuty 및 webhook 알림과 함께 Slack 채널을 지원합니다.
  • 전화번호 검색: 제공업체, 발신 지원, 할당된 에이전트 및 브랜치, 라벨, 전화번호 필터를 갖춘 커서 페이지네이션 전화번호 엔드포인트를 추가했습니다.

이미지 및 비디오

  • GPT Image 2.5 모델: 이제 이미지 생성에서 gpt-image-2.5-flare 및 gpt-image-2.5-sunburst를 지원합니다. 두 모델 모두 최대 10개의 참조 이미지, max까지의 품질 수준, auto를 포함한 14개의 고정 가로세로비, 1K, 2K 또는 4K 출력을 지원합니다.

Speech Engine

  • 캐스케이드 시간 초과: 이제 Speech Engine 생성 및 업데이트 요청에서 cascade_timeout_seconds(숫자, 2–15, 기본값 4)를 지원하여 재시도 전 ElevenLabs가 업스트림 음성 엔진을 대기하는 시간을 제어할 수 있습니다.

텍스트 음성 변환

  • 멀티 컨텍스트 턴 경계: 이제 is_final_audio_for_turn 마커가 MP3 및 Opus 출력을 포함해 해당 턴의 버퍼링된 모든 바이트 뒤에 전송됩니다. 클라이언트는 PCM으로 전환하지 않고도 이 마커를 정확한 턴 경계로 사용할 수 있습니다.

SDK 릴리스

JavaScript SDK

  • v2.69.0 - 실시간 Speech to Text 래퍼에 transcriptEdit를 추가했으며, 편집된 텍스트는 edited_transcript 이벤트를 통해 전달됩니다. 데이터 레지던시 접미사가 있는 API 키에 대한 Speech Engine JWT 검증을 수정했습니다. 템플릿을 나열하고 가져오며 실행을 나열, 생성, 가져오는 phoneNumbers.listV2 및 Flows 템플릿 메서드를 추가했습니다. GPT Image 2.5, Slack 에이전트 알림, 병렬 도구 호출, gpt-6-astra, 서비스 계정 API 키 동시성 제한, Music 제로 보존, 대화 필터, MCP 도구 승인 상태를 위한 클라이언트와 타입을 재생성했습니다.

Python SDK

  • v2.69.0 - 실시간 Speech to Text 래퍼에 transcript_edit를 추가했으며, 편집된 텍스트는 edited_transcript 이벤트를 통해 전달됩니다. 데이터 레지던시 접미사가 있는 API 키에 대한 Speech Engine JWT 검증을 수정하고, ffplay가 실패하면 play가 오류를 발생시키도록 했습니다. 템플릿을 나열하고 가져오며 실행을 나열, 생성, 가져오는 phone_numbers.list_v2 및 Flows 템플릿 메서드를 추가했습니다. GPT Image 2.5, Slack 에이전트 알림, 병렬 도구 호출, gpt-6-astra, 서비스 계정 API 키 동시성 제한, Music 제로 보존, 대화 필터, MCP 도구 승인 상태를 위한 클라이언트와 타입을 재생성했습니다.

ElevenLabs CLI

  • v1.3.2 - CLI 사용에 대한 피드백을 수집할 수 있도록 선택적 --intent 메타데이터를 추가했습니다. CLI에서 지원하지 않는 워크플로를 신고할 수 있도록 elevenlabs feedback missing-capability를 추가했습니다.

API

API 변경 사항 보기

새 엔드포인트

ElevenAgents

  • 전화번호 페이지 나열 - GET /v1/convai/v2/phone-numbers
    • 선택적 page_size(정수, 1–1,000, 기본값 100) 및 cursor(nullable 문자열) 페이지네이션 매개변수를 추가했습니다.
    • 선택적 search, label, phone_number, provider, supports_outbound, agent_id, branch_id, sort_by, sort_direction 필터를 추가했습니다. sort_by는 label 또는 phone_number를 지원하며, sort_direction의 기본값은 asc입니다.
    • 응답에는 필수 phone_numbers(배열), 선택적 nullable next_cursor(문자열), has_more(불리언, 기본값 false)가 포함됩니다.

업데이트된 엔드포인트

ElevenAgents

  • 에이전트 생성, 에이전트 가져오기 및 에이전트 업데이트
    • 프롬프트 구성에 enable_parallel_tool_calls(불리언, 기본값 true)를 추가했습니다. 워크플로 재정의는 nullable 불리언을 지원합니다.
    • LLM 열거형에 대화 시작 재정의를 포함하여 gpt-6-astra를 추가했습니다.
    • 이제 알림 통합 알리미에서 integration_type을 사용하여 pagerduty 또는 slack을 선택합니다. Slack 알리미에는 connection_id 및 channel_id(문자열)가 필요하며, channel_id는 1~64자를 지원합니다.
  • 대화 나열 및 대화 참조 확인
    • data_collection_params에서 더 이상 missing 연산자를 지원하지 않습니다. 필드가 수집되지 않은 대화를 일치시키려면 빈 값을 사용하세요.
    • dynamic_variable_params의 빈 값은 변수가 설정되지 않은 대화와 일치합니다.
  • Speech Engine 생성, Speech Engine 가져오기 및 Speech Engine 업데이트
    • cascade_timeout_seconds(숫자, 2–15)를 추가했습니다. 생성 요청의 기본값은 4이며, 업데이트 요청은 nullable 값을 지원하고 응답에는 해당 필드가 필요합니다.

이미지 및 비디오

  • 이미지 생성 만들기 - POST /v1/flows/image
    • gpt-image-2.5-flare 및 gpt-image-2.5-sunburst를 위한 요청 변형을 추가했습니다.
    • 두 변형 모두 prompt 및 model_id가 필요하고, 최대 10개의 images를 지원하며, resolution(1K, 2K 또는 4K, 기본값 1K)을 추가합니다.
    • quality는 low, medium, high, xhigh, max를 지원하며 기본값은 high입니다. aspect_ratio는 auto 및 14개의 고정 비율을 지원하며 기본값은 16:9입니다.

더빙

  • 더빙 프로젝트 생성 - POST /v1/dubbing/project
    • multipart keyterms는 반복 필드 또는 단일 JSON 배열을 지원합니다.
    • multipart webhook_ids는 반복 필드, 단일 JSON 배열 또는 쉼표로 구분된 문자열을 지원합니다.
  • 워크스페이스 리소스 가져오기, 워크스페이스 리소스 공유 및 워크스페이스 리소스 공유 해제
    • WorkspaceResourceType에 dubbing_project를 추가했습니다.

지식 베이스

  • 크롤 작업 생성 - POST /v1/convai/knowledge-base/crawl
    • max_depth(정수, 기본값 3)를 지원 중단했습니다. 이 필드는 이제 아무 작업도 수행하지 않으며 최소 또는 최대 제약 조건도 აღარ 이상 적용되지 않습니다.
    • 크롤 작업 메타데이터에서 더 이상 max_depth가 필요하지 않습니다.

사용자

  • 사용자 가져오기 및 구독 가져오기
    • 통화 열거형에 gbp를 추가했습니다.

스키마 변경 사항

텍스트 음성 변환

  • 이제 멀티 컨텍스트 WebSocket audio 및 final 메시지에서 is_final_audio_for_turn을 해당 턴의 버퍼링된 모든 바이트가 전달된 후 발생하는 것으로 정의합니다.

ElevenAgents

  • 통화 대기열 및 대기 오디오: 동시 처리 한도에 도달한 에이전트를 위한 통화 대기열을 추가했습니다. 대기 중인 발신자는 대기 오디오를 듣고, 입장하거나 시간 초과될 때까지 queue_status 이벤트를 수신합니다. 새 API 메서드로 사용자 지정 대기 오디오를 업로드하거나 삭제할 수 있습니다.
  • 테스트 버전 메타데이터: 이제 에이전트 테스트 결과에서 테스트를 실행한 에이전트 버전과 초안 변경 사항 포함 여부를 확인할 수 있습니다. 호출 요약에는 부분 재제출이 서로 다른 버전에서 실행된 경우도 표시됩니다.
  • 모델 및 계정 메타데이터: 이제 에이전트 LLM 구성에서 gemini-3.8-flash를 지원합니다. WhatsApp 계정 응답에서 해당 계정이 Cloud API를 사용하는지, 공존 가입 플로를 사용하는지 확인할 수 있습니다.

음악

  • Music v2.5 API 지원: 이제 음악 엔드포인트와 SDK에서 music_v2_5를 지원합니다. 작곡 계획 생성 청크는 최대 6,132자를 지원하며, 각 줄 최대 200자의 줄을 최대 30개까지 포함할 수 있습니다.

SDK 릴리스

JavaScript SDK

  • v2.68.0 - 에이전트 대기 오디오를 업로드하고 삭제하는 메서드를 추가했습니다. 통화 대기열, 프로시저 참조, 초안 브랜치 생성, RAG 쿼리 제한, 테스트 버전 메타데이터, gemini-3.8-flash, music_v2_5를 위한 타입을 재생성했습니다.

Python SDK

  • v2.68.0 - 에이전트 대기 오디오를 업로드하고 삭제하는 동기 및 비동기 메서드를 추가했습니다. 통화 대기열, 프로시저, 초안 브랜치 생성, RAG 쿼리 제한, 테스트 버전 메타데이터, gemini-3.8-flash, music_v2_5를 위한 타입을 재생성했습니다. 이제 compose_detailed 래퍼에서 생성된 모든 음악 모델 ID와 프롬프트 기반 및 청크 기반 작곡 계획을 모두 지원합니다.

iOS SDK

  • v3.3.1 - 에이전트 메시지를 event_id 대신 response_id로 조정하여 도구 호출 주변의 여러 응답을 보존하고, 스트리밍된 부분이나 수정 사항이 잘못된 메시지에 연결되지 않도록 했습니다.

ElevenLabs CLI

  • v1.3.0 - 생성된 API 명령에 선택적 --intent 메타데이터를 추가했습니다. CLI에서 지원하지 않는 워크플로를 신고할 수 있도록 elevenlabs feedback missing-capability를 추가했습니다.

패키지

  • @elevenlabs/convai-widget-core@0.18.2 및 @elevenlabs/convai-widget-embed@0.18.2 - 도구 및 프로시저 호출 후 중복되는 에이전트 답변을 수정했습니다. 스트리밍된 텍스트 답변은 Markdown 형식을 유지하며, 음성 대화에서는 발화되지 않은 스트리밍 채팅 부분이 더 이상 렌더링되지 않습니다. 임베드 패키지는 user_activity 이벤트도 초당 한 번으로 제한하고 세션이 종료되면 이 제한을 해제합니다.

API

API 변경 사항 보기

새 엔드포인트

ElevenAgents

  • 에이전트 대기 오디오 업로드 - POST /v1/convai/agents/{agent_id}/hold-audio
    • 필수 hold_audio_file(바이너리)을 multipart 양식 데이터로 받습니다. 파일은 최대 40MB 및 180초 길이의 MP3 또는 WAV여야 합니다.
    • 필수 agent_id(문자열) 및 hold_audio(AgentHoldAudioConfig)를 반환합니다. 대기 오디오 객체에는 audio_path, audio_url, original_filename(문자열), duration_secs(숫자), size_bytes(정수)가 필요합니다.
  • 에이전트 대기 오디오 삭제 - DELETE /v1/convai/agents/{agent_id}/hold-audio
    • 사용자 지정 클립을 제거하여 대기 중인 발신자가 기본 대기음을 듣도록 합니다.
    • 필수 agent_id(문자열)를 반환합니다.

업데이트된 엔드포인트

ElevenAgents

  • 에이전트 생성, 에이전트 가져오기 및 에이전트 업데이트
    • enabled(불리언, 기본값 false) 및 wait_timeout_seconds(정수, 1–1,800, 기본값 180)가 포함된 선택적 platform_settings.queueing_config(AgentQueueingConfig)를 추가했습니다.
    • 대기열 구성 응답에는 읽기 전용의 nullable hold_audio(AgentHoldAudioConfig)가 포함됩니다. 에이전트 응답에는 선택적 default_hold_audio_url(문자열)도 포함됩니다.
  • 대화 가져오기 - GET /v1/convai/conversations/{conversation_id}
    • 메타데이터에 선택적 nullable queue_wait_secs(숫자)를 추가했습니다. 대기열 시간은 call_duration_secs 및 청구 시간에서 제외됩니다.
  • 에이전트 브랜치 생성 - POST /v1/convai/agents/{agent_id}/branches
    • 선택적 include_draft(불리언, 기본값 false)를 추가했습니다. true인 경우 브랜치 팁에서 생성된 브랜치에 호출자의 초안 프로시저 세트가 포함됩니다.
  • 프로시저 나열 및 프로시저 생성, 가져오기, 초안 엔드포인트
    • 목록 항목에 선택적 referenced_tool_ids, referenced_kb_ids, referenced_procedure_ids, referenced_dynamic_variables(문자열 배열)를 추가했습니다.
    • 에이전트 및 병합 미리보기 응답에 프로시저 ID를 키로 하는 맵인 선택적 procedures를 추가했습니다.
  • 테스트 호출 나열 - GET /v1/convai/test-invocations
    • 이름으로 테스트와 폴더를 필터링하는 선택적 nullable search(문자열)를 추가했습니다.
  • 에이전트에서 테스트 실행 및 테스트 호출 가져오기
    • 테스트 스위트 호출 및 단위 테스트 실행 응답에 선택적 nullable version_id(문자열)와 선택적 ran_against_draft(불리언, 기본값 false)를 추가했습니다.
    • 호출 요약에도 선택적 runs_diverged_from_version(불리언, 기본값 false)를 추가했습니다.
  • POST /v1/convai/agents/{agent_id}/knowledge-base/rag-query
    • 요청 본문에 쿼리별 재정의 값으로 선택적 nullable max_documents_length(정수, 1–50,000) 및 max_retrieved_rag_chunks_count(정수, 1–20)를 추가했습니다.
  • WhatsApp 계정 가져오기 - GET /v1/convai/whatsapp-accounts/{phone_number_id}
    • 선택적 account_type(WhatsAppAccountType, 기본값 cloud_api)을 추가했습니다. 값은 cloud_api 및 coexistence입니다.
  • 예상 LLM 사용량 계산 - POST /v1/convai/agent/{agent_id}/llm-usage/calculate
    • LLMUsageCalculatorLLMResponseModel에 필수 price_per_message(숫자)를 추가했습니다.

음악

  • MusicModelID에 POST /v1/music/video-to-music, POST /v1/music/plan, 음악 작곡, POST /v1/music/detailed, POST /v1/music/detailed/stream, POST /v1/music/stream, POST /v1/music/upload, POST /v1/music/finetunes용 music_v2_5를 추가했습니다.
  • GenerationChunk.text의 maxLength를 POST /v1/music/plan, POST /v1/music, POST /v1/music/detailed, POST /v1/music/detailed/stream, POST /v1/music/stream, POST /v1/music/upload에 대해 6,000자에서 6,132자로 늘렸습니다. 섹션 이름은 1~100자를 포함할 수 있고, 청크에는 한 줄당 200자씩 최대 30줄을 포함할 수 있습니다.

스키마 변경 사항

ElevenAgents

  • 실시간 서버 이벤트에 queue_status를 추가했습니다. 필수 queue_status_event.status는 waiting, admitted, timed_out를 지원하며, timed_out은 WebSocket 종료 코드 4300보다 먼저 발생합니다. 대기 오디오는 계속 일반 audio 이벤트로 전달됩니다.
  • LLM 열거형에 대화 시작 재정의를 포함하여 gemini-3.8-flash를 추가했습니다.
  • 대화 시스템 도구 결과 유니온에 start_procedure_success, start_procedure_error, end_procedure_success, end_procedure_error를 추가했습니다.
  • FeaturesUsageCommonModel에 선택적 freeform_procedure 및 structured_procedure 기능 상태를 추가했습니다.

Scribe v2 Medical

Scribe v2 Medical이 이제 정식 출시되었습니다. 의료 및 임상 오디오에 특화된 일괄 음성 인식 모델이며, Scribe v2와 동일한 요금이 적용됩니다.

트랜스크립트 생성에서 model_id로 scribe_v2_medical을 전달하세요. 키워드 프롬프팅, 엔터티 감지, 화자 분리 및 축어록 비사용 모드는 Scribe v2와 동일하게 작동합니다.

모델

모델 ID, 기능 및 Scribe v2 Medical을 사용해야 하는 경우를 확인하세요.

트랜스크립트 생성

model_id를 scribe_v2_medical로 설정하여 오디오를 트랜스크립션하세요.

ElevenAgents

  • 워크스페이스 전체 대화 티켓: 액세스 가능한 에이전트 전반의 대화 트리아지 티켓을 가져오는 워크스페이스 티켓 목록을 추가했습니다. 상태 또는 담당자로 필터링하고 커서 페이지네이션을 사용해 페이지당 최대 100개의 티켓을 가져올 수 있습니다.
  • 동적 변수 대화 필터: 이제 대화 목록 및 대화 메시지 텍스트 검색에서 반복 가능한 dynamic_variable_params 필터를 지원합니다. eq, gt, gte, lt, lte와 함께 name:op:value를 사용하세요. 비교 연산자에는 숫자 값이 필요합니다.
  • Twilio 자동응답기 감지: 이제 발신 전화 및 일괄 통화 구성에서 선택적 twilio_machine_detection을 지원합니다. 사람 또는 기계 여부를 빠르게 판별하려면 enable을 선택하고, 음성사서함 안내가 끝날 때까지 기다리려면 detect_message_end를 선택하세요. 결과는 새 answering_machine_detection 웹훅 이벤트를 통해 제공됩니다.
  • 데이터 수집 값 제약 조건: 이제 데이터 수집 속성에서 허용되는 값을 포함하는 동적 변수의 이름을 지정하기 위해 allowed_values를 사용할 수 있습니다. 이전 allowed_values_dynamic_variable 필드는 더 이상 사용되지 않습니다.
  • 에이전트 메타데이터: 이제 에이전트 브랜치 목록 응답에서 초안 생성 시점과 브랜치 팁보다 이전인지 여부를 표시합니다. 에이전트 및 Speech Engine 요약에는 이제 voice_id가 필요합니다.
  • 지식 베이스 소스 URL: 이제 에이전트 RAG 쿼리 청크에 URL 문서의 추적 URL을 포함하는 필수 nullable source_url이 포함됩니다.
  • 에이전트 응답 첨부 파일: 이제 agent_response WebSocket 이벤트에 선택적 attachments가 포함됩니다. 각 첨부 파일에는 url 및 name이 필요하며 mime_type을 포함할 수 있습니다.

워크스페이스

  • API 키 플랫폼 한도: 이제 서비스 계정 API 키 응답에 크레딧, 프로페셔널 음성 복제, TTS, 더빙 및 음악 동시성에 대한 엔터프라이즈 platform_limits가 포함될 수 있습니다.

SDK 릴리스

JavaScript SDK

  • v2.67.0 - 대화 목록 및 텍스트 검색 요청에 dynamicVariableParams를 추가했습니다. Twilio 자동응답기 감지, 데이터 수집 값 제약 조건, API 키 플랫폼 한도, 에이전트 브랜치 초안 메타데이터, 지식 베이스 소스 URL의 유형을 다시 생성했습니다.

Python SDK

  • v2.67.0 - 동기 및 비동기 대화 목록과 텍스트 검색 메서드에 dynamic_variable_params를 추가했습니다. Twilio 자동응답기 감지, 데이터 수집 값 제약 조건, API 키 플랫폼 한도, 에이전트 브랜치 초안 메타데이터, 지식 베이스 소스 URL의 유형을 다시 생성했습니다. 실시간 텍스트 음성 변환 클라이언트는 더 이상 내부 omit sentinel을 연결에 전달하지 않습니다.

ElevenLabs CLI

  • v1.2.0 - elevenlabs say 명령과 해당 에이전트 스킬을 추가하고, API 명령 바인딩을 다시 생성했으며, eleven_v3를 기본 TTS 모델로 설정했습니다.

패키지

  • @elevenlabs/client@1.25.0, @elevenlabs/react@1.15.2, @elevenlabs/react-native@1.2.27, @elevenlabs/convai-widget-core@0.18.1 및 @elevenlabs/convai-widget-embed@0.18.1 - 소비자가 유형을 직접 가져올 수 있도록 @elevenlabs/client에서 MessageAttachment를 다시 내보냈습니다.
  • @elevenlabs/client@1.24.0, @elevenlabs/types@0.23.0, @elevenlabs/react@1.15.1, @elevenlabs/react-native@1.2.26, @elevenlabs/convai-widget-core@0.18.0 및 @elevenlabs/convai-widget-embed@0.18.0 - 에이전트 응답 파일 첨부를 onMessage로 전달하고 선택적 webRtc.singlePeerConnection 세션 설정을 추가했습니다. 위젯은 인사말 버튼도 현지화하며, 누락되거나 중복된 텍스트 채팅 응답을 수정합니다.

API

API 변경 사항 보기

새 엔드포인트

ElevenAgents

  • 워크스페이스 티켓 목록 - GET /v1/convai/triage-tickets
    • 호출자가 액세스할 수 있는 모든 에이전트의 대화 트리아지 티켓을 가장 최근 생성된 순으로 나열합니다.
    • 선택적 page_size(정수, 1~100, 기본값 100), status(AgentConversationTicketStatus), assignee_user_id(문자열 또는 unassigned), cursor(문자열) 쿼리 매개변수를 추가했습니다.
    • GetAgentConversationTicketsPageResponseModel을 반환합니다.

업데이트된 엔드포인트

ElevenAgents

  • 대화 목록 - GET /v1/convai/conversations
    • 선택적 nullable dynamic_variable_params(반복 가능한 문자열 배열)를 추가했습니다. 각 값은 name:op:value 형식을 사용하며, op는 eq, gt, gte, lt, lte입니다.
  • 대화 메시지 텍스트 검색 - GET /v1/convai/conversations/messages/text-search
    • 동일한 구문을 사용하는 선택적 nullable dynamic_variable_params(반복 가능한 문자열 배열)를 추가했습니다.
  • Twilio 발신 통화, SIP 트렁크 발신 통화, Exotel 발신 통화, 일괄 통화 제출
    • 이제 telephony_call_config에서 별도의 입력 및 출력 스키마를 사용합니다.
    • 선택적 nullable twilio_machine_detection(TwilioMachineDetectionConfig)을 추가했습니다. mode는 enable 또는 detect_message_end를 허용하며 기본값은 enable입니다. 이 설정은 Twilio 이외의 제공업체와 수신 통화에서는 무시됩니다.
  • 전화번호 가져오기 - POST /v1/convai/phone-numbers
    • Twilio API 키 가져오기에서 수신 웹훅 서명을 검증하기 위한 선택적 nullable account_auth_token(문자열)을 추가했습니다.

스키마 변경 사항

ElevenAgents

  • WebhookEventType에 answering_machine_detection을 추가했습니다.
  • AgentBranchSummary에 선택적 nullable draft_created_at(정수) 및 선택적 draft_is_behind_tip(불리언, 기본값 false)을 추가했습니다.
  • AgentKnowledgeBaseRagChunkResponseModel에 필수 nullable source_url(문자열)을 추가했습니다.
  • AgentSummaryResponseModel 및 SpeechEngineSummaryResponse에 필수 voice_id(문자열)를 추가했습니다.
  • AnalysisProperty에 선택적 nullable name(문자열) 및 allowed_values(AllowedValues)를 추가했습니다. LiteralJsonSchemaProperty에도 allowed_values를 추가했습니다. 두 항목 모두 allowed_values_dynamic_variable을 더 이상 사용하지 않습니다.
  • DataCollectionResultCommonModel에 선택적 nullable name(문자열)을 추가했습니다.
  • WorkspaceApiKeyResponseModel에 선택적 nullable platform_limits(PlatformLimits)를 추가했습니다.
  • MCP 도구 Icon에 선택적 nullable theme(light 또는 dark)을 추가했습니다.
  • SMBToolConfig에 send_custom_email, create_service_quote_request, create_product_quote_request 매개변수 변형을 추가했습니다.
  • 이제 웹훅 쿼리 매개변수 스키마와 전화 통화 구성에서 별도의 입력 및 출력 모델을 사용합니다.
  • agent_response WebSocket 이벤트에 선택적 attachments(배열)를 추가했습니다. 각 항목에는 url 및 name(문자열)이 필요하며 선택적 mime_type(문자열)을 허용합니다.

ElevenCreative

  • 이제 ReferenceVideo.studio_clip에서 StudioClipReference 대신 StudioClipLocator를 사용합니다. 필드와 와이어 형식은 변경되지 않았습니다.

ElevenAgents

  • 전화 키패드 입력: 이제 에이전트 대화 구성에서 DTMF 입력을 위한 선택적 dtmf_input_settings를 지원합니다. 숫자 입력 제한 시간을 설정하고, #을 종료 문자로 사용하며, 기록, 로그 및 분석에서 키패드 입력을 숨길 수 있습니다.
  • 대화 첨부 파일 기록: 이제 대화 가져오기의 트랜스크립트 항목에 연결된 모든 파일의 ID, 이름, MIME 유형 및 URL이 포함된 배열 file_inputs가 포함됩니다.
  • 에이전트 태그 필터링: 이제 에이전트 목록에서 선택적 tags 쿼리 매개변수를 사용할 수 있습니다. 매개변수를 반복하여 제공된 태그 중 하나와 일치하는 에이전트를 찾을 수 있습니다.
  • 일괄 캠페인 컨텍스트: 이제 대화 가져오기에서 필수 campaign_id 및 campaign_lead_id를 포함하는 nullable campaign 메타데이터로 일괄 통화를 식별합니다.

음악

  • 파형 시각화 데이터: 이제 상세 음악 생성, 세부 정보와 함께 음악 스트리밍, 음악 업로드에서 선택적 with_waveform_visual(불리언, 기본값 false)을 지원합니다. 이 옵션을 선택한 응답은 초당 4개 샘플로 구성된 저해상도 waveform_visual 정수 배열을 반환합니다.

더빙

  • 프로젝트 페이지네이션 동작: 이제 더빙 프로젝트 목록 및 언어 대상 목록에서 page_size를 1~100으로 제한합니다. 프로젝트 상태 필터에 queued가 포함되며, 두 엔드포인트 모두 다음 페이지를 가져오기 위해 next_cursor를 사용하는 방법을 안내합니다.

SDK 릴리스

JavaScript SDK

  • v2.66.0 - sendMultimodalMessage에 fileIds를 추가하여 하나의 메시지에 여러 파일 첨부를 포함할 수 있습니다.

Python SDK

  • v2.66.0 - send_multimodal_message에 file_ids를 추가하여 하나의 메시지에 여러 파일 첨부를 포함할 수 있습니다.

Android SDK

  • v0.12.2 - 세션 이벤트를 연결할 때 onUnhandledClientToolCall 콜백을 유지했습니다. 응답을 예상하는 처리되지 않은 클라이언트 도구 호출은 더 이상 미해결 상태로 남지 않고 자동 오류 응답을 받습니다.

ElevenLabs CLI

  • v1.1.0 - API 명령 바인딩을 다시 생성하고 ElevenAgents 워크플로에 명령 범위 요청 어트리뷰션을 추가했습니다. 이 명령은 CLI User-Agent에 cmd/<command>를 추가하여 agents push 및 agents create와 같은 워크플로의 요청을 구분할 수 있게 합니다.

패키지

  • @elevenlabs/client@1.23.0, @elevenlabs/react@1.15.0, @elevenlabs/types@0.22.1, @elevenlabs/react-native@1.2.25, @elevenlabs/convai-widget-core@0.17.1 및 @elevenlabs/convai-widget-embed@0.17.1 - sendMultimodalMessage에 fileIds를 추가했습니다. 호환성을 위해 클라이언트가 file 및 files 필드를 모두 전송하며, React에서 업데이트된 클라이언트 API를 제공합니다.

API

API 변경 사항 보기

업데이트된 엔드포인트

ElevenAgents

  • 에이전트 목록 - GET /v1/convai/agents
    • 선택적 nullable tags(문자열 배열)를 추가했습니다. 쿼리 매개변수를 반복하여 제공된 태그 중 하나와 일치시킬 수 있습니다.
  • 에이전트 생성, 에이전트 가져오기, 에이전트 업데이트
    • 선택적 nullable conversation_config.conversation.dtmf_input_settings(DTMFInputConfig)를 추가했습니다. dtmf_input_timeout(숫자, 0.5~10초, 기본값 2), hash_terminator(불리언, 기본값 true), redact_input(불리언, 기본값 false)을 지원합니다.
    • 전화번호 전송 구성에 선택적 sip_refer_play_dialtone(불리언, 기본값 true)을 추가했습니다. SIP REFER 전송이 완료되는 동안 원래 통화 레그를 무음으로 유지하려면 false로 설정하세요.
    • 시작 및 종료 절차 시스템 도구는 이제 ProcedureVersionRef 또는 ProcedureDraftRef를 받을 수 있습니다. 초안 참조에는 procedure_id(문자열)가 필요하며 version_id는 null로 설정됩니다.
  • 대화 가져오기 - GET /v1/convai/conversations/{conversation_id}
    • 트랜스크립트 항목에 file_inputs(ConversationHistoryTranscriptFileInputResponseModel 배열)를 추가했습니다. 각 항목에는 file_id, original_filename, mime_type, file_url(문자열)이 필요합니다.
    • 일괄 통화 메타데이터에 선택적 nullable campaign(BatchCallingCampaignInformation)을 추가했습니다. 객체에는 campaign_id 및 campaign_lead_id(문자열)가 필요합니다.
    • ChatSourceMedium에 dtmf를 추가했습니다.
  • 대화 트리아지 티켓 이슈 유형에 incorrect_information, documentation_gap, platform_bug, wrong_action을 추가했습니다.

음악

  • 상세 음악 생성(POST /v1/music/detailed) 및 세부 정보와 함께 음악 스트리밍(POST /v1/music/detailed/stream)
    • 선택적 with_waveform_visual(불리언, 기본값 false)을 추가했습니다.
    • 상세 응답에 nullable waveform_visual(정수 배열)을 추가했습니다. -1000에서 1000 범위로 초당 4회 샘플링됩니다.
  • 음악 업로드 - POST /v1/music/upload
    • 응답에 선택적 with_waveform_visual(불리언, 기본값 false) 및 nullable waveform_visual(정수 배열)을 추가했습니다.

ElevenCreative

  • Studio 프로젝트 생성 및 팟캐스트 생성
    • 이제 quality_preset에서 null을 허용하며, standard 스키마 기본값을 제거했습니다.

더빙

  • 더빙 프로젝트 목록 - GET /v1/dubbing/project
    • page_size는 기본값 20의 선택적 정수로 유지되지만, 이제 값이 거부되는 대신 1~100으로 제한됩니다.
    • 이제 status 필터에서 queued, preparing, ready, failed를 안내합니다.
    • 이전 응답의 next_cursor를 cursor에 전달하세요. 첫 페이지에서는 생략하세요.
  • 언어 대상 목록 - GET /v1/dubbing/project/{project_id}/language
    • page_size는 기본값 20의 선택적 정수로 유지되지만, 이제 값이 거부되는 대신 1~100으로 제한됩니다.
    • status 필터는 queued, processing, completed, stale, failed를 지원합니다.
    • 이전 응답의 next_cursor를 cursor에 전달하세요. 첫 페이지에서는 생략하세요.

스키마 변경 사항

워크스페이스

  • PendingSubscriptionSwitchResponseModel.next_tier에 grant를 추가했습니다.

ElevenLabs CLI

ElevenLabs CLI v1.0.0을 이제 사용할 수 있습니다. 모든 ElevenLabs API 작업을 하위 명령으로 제공하며, JSON, 표, YAML, CSV 출력, 자동 페이지네이션 및 셸 자동 완성을 지원합니다.

CLI는 ElevenAgents를 위한 로컬 구성 워크플로도 제공합니다. 에이전트, 도구, 테스트 구성을 파일로 저장하고 push 및 pull 명령으로 동기화하며, 브랜치를 관리하고, 테스트를 실행하고, ElevenLabs UI 구성 요소를 설치하고, 데이터 레지던시 리전을 선택할 수 있습니다.

CLI 문서

CLI를 설치하고, 인증하고, 에이전트를 코드로 관리하세요.

절차

이제 ElevenAgents에서 절차를 정식으로 사용할 수 있습니다. 절차에는 작업별 지침과 적용 시점을 결정하는 트리거가 포함됩니다. 대화 중 에이전트는 관련 절차를 로드하므로, 모든 지침을 시스템 프롬프트에 넣지 않고도 하나의 에이전트가 서로 다른 작업을 처리할 수 있습니다.

에이전트가 지침의 표현이나 순서를 조정할 수 있는 경우 자유 형식 절차를 사용하세요. 단계가 정해진 순서로 실행되어야 하는 경우 구조화된 절차를 사용하세요. 두 유형 모두 동일한 에이전트에서 워크플로와 함께 사용할 수 있습니다.

절차 개요

절차를 사용해야 하는 시점과 프롬프트 및 워크플로와의 차이점을 알아보세요.

자유 형식 절차

에이전트가 대화에 맞게 조정할 수 있는 자연어 지침을 작성하세요.

구조화된 절차

에이전트가 일관된 순서로 따르는 타입 지정 단계를 정의하세요.

ElevenAgents

  • 대화 분류 티켓: 에이전트 성능 관련 티켓 생성, 수동 후속 조치 티켓 생성, 티켓 나열, 워크스페이스 멤버 할당, 상태 및 담당자 업데이트, 티켓 수준 또는 턴 수준 댓글 추가를 위한 API를 추가했습니다.
  • 대화 관측성: 실시간 클라이언트는 완료된 각 에이전트 턴 후 context_usage 이벤트를 받을 수 있습니다. 이 이벤트는 모델, 프롬프트 토큰 수 및 모델 컨텍스트 한도를 보고합니다.

SDK 릴리스

JavaScript SDK

  • v2.65.0 - 대화 분류 티켓 및 경량 대화 요약을 위한 클라이언트와 타입을 추가했습니다. 대화 API에는 절차, 잘못된 도구 호출 및 정렬 필터가 추가되었고, 절차 API에는 에이전트 버전 선택이 추가되었으며, 주제 API에는 평가 세부 정보 제어 및 불만 정렬이 추가되었습니다. 또한 지식 베이스 새로 고침 빈도, 테스트 환경 및 알림 통합 필드와 실시간 더빙 메시지 타입을 추가했습니다.

Python SDK

  • v2.65.0 - 대화 분류 티켓 및 경량 대화 요약을 위한 클라이언트와 타입을 추가했습니다. 대화 API에는 절차, 잘못된 도구 호출 및 정렬 필터가 추가되었고, 절차 API에는 에이전트 버전 선택이 추가되었으며, 주제 API에는 평가 세부 정보 제어 및 불만 정렬이 추가되었습니다. 또한 지식 베이스 새로 고침 빈도, 테스트 환경 및 알림 통합 필드를 추가하고, 음성-텍스트 변환 keyterms 및 더빙 webhook_ids의 반복된 multipart 필드를 유지합니다.

Swift SDK

  • v3.3.0 - 타입 지정 클라이언트 오류 파싱, expects_response 처리 및 타입 안전 도구 결과를 추가했습니다. 이제 WebRTC 시작은 오디오 트랙 구독을 기다리는 대신 에이전트가 참여하면 준비 상태가 됩니다. 이 릴리스는 URL 처리를 강화하고, 알 수 없는 이벤트 노이즈를 억제하며, 소프트웨어 음소거 처리에서 실시간 스레드 할당을 제거합니다.

패키지

  • @elevenlabs/client@1.19.1, @elevenlabs/react@1.12.3, @elevenlabs/react-native@1.2.21, @elevenlabs/convai-widget-core@0.16.2 및 @elevenlabs/convai-widget-embed@0.16.2 - 이제 WebRTC 출력 캡처는 엄격한 콘텐츠 보안 정책에서 자체 호스팅 AudioWorklet 경로를 사용합니다. Worklet 캐싱에는 요청된 소스가 포함되어, 이전 인라인 URL이 자체 호스팅 경로를 대체하지 못하도록 합니다. 이제 React Native 설정 오류는 @elevenlabs/react-native를 가리킵니다.
  • @elevenlabs/client@1.20.0, @elevenlabs/react@1.12.4, @elevenlabs/react-native@1.2.22, @elevenlabs/convai-widget-core@0.16.3 및 @elevenlabs/convai-widget-embed@0.16.3 - 선택 사항인 webRtc.iceTransportPolicy를 추가했습니다. 직접 UDP 트래픽을 차단하는 네트워크에서 WebRTC ICE 후보를 TURN 릴레이로 제한하려면 이를 relay로 설정하세요.
  • @elevenlabs/client@1.21.0, @elevenlabs/react@1.13.0, @elevenlabs/types@0.21.1, @elevenlabs/react-native@1.2.23, @elevenlabs/convai-widget-core@0.16.4 및 @elevenlabs/convai-widget-embed@0.16.4 - onContextUsage 콜백과 ContextUsageEvent 타입을 추가했습니다. React는 useConversation을 통해 콜백을 노출합니다. 이제 React Native는 브라우저 전역 감지 대신 패키지 export 조건을 통해 확인됩니다.
  • @elevenlabs/client@1.22.0, @elevenlabs/react@1.14.0, @elevenlabs/types@0.22.0, @elevenlabs/react-native@1.2.24, @elevenlabs/convai-widget-core@0.17.0 및 @elevenlabs/convai-widget-embed@0.17.0 - 속성이 지정된 버튼 응답이 포함된 첫 메시지 리치 콘텐츠, onExternalAgentDisconnected, onMCPToolApprovalRequest를 추가했습니다. 이제 WebRTC는 선택한 입력 장치를 사용하고, 마이크 전환 시 음소거 상태를 유지하며, 시작 데이터를 전송할 수 없으면 설정에 실패합니다. 위젯에는 동시성 대기열 상태, 접힌 트리거에서의 선택적 언어 선택, 텍스트와 음성을 모두 지원하는 에이전트를 위한 첫 메시지 렌더링이 추가되었습니다.

API

API 변경 사항 보기

새 엔드포인트

ElevenAgents

  • 대화 분류 티켓 엔드포인트 9개를 추가했습니다.
    • 대화 티켓 생성 - POST /v1/convai/triage-tickets. 요청에는 conversation_id(문자열)가 필요하며, qa_comment(nullable 문자열, 1~10,000자) 및 최대 200개의 턴 댓글을 허용합니다.
    • 티켓 나열 - GET /v1/convai/agents/{agent_id}/triage-tickets, 커서 페이지네이션을 지원합니다.
    • 수동 티켓 생성 - POST /v1/convai/agents/{agent_id}/triage-tickets. 요청에는 qa_comment(문자열, 1~10,000자)가 필요합니다.
    • 할당 가능한 사용자 나열 - GET /v1/convai/agents/{agent_id}/triage-tickets/assignable-users. 응답은 서비스 계정이 아닌 워크스페이스 멤버와 각 멤버의 에이전트 액세스 여부를 나열합니다.
    • 티켓 가져오기 - GET /v1/convai/triage-tickets/{agentqa_ticket_id}.
    • 티켓 업데이트 - PATCH /v1/convai/triage-tickets/{agentqa_ticket_id}. 요청은 선택 사항인 status와 nullable assignee_user_id를 허용합니다.
    • 티켓 삭제 - DELETE /v1/convai/triage-tickets/{agentqa_ticket_id}.
    • 댓글 추가 - POST /v1/convai/triage-tickets/{agentqa_ticket_id}/comments. 요청에는 comment(문자열, 1~10,000자)가 필요합니다.
    • 턴 댓글 추가 - POST /v1/convai/triage-tickets/{agentqa_ticket_id}/turn-comments. 요청에는 0부터 시작하는 turn_index(정수)와 comment(문자열, 1~10,000자)가 필요합니다.

업데이트된 엔드포인트

ElevenAgents

  • 서명된 URL 가져오기 - GET /v1/convai/conversation/get-signed-url
    • 선택 사항인 debug_events_request(불리언, 기본값 false)를 추가했습니다. 디버그 이벤트에는 에이전트 편집자 액세스가 필요합니다.
  • WebRTC 토큰 가져오기 - GET /v1/convai/conversation/token
    • 선택 사항인 debug_events_request(불리언, 기본값 false)를 추가했습니다. 레거시 GET /v1/convai/conversation/get_signed_url 경로도 동일한 파라미터를 허용합니다.
  • 대화 나열 - GET /v1/convai/conversations
    • 지정된 절차 중 하나가 실행된 대화를 일치시키기 위한 선택 사항인 triggered_procedure_ids(nullable 문자열 배열, 최대 50개)를 추가했습니다.
    • 실행되지 않은 도구 호출을 포함하기 위한 선택 사항인 include_invalid_tool_calls(불리언, 기본값 false)를 추가했습니다.
    • 통화 시작 시간에 대한 선택 사항인 sort_direction(asc 또는 desc, 기본값 desc)을 추가했습니다.
  • 대화 메시지 텍스트 검색 - GET /v1/convai/conversations/messages/text-search
    • 선택 사항인 triggered_procedure_ids(nullable 문자열 배열, 최대 50개)를 추가했습니다.
    • 선택 사항인 include_invalid_tool_calls(불리언, 기본값 false)를 추가했습니다.
  • 에이전트 대화 주제 가져오기 - GET /v1/convai/agents/{agent_id}/topics
    • 선택 사항인 include_evaluation_criteria(불리언, 기본값 true)를 추가했습니다.
    • sort_by에 frustration을 추가했습니다.
    • 주제 응답에 nullable success_rate(숫자)를 추가하고, 전체 응답에는 aggregated_run_count(정수, 기본값 0)를 추가했습니다.
    • from_unix_secs는 UTC 날짜 시작 시점으로 내림 처리됩니다. 범위가 지정되면 완료된 일별 탐색 실행을 집계하며, 두 경계를 모두 생략하면 최신 실행을 반환합니다.
  • 절차 나열 (GET /v1/convai/agents/{agent_id}/branches/{branch_id}/procedures) 및 절차 가져오기 (GET /v1/convai/agents/{agent_id}/branches/{branch_id}/procedures/{procedure_id})
    • 특정 에이전트 버전에서 절차를 가져오기 위한 선택 사항 nullable agent_version_id(문자열)를 추가했습니다.
  • 테스트 생성 및 테스트 업데이트
    • 응답, 시뮬레이션 및 도구 호출 단위 테스트 스키마에 선택 사항 nullable environment(문자열)를 추가했습니다. 이 값은 환경별 URL, 헤더 및 인증 연결을 선택하며, 기본값은 production입니다.
  • URL 문서 생성, 크롤 작업 생성 및 폴더 생성
    • 자동 동기화를 위한 선택 사항 nullable minimum_frequency_days(정수, 1~180)를 추가했습니다. 기본값은 7이며, 더 엄격한 상위 폴더 빈도가 우선합니다.

음악

  • 음악 Finetune 나열 - GET /v1/music/finetunes
    • 최대 page_size를 100에서 150으로 늘렸습니다. 기본값은 50으로 유지됩니다.

스키마 변경 사항

ElevenAgents

  • 에이전트 업데이트 요청에 선택 사항 nullable procedures(object<string, ProcedureVersionRef>)를 추가했습니다. 각 값에는 procedure_id와 version_id(문자열)가 필요합니다. 빈 객체는 모든 절차를 제거합니다.
  • 대화 시작 구성에 enable_procedure_ids_from_client(불리언, 기본값 false)를 추가했습니다. 시작 데이터에 선택 사항 nullable procedure_ids(문자열 배열)를 추가했으며, 빈 배열은 시작 에이전트의 모든 절차를 비활성화합니다.
  • ClientEvent에 context_usage를 추가했습니다.
  • 소프트 타임아웃 재정의에 선택 사항 nullable additional_soft_timeout_messages(문자열 배열)를 추가했습니다.
  • 분석 및 스키마 재정의 모델의 상수 값이 이제 null을 허용합니다.
  • mic_muting_enabled 및 transcript_enabled의 위젯 구성 기본값이 false에서 true로 변경되었습니다. 이전 동작을 유지하려면 명시적으로 false로 설정하세요.

워크스페이스

  • 사용자 가져오기 응답에서 UserResponseModel의 xi_api_key를 제거했습니다.
  • 이제 ResourceMetadataResponseModel.role_to_group_ids는 키를 admin, editor, commenter, viewer로 제한하지 않고 사용자 지정 역할 ID를 키로 허용합니다.
  • 직접 게시 응답에 선택 사항 nullable restricted_to_user_email_domains(문자열 배열)를 추가했습니다.
  • 보류 중인 구독 전환 응답의 next_tier에 go를 추가했습니다.

MCP 서버

  • 로컬 MCP 서버 지원 중단: 로컬 ElevenLabs MCP 서버와 MCP 플레이어는 호스팅형 MCP 서버를 위해 지원이 중단되었습니다. 두 리포지토리는 보관 처리되었으며 더 이상 업데이트를 받지 않습니다. 호스팅형 서버는 https://api.elevenlabs.io/v1/mcp에서 이용할 수 있으며, OAuth를 통해 ElevenLabs 계정으로 로그인하고 로컬 설치나 API 키가 필요하지 않습니다. Claude, Cursor 및 기타 MCP 클라이언트의 설정 방법은 호스팅형 MCP 서버 문서를 참조하세요.