Eleven v4 및 Eleven v4 Turbo
이제 Eleven v4 및 Eleven v4 Turbo를 사용할 수 있습니다. Eleven v4는 90개 이상의 언어에서 더 높은 품질과 표현력이 풍부한 음성, 향상된 음성 복제를 제공합니다. Eleven v4 Turbo는 실시간 애플리케이션을 위한 동일한 모델 제품군으로, 중앙값 추론 지연 시간은 약 100ms입니다.
콘텐츠 제작 및 장문 오디오에는 Text to Dialogue API를 통해 eleven_v4를 사용하세요. 에이전트 및 인터랙티브 애플리케이션에는 Text to Dialogue WebSocket을 통해 eleven_v4_turbo를 사용하세요.
음성-텍스트 변환
- 트랜스크립트 편집: 이제 배치 및 실시간 트랜스크립션에서 최대 2,000자의 자연어 편집 지시문을 받을 수 있습니다. 배치 응답은
edited_transcript에 결과를 반환하며, 실시간 세션은edited_transcript이벤트를 내보냅니다. 호환되지 않는 기능, 응답 처리 및 가격은 배치 및 실시간 가이드를 참조하세요.
ElevenAgents
- 에이전트 모델: 지원되는 에이전트 LLM 옵션에
gpt-6-sol,gpt-6-luna,glm-52,deepseek-v41-flash,claude-opus-5,claude-opus-5-5를 추가했습니다. - 에이전트 테스트 사용량: 테스트 호출 요약에 총 크레딧 및 USD 가격을 포함할 수 있습니다. 개별 테스트 실행에는 크레딧 및 과금 내역을 포함할 수 있습니다.
Flows
- 템플릿 API: 게시된 Flows 템플릿을 나열하고 검색하며, 템플릿 실행을 시작하고 실행 결과를 조회하는 엔드포인트를 추가했습니다. 실행은 게시된 버전을 대상으로 할 수 있으며, 최종 결과를 구성된 웹훅으로 전송할 수 있습니다.
Text to Dialogue
- 생성 연속성: Text to Dialogue 요청에서 이전 또는 이후 텍스트와 요청 ID를 사용해 여러 생성 간 연속성을 유지할 수 있습니다.
- 프로페셔널 음성 모드: Text to Dialogue 요청에서 프로페셔널 음성 복제의 즉석 음성 복제 버전을 사용해 지연 시간을 줄이거나 표현력을 높일 수 있습니다.
SDK 릴리스
JavaScript SDK
- v2.70.0 - 배치 및 실시간 음성-텍스트 변환 트랜스크립트 편집 타입, 테스트 호출 요약용
branchId필터링 및 비용 필드, 지식 베이스 자동 검색, Text to DialogueusePvcAsIvc,deepseek-v41-flash에이전트 모델을 추가했습니다.
Python SDK
- v2.70.0 - 배치 및 실시간 음성-텍스트 변환 트랜스크립트 편집 타입, 테스트 호출 요약용
branch_id필터링 및 비용 필드, 지식 베이스 자동 검색, Text to Dialogueuse_pvc_as_ivc,deepseek-v41-flash에이전트 모델을 추가했습니다.
ElevenLabs CLI
- v1.4.0 - 명시적 API 키를 사용하는 요청이 저장된 OAuth 자격 증명도 함께 전송하여 인증에 실패하던 문제를 수정했습니다. 피드백 명령 그룹에 설명을 추가하고, 생성된 에이전트 스킬에서 누락된 기능을 신고하는 방법을 추가했습니다. Flows 템플릿 엔드포인트 및 최신 스키마 타입으로 API 클라이언트를 다시 생성했습니다.
API
API 변경 사항 보기
새 엔드포인트
Flows
- 템플릿 나열 -
GET /v1/flows/templates- 게시된 템플릿과 실행 가능한 버전을 나열합니다. - 템플릿 가져오기 -
GET /v1/flows/templates/{template_id}- 템플릿과 실행 가능한 버전을 조회합니다. - 템플릿 실행 생성 -
POST /v1/flows/templates/{template_id}/runs- 입력 값, 선택적 버전 및 선택적 웹훅으로 템플릿 실행을 시작합니다. - 템플릿 실행 나열 -
GET /v1/flows/templates/{template_id}/runs- 커서 페이지네이션 및 선택적 버전 필터링으로 템플릿 실행을 나열합니다. - 템플릿 실행 가져오기 -
GET /v1/flows/templates/{template_id}/runs/{run_id}- 템플릿 실행과 출력 상태를 조회합니다.
업데이트된 엔드포인트
음성-텍스트 변환
- 음성을 텍스트로 변환 -
POST /v1/speech-to-text- 최대 2,000자의 자연어 편집 지시문을 받을 수 있는 선택적 nullable
transcript_edit(문자열)를 추가했습니다. - 응답에 선택적 nullable
edited_transcript를 추가했습니다. 편집에 성공하면 필수kind: "transcript"및text필드가 포함됩니다. 편집에 실패하면 필수kind: "error",error_type: "edit_failed",message필드가 포함됩니다.
- 최대 2,000자의 자연어 편집 지시문을 받을 수 있는 선택적 nullable
- 실시간 음성-텍스트 변환은
transcript_edit(문자열)를 수락하고 필수text및edited_text필드가 있는edited_transcript이벤트를 내보냅니다.
ElevenAgents
- 에이전트 생성, 에이전트 가져오기, 에이전트 업데이트
LLM열거형에gpt-6-sol,gpt-6-luna,glm-52,deepseek-v41-flash,claude-opus-5,claude-opus-5-5를 추가했습니다.- 알림 모니터에 모니터의 알림 전송 여부를 제어하는 선택적 nullable
enabled(불리언)를 추가했습니다.
- 대화 나열 및 텍스트 검색
data_collection_params및dynamic_variable_params에neq및in연산자를 추가했습니다.in의 값은 파이프 구분 기호를 사용합니다.evaluation_params는 결과 값으로success,failure또는unknown을 허용합니다.
- 스마트 검색 -
GET /v1/convai/conversations/messages/smart-search- 선택적 nullable
branch_id(문자열)를 추가했습니다.
- 선택적 nullable
- 테스트 호출 나열 -
GET /v1/convai/test-invocations- 선택적 nullable
branch_id(문자열)를 추가했습니다. - 테스트 호출 요약에 선택적 nullable
credits_used(정수) 및total_price(숫자)를 추가했습니다.
- 선택적 nullable
- 테스트 호출 가져오기 -
GET /v1/convai/test-invocations/{test_invocation_id}- 개별 테스트 실행에 선택적 nullable
credits_used(정수) 및charging(ConversationChargingCommonModel)을 추가했습니다.
- 개별 테스트 실행에 선택적 nullable
- 대화 시뮬레이션 및 대화 스트림 시뮬레이션
- 선택적
new_turns_limit기본값을10,000에서100으로 변경하고 최대값을100으로 설정했습니다.
- 선택적
- 크롤 작업 생성 및 크롤 작업 가져오기
- 자동 동기화 중 링크를 따라가 새로 발견된 페이지를 추가하는 선택적
auto_discover(불리언, 기본값false)를 추가했습니다. 이를 사용하려면enable_auto_sync: true가 필요합니다.
- 자동 동기화 중 링크를 따라가 새로 발견된 페이지를 추가하는 선택적
- 지식 베이스 문서 새로 고침 -
POST /v1/convai/knowledge-base/{documentation_id}/refreshAutoSyncInfo에 새로 고침 시 새로 발견된 페이지를 크롤링하고 추가하는지 나타내는 선택적auto_discover(불리언, 기본값false)를 추가했습니다.
- MCP 서버 도구 나열 -
GET /v1/convai/mcp-servers/{mcp_server_id}/tools- 응답에 선택적
tool_approval_statuses(배열)를 추가했습니다. 각 항목에는 필수tool_id(문자열)와state(up_to_date,needs_review또는not_approved)가 포함되며, 선택적 승인 정책 및 승인된 정의 필드가 포함됩니다.
- 응답에 선택적
Text to Dialogue
- 텍스트를 대화로 변환, 텍스트를 대화로 스트리밍, 타임스탬프와 함께 변환, 타임스탬프와 함께 스트리밍
- 프로페셔널 음성 복제의 즉석 음성 복제 버전을 사용하는 선택적
use_pvc_as_ivc(불리언, 기본값false)를 추가했습니다. - 생성 연속성을 위해 선택적 nullable
previous_text및future_text(문자열, 최대 100자)와previous_request_ids및next_request_ids(문자열 배열, 최대 3개 ID)를 추가했습니다. - 선택적
settings객체에 nullablesimilarity(숫자, 0~1, 기본값0.75)를 추가했습니다.
- 프로페셔널 음성 복제의 즉석 음성 복제 버전을 사용하는 선택적
텍스트 음성 변환
- 텍스트를 음성으로 변환, 텍스트를 음성으로 스트리밍, 타임스탬프와 함께 변환, 타임스탬프와 함께 스트리밍
- 기존
use_pvc_as_ivc필드는 더 이상 지원 중단되지 않습니다.
- 기존
Flows
보이스 디자인
- 미리 보기에서 음성 생성, 음성 미리 보기 생성, 음성 디자인, 음성 리믹스
- 미리 보기용 생성이 이미 진행 중인 경우
409응답을 추가했습니다. 이 응답을 받은 후 요청을 다시 시도하세요.
- 미리 보기용 생성이 이미 진행 중인 경우
워크스페이스
- 서비스 계정 API 키 생성 -
POST /v1/service-accounts/{service_account_user_id}/api-keys- 엔터프라이즈 서비스 계정 API 키를 위한 선택적 nullable
tts_concurrency_limit,music_concurrency_limit,dubbing_concurrency_limit(정수)를 추가했습니다.
- 엔터프라이즈 서비스 계정 API 키를 위한 선택적 nullable
- 서비스 계정 API 키 업데이트 -
PATCH /v1/service-accounts/{service_account_user_id}/api-keys/{api_key_id}- 선택적
tts_concurrency_limit,music_concurrency_limit,dubbing_concurrency_limit를 추가했습니다. 각 필드는 정수,clear,no_update,null을 허용하며 기본값은no_update입니다.
- 선택적
모델
- 모델 나열 -
GET /v1/models- 필수
max_characters_request_free_user및max_characters_request_subscribed_user를 지원 중단했습니다. 이 필드는 적용되지 않으므로 대신maximum_text_length_per_request를 사용하세요.
- 필수