Eleven v4 및 Eleven v4 Turbo

이제 Eleven v4 및 Eleven v4 Turbo를 사용할 수 있습니다. Eleven v4는 90개 이상의 언어에서 더 높은 품질과 표현력이 풍부한 음성, 향상된 음성 복제를 제공합니다. Eleven v4 Turbo는 실시간 애플리케이션을 위한 동일한 모델 제품군으로, 중앙값 추론 지연 시간은 약 100ms입니다.

콘텐츠 제작 및 장문 오디오에는 Text to Dialogue API를 통해 eleven_v4를 사용하세요. 에이전트 및 인터랙티브 애플리케이션에는 Text to Dialogue WebSocket을 통해 eleven_v4_turbo를 사용하세요.

음성-텍스트 변환

  • 트랜스크립트 편집: 이제 배치 및 실시간 트랜스크립션에서 최대 2,000자의 자연어 편집 지시문을 받을 수 있습니다. 배치 응답은 edited_transcript에 결과를 반환하며, 실시간 세션은 edited_transcript 이벤트를 내보냅니다. 호환되지 않는 기능, 응답 처리 및 가격은 배치 및 실시간 가이드를 참조하세요.

ElevenAgents

  • 에이전트 모델: 지원되는 에이전트 LLM 옵션에 gpt-6-sol, gpt-6-luna, glm-52, deepseek-v41-flash, claude-opus-5, claude-opus-5-5를 추가했습니다.
  • 에이전트 테스트 사용량: 테스트 호출 요약에 총 크레딧 및 USD 가격을 포함할 수 있습니다. 개별 테스트 실행에는 크레딧 및 과금 내역을 포함할 수 있습니다.

Flows

  • 템플릿 API: 게시된 Flows 템플릿을 나열하고 검색하며, 템플릿 실행을 시작하고 실행 결과를 조회하는 엔드포인트를 추가했습니다. 실행은 게시된 버전을 대상으로 할 수 있으며, 최종 결과를 구성된 웹훅으로 전송할 수 있습니다.

Text to Dialogue

  • 생성 연속성: Text to Dialogue 요청에서 이전 또는 이후 텍스트와 요청 ID를 사용해 여러 생성 간 연속성을 유지할 수 있습니다.
  • 프로페셔널 음성 모드: Text to Dialogue 요청에서 프로페셔널 음성 복제의 즉석 음성 복제 버전을 사용해 지연 시간을 줄이거나 표현력을 높일 수 있습니다.

SDK 릴리스

JavaScript SDK

  • v2.70.0 - 배치 및 실시간 음성-텍스트 변환 트랜스크립트 편집 타입, 테스트 호출 요약용 branchId 필터링 및 비용 필드, 지식 베이스 자동 검색, Text to Dialogue usePvcAsIvc, deepseek-v41-flash 에이전트 모델을 추가했습니다.

Python SDK

  • v2.70.0 - 배치 및 실시간 음성-텍스트 변환 트랜스크립트 편집 타입, 테스트 호출 요약용 branch_id 필터링 및 비용 필드, 지식 베이스 자동 검색, Text to Dialogue use_pvc_as_ivc, deepseek-v41-flash 에이전트 모델을 추가했습니다.

ElevenLabs CLI

  • v1.4.0 - 명시적 API 키를 사용하는 요청이 저장된 OAuth 자격 증명도 함께 전송하여 인증에 실패하던 문제를 수정했습니다. 피드백 명령 그룹에 설명을 추가하고, 생성된 에이전트 스킬에서 누락된 기능을 신고하는 방법을 추가했습니다. Flows 템플릿 엔드포인트 및 최신 스키마 타입으로 API 클라이언트를 다시 생성했습니다.

API

새 엔드포인트

Flows

  • 템플릿 나열 - GET /v1/flows/templates - 게시된 템플릿과 실행 가능한 버전을 나열합니다.
  • 템플릿 가져오기 - GET /v1/flows/templates/{template_id} - 템플릿과 실행 가능한 버전을 조회합니다.
  • 템플릿 실행 생성 - POST /v1/flows/templates/{template_id}/runs - 입력 값, 선택적 버전 및 선택적 웹훅으로 템플릿 실행을 시작합니다.
  • 템플릿 실행 나열 - GET /v1/flows/templates/{template_id}/runs - 커서 페이지네이션 및 선택적 버전 필터링으로 템플릿 실행을 나열합니다.
  • 템플릿 실행 가져오기 - GET /v1/flows/templates/{template_id}/runs/{run_id} - 템플릿 실행과 출력 상태를 조회합니다.

업데이트된 엔드포인트

음성-텍스트 변환

  • 음성을 텍스트로 변환 - POST /v1/speech-to-text
    • 최대 2,000자의 자연어 편집 지시문을 받을 수 있는 선택적 nullable transcript_edit(문자열)를 추가했습니다.
    • 응답에 선택적 nullable edited_transcript를 추가했습니다. 편집에 성공하면 필수 kind: "transcript" 및 text 필드가 포함됩니다. 편집에 실패하면 필수 kind: "error", error_type: "edit_failed", message 필드가 포함됩니다.
  • 실시간 음성-텍스트 변환은 transcript_edit(문자열)를 수락하고 필수 text 및 edited_text 필드가 있는 edited_transcript 이벤트를 내보냅니다.

ElevenAgents

  • 에이전트 생성, 에이전트 가져오기, 에이전트 업데이트
    • LLM 열거형에 gpt-6-sol, gpt-6-luna, glm-52, deepseek-v41-flash, claude-opus-5, claude-opus-5-5를 추가했습니다.
    • 알림 모니터에 모니터의 알림 전송 여부를 제어하는 선택적 nullable enabled(불리언)를 추가했습니다.
  • 대화 나열 및 텍스트 검색
    • data_collection_params 및 dynamic_variable_params에 neq 및 in 연산자를 추가했습니다. in의 값은 파이프 구분 기호를 사용합니다.
    • evaluation_params는 결과 값으로 success, failure 또는 unknown을 허용합니다.
  • 스마트 검색 - GET /v1/convai/conversations/messages/smart-search
    • 선택적 nullable branch_id(문자열)를 추가했습니다.
  • 테스트 호출 나열 - GET /v1/convai/test-invocations
    • 선택적 nullable branch_id(문자열)를 추가했습니다.
    • 테스트 호출 요약에 선택적 nullable credits_used(정수) 및 total_price(숫자)를 추가했습니다.
  • 테스트 호출 가져오기 - GET /v1/convai/test-invocations/{test_invocation_id}
    • 개별 테스트 실행에 선택적 nullable credits_used(정수) 및 charging(ConversationChargingCommonModel)을 추가했습니다.
  • 대화 시뮬레이션 및 대화 스트림 시뮬레이션
    • 선택적 new_turns_limit 기본값을 10,000에서 100으로 변경하고 최대값을 100으로 설정했습니다.
  • 크롤 작업 생성 및 크롤 작업 가져오기
    • 자동 동기화 중 링크를 따라가 새로 발견된 페이지를 추가하는 선택적 auto_discover(불리언, 기본값 false)를 추가했습니다. 이를 사용하려면 enable_auto_sync: true가 필요합니다.
  • 지식 베이스 문서 새로 고침 - POST /v1/convai/knowledge-base/{documentation_id}/refresh
    • AutoSyncInfo에 새로 고침 시 새로 발견된 페이지를 크롤링하고 추가하는지 나타내는 선택적 auto_discover(불리언, 기본값 false)를 추가했습니다.
  • MCP 서버 도구 나열 - GET /v1/convai/mcp-servers/{mcp_server_id}/tools
    • 응답에 선택적 tool_approval_statuses(배열)를 추가했습니다. 각 항목에는 필수 tool_id(문자열)와 state(up_to_date, needs_review 또는 not_approved)가 포함되며, 선택적 승인 정책 및 승인된 정의 필드가 포함됩니다.

Text to Dialogue

텍스트 음성 변환

Flows

보이스 디자인

워크스페이스

  • 서비스 계정 API 키 생성 - POST /v1/service-accounts/{service_account_user_id}/api-keys
    • 엔터프라이즈 서비스 계정 API 키를 위한 선택적 nullable tts_concurrency_limit, music_concurrency_limit, dubbing_concurrency_limit(정수)를 추가했습니다.
  • 서비스 계정 API 키 업데이트 - PATCH /v1/service-accounts/{service_account_user_id}/api-keys/{api_key_id}
    • 선택적 tts_concurrency_limit, music_concurrency_limit, dubbing_concurrency_limit를 추가했습니다. 각 필드는 정수, clear, no_update, null을 허용하며 기본값은 no_update입니다.

모델

  • 모델 나열 - GET /v1/models
    • 필수 max_characters_request_free_user 및 max_characters_request_subscribed_user를 지원 중단했습니다. 이 필드는 적용되지 않으므로 대신 maximum_text_length_per_request를 사용하세요.