텍스트 음성 디자인

  • 보이스 디자인: 텍스트 설명으로 사용자 지정 음성을 만들 수 있는 Eleven v3 기반의 새 텍스트 음성 디자인을 출시했습니다.

음성 텍스트 변환

  • 향상된 화자 분리: 음성 텍스트 변환 엔드포인트에 diarization_threshold 파라미터를 추가했습니다. 임곗값을 0.1~0.4 사이에서 조정하여 화자 정확도와 전체 화자 수 간의 균형을 세밀하게 조정할 수 있습니다.

프로페셔널 음성 복제

  • 배경 소음 제거: 오디오 분리 모델을 사용해 음성 샘플을 정리하는 remove_background_noise를 추가하여 더 높은 품질의 학습 데이터를 제공합니다.

ElevenCreative Studio

워크스페이스

  • 서비스 계정 그룹: 이제 서비스 계정을 워크스페이스 그룹에 추가하여 권한 관리와 액세스 제어를 개선할 수 있습니다.

  • 워크스페이스 인증: 워크스페이스 인증 연결을 지원하여 외부 서비스와의 안전한 웹훅 도구 통합을 구현합니다.

SDK

  • Python SDK: 최신 API 지원 및 버그 수정이 포함된 v2.6.0을 출시했습니다.
  • JavaScript SDK: 최신 API 지원 및 버그 수정이 포함된 v2.5.0을 출시했습니다.
  • React Agents Platform SDK: 0.2.0에 WebRTC 지원 추가

API

새 엔드포인트

업데이트된 엔드포인트

음성 텍스트 변환

음성 관리