텍스트 음성 디자인
- 보이스 디자인: 텍스트 설명으로 사용자 지정 음성을 만들 수 있는 Eleven v3 기반의 새 텍스트 음성 디자인을 출시했습니다.
음성 텍스트 변환
- 향상된 화자 분리: 음성 텍스트 변환 엔드포인트에
diarization_threshold파라미터를 추가했습니다. 임곗값을 0.1~0.4 사이에서 조정하여 화자 정확도와 전체 화자 수 간의 균형을 세밀하게 조정할 수 있습니다.
프로페셔널 음성 복제
- 배경 소음 제거: 오디오 분리 모델을 사용해 음성 샘플을 정리하는
remove_background_noise를 추가하여 더 높은 품질의 학습 데이터를 제공합니다.
ElevenCreative Studio
- 비디오 지원 감지: 챕터에 비디오 콘텐츠가 포함되어 있는지를 나타내도록 챕터 응답에
has_video속성을 추가했습니다.
워크스페이스
-
서비스 계정 그룹: 이제 서비스 계정을 워크스페이스 그룹에 추가하여 권한 관리와 액세스 제어를 개선할 수 있습니다.
-
워크스페이스 인증: 워크스페이스 인증 연결을 지원하여 외부 서비스와의 안전한 웹훅 도구 통합을 구현합니다.
SDK
- Python SDK: 최신 API 지원 및 버그 수정이 포함된 v2.6.0을 출시했습니다.
- JavaScript SDK: 최신 API 지원 및 버그 수정이 포함된 v2.5.0을 출시했습니다.
- React Agents Platform SDK: 0.2.0에 WebRTC 지원 추가
API
API 변경 사항 보기
새 엔드포인트
- 새 엔드포인트 2개를 추가했습니다.
- 음성 디자인 - 텍스트 설명에서 음성 프리뷰를 생성합니다.
- 프리뷰에서 음성 생성 - 음성 프리뷰를 영구 음성으로 변환합니다.
업데이트된 엔드포인트
음성 텍스트 변환
- 음성을 텍스트로 변환 - 화자 분리를 세밀하게 조정하는
diarization_threshold파라미터 추가
음성 관리
- 음성 샘플 오디오 조회 -
remove_background_noise쿼리 파라미터를 추가하고 요청 본문에서 쿼리 파라미터로 이동