음성
- 새 PVC 흐름: 프로페셔널 음성 복제 생성을 위한 새 흐름을 추가했습니다. 여기에서 사용해 보세요.
Agents Platform
- 에이전트 간 전환: 새 시스템 도구를 통해 에이전트 간 전환을 지원하여 더 복잡한 대화 흐름을 구현할 수 있습니다. 자세한 내용은 에이전트 전환 도구 문서를 참조하세요.
- 향상된 도구 디버깅: 더 쉽게 디버깅할 수 있도록 대화 기록에서 도구 실행 세부 정보가 표시되는 방식을 개선했습니다.
- 언어 감지 수정: 언어 감지 도구가 강제로 호출되던 문제를 해결했습니다.
더빙
- 렌더 엔드포인트: 더빙 프로젝트 내 특정 언어의 오디오 또는 비디오 렌더를 다시 생성하는 새 엔드포인트를 도입했습니다. 누락된 트랜스크립션이나 번역은 자동으로 처리됩니다. Render Dub 엔드포인트를 참조하세요.
- 크기 제한 증가: 더빙 프로젝트에 허용되는 최대 파일 크기를 1GiB로 늘렸습니다.
API
API 변경 사항 보기
새 엔드포인트
- 렌더 더빙 엔드포인트 추가 - 특정 언어의 더빙을 다시 생성합니다.
업데이트된 엔드포인트
발음 사전
GET /v1/pronunciation-dictionaries/{pronunciation_dictionary_id}/엔드포인트 및 관련 구성 요소의 응답을 업데이트하여permission_on_resource필드를 포함했습니다.
음성 텍스트 변환
- 음성 텍스트 변환 엔드포인트(
POST /v1/speech-to-text)를 업데이트했습니다.- 공개 S3 또는 GCS URL(최대 2GB)에서 직접 트랜스크립션할 수 있도록
cloud_storage_url매개변수를 추가했습니다. file매개변수를 선택 사항으로 변경했습니다. 이제file또는cloud_storage_url중 정확히 하나를 제공해야 합니다.
- 공개 S3 또는 GCS URL(최대 2GB)에서 직접 트랜스크립션할 수 있도록
음성 변환
POST /v1/speech-to-speech/{voice_id}에 PCM 입력 시 더 낮은 지연 시간을 위한 선택적file_format매개변수(pcm_s16le_16또는other)를 추가했습니다.
Agents Platform
- 에이전트 간 전환 도구를 지원하도록 구성 요소를 업데이트했습니다.
음성
GET /v1/voices/{voice_id}의samples필드를 업데이트하여 선택적trim_start및trim_end매개변수를 포함했습니다.
AudioNative
Get /v1/audio-native/{project_id}/settings를 업데이트하여status필드(processing또는ready)를 포함했습니다.