음성

  • 새 PVC 흐름: 프로페셔널 음성 복제 생성을 위한 새 흐름을 추가했습니다. 여기에서 사용해 보세요.

Agents Platform

  • 에이전트 간 전환: 새 시스템 도구를 통해 에이전트 간 전환을 지원하여 더 복잡한 대화 흐름을 구현할 수 있습니다. 자세한 내용은 에이전트 전환 도구 문서를 참조하세요.
  • 향상된 도구 디버깅: 더 쉽게 디버깅할 수 있도록 대화 기록에서 도구 실행 세부 정보가 표시되는 방식을 개선했습니다.
  • 언어 감지 수정: 언어 감지 도구가 강제로 호출되던 문제를 해결했습니다.

더빙

  • 렌더 엔드포인트: 더빙 프로젝트 내 특정 언어의 오디오 또는 비디오 렌더를 다시 생성하는 새 엔드포인트를 도입했습니다. 누락된 트랜스크립션이나 번역은 자동으로 처리됩니다. Render Dub 엔드포인트를 참조하세요.
  • 크기 제한 증가: 더빙 프로젝트에 허용되는 최대 파일 크기를 1GiB로 늘렸습니다.

API

새 엔드포인트

업데이트된 엔드포인트

발음 사전

음성 텍스트 변환

  • 음성 텍스트 변환 엔드포인트(POST /v1/speech-to-text)를 업데이트했습니다.
    • 공개 S3 또는 GCS URL(최대 2GB)에서 직접 트랜스크립션할 수 있도록 cloud_storage_url 매개변수를 추가했습니다.
    • file 매개변수를 선택 사항으로 변경했습니다. 이제 file 또는 cloud_storage_url 중 정확히 하나를 제공해야 합니다.

음성 변환

Agents Platform

음성

  • GET /v1/voices/{voice_id}의 samples 필드를 업데이트하여 선택적 trim_start 및 trim_end 매개변수를 포함했습니다.

AudioNative