음성 텍스트 변환

  • scribe_v1_experimental: 여러 언어가 포함된 오디오 파일에서의 성능 향상, 오디오와 무음이 교차할 때의 환각 감소, 오디오 태그 개선 등을 포함한 새로운 실험적 Scribe v1 모델 미리보기를 출시했습니다. 새 모델은 API에서 scribe_v1_experimental 모델명으로 이용할 수 있습니다.

텍스트 음성 변환

  • A-law 형식 지원: 유럽 전화 시스템과 통합할 수 있도록 8kHz 샘플 레이트의 a-law 형식을 추가했습니다.
  • 할당량 문제 수정: 일부 요청이 할당량 초과로 잘못 거부되던 데이터베이스 버그를 수정했습니다.

Agents Platform

  • 문서 유형 필터링: 지식 베이스 문서를 유형(파일, URL 또는 텍스트)별로 필터링하는 기능을 추가했습니다.
  • 비오디오 에이전트: 오디오를 출력하지 않지만 응답 트랜스크립트를 전송하고 도구를 사용할 수 있는 대화형 에이전트를 지원합니다. 오디오 클라이언트 이벤트를 제거하면 비오디오 에이전트를 활성화할 수 있습니다.
  • 개선된 에이전트 템플릿: 향상된 구성과 프롬프트로 모든 에이전트 템플릿을 업데이트했습니다. 시스템 프롬프트 개선 방법은 여기에서 자세히 확인하세요.
  • 멈춘 내보내기 수정: 내보내기가 장시간 멈추던 문제를 수정했습니다.

ElevenCreative Studio

  • 볼륨 정규화 수정: 볼륨 정규화가 활성화된 경우 프로젝트 스냅샷 스트리밍에 발생하던 문제를 수정했습니다.

새 API 엔드포인트

  • 강제 정렬: 자막 생성에 적합한, 오디오와 텍스트를 정렬하는 새 강제 정렬 엔드포인트를 추가했습니다.
  • 일괄 통화: 여러 수신자에게 통화를 예약할 수 있는 일괄 통화 엔드포인트를 추가했습니다.

API

새 엔드포인트

업데이트된 엔드포인트

텍스트 음성 변환

음성

  • 음성 가져오기 - 컬렉션별 음성 필터링을 위한 collection_id 매개변수를 추가했습니다.

지식 베이스

  • 지식 베이스 가져오기 - 유형별 문서 필터링을 위한 types 매개변수를 추가했습니다.
  • 지식 베이스 문서를 생성하는 일반 엔드포인트는 특수 엔드포인트 사용을 권장하며 더 이상 사용되지 않는 것으로 표시했습니다.

사용자 구독

  • 사용자 구독 가져오기 - 워크스페이스에서 사용한 프로페셔널 음성 수를 추적하는 professional_voice_slots_used 속성을 추가했습니다.

Agents Platform

  • 통화 종료 전 최대 대기 시간을 설정하는 silence_end_call_timeout 매개변수를 추가했습니다.
  • /v1/convai/agents/{agent_id}/add-secret 엔드포인트를 제거했습니다(이제 워크스페이스 시크릿 엔드포인트에서 처리).