ElevenAgents

  • 병렬 도구 호출: 이제 에이전트 프롬프트 구성에 enable_parallel_tool_calls(불리언, 기본값 true)가 포함됩니다. 활성화하면 지원되는 모델은 한 턴에서 여러 도구를 실행할 수 있습니다.
  • 에이전트 모델: 에이전트 LLM 옵션에 gpt-6-astra를 추가했습니다.
  • 알림: 이제 에이전트 알림에서 PagerDuty 및 webhook 알림과 함께 Slack 채널을 지원합니다.
  • 전화번호 검색: 제공업체, 발신 지원, 할당된 에이전트 및 브랜치, 라벨, 전화번호 필터를 갖춘 커서 페이지네이션 전화번호 엔드포인트를 추가했습니다.

이미지 및 비디오

  • GPT Image 2.5 모델: 이제 이미지 생성에서 gpt-image-2.5-flare 및 gpt-image-2.5-sunburst를 지원합니다. 두 모델 모두 최대 10개의 참조 이미지, max까지의 품질 수준, auto를 포함한 14개의 고정 가로세로비, 1K, 2K 또는 4K 출력을 지원합니다.

Speech Engine

  • 캐스케이드 시간 초과: 이제 Speech Engine 생성 및 업데이트 요청에서 cascade_timeout_seconds(숫자, 2–15, 기본값 4)를 지원하여 재시도 전 ElevenLabs가 업스트림 음성 엔진을 대기하는 시간을 제어할 수 있습니다.

텍스트 음성 변환

  • 멀티 컨텍스트 턴 경계: 이제 is_final_audio_for_turn 마커가 MP3 및 Opus 출력을 포함해 해당 턴의 버퍼링된 모든 바이트 뒤에 전송됩니다. 클라이언트는 PCM으로 전환하지 않고도 이 마커를 정확한 턴 경계로 사용할 수 있습니다.

SDK 릴리스

JavaScript SDK

  • v2.69.0 - 실시간 Speech to Text 래퍼에 transcriptEdit를 추가했으며, 편집된 텍스트는 edited_transcript 이벤트를 통해 전달됩니다. 데이터 레지던시 접미사가 있는 API 키에 대한 Speech Engine JWT 검증을 수정했습니다. 템플릿을 나열하고 가져오며 실행을 나열, 생성, 가져오는 phoneNumbers.listV2 및 Flows 템플릿 메서드를 추가했습니다. GPT Image 2.5, Slack 에이전트 알림, 병렬 도구 호출, gpt-6-astra, 서비스 계정 API 키 동시성 제한, Music 제로 보존, 대화 필터, MCP 도구 승인 상태를 위한 클라이언트와 타입을 재생성했습니다.

Python SDK

  • v2.69.0 - 실시간 Speech to Text 래퍼에 transcript_edit를 추가했으며, 편집된 텍스트는 edited_transcript 이벤트를 통해 전달됩니다. 데이터 레지던시 접미사가 있는 API 키에 대한 Speech Engine JWT 검증을 수정하고, ffplay가 실패하면 play가 오류를 발생시키도록 했습니다. 템플릿을 나열하고 가져오며 실행을 나열, 생성, 가져오는 phone_numbers.list_v2 및 Flows 템플릿 메서드를 추가했습니다. GPT Image 2.5, Slack 에이전트 알림, 병렬 도구 호출, gpt-6-astra, 서비스 계정 API 키 동시성 제한, Music 제로 보존, 대화 필터, MCP 도구 승인 상태를 위한 클라이언트와 타입을 재생성했습니다.

ElevenLabs CLI

  • v1.3.2 - CLI 사용에 대한 피드백을 수집할 수 있도록 선택적 --intent 메타데이터를 추가했습니다. CLI에서 지원하지 않는 워크플로를 신고할 수 있도록 elevenlabs feedback missing-capability를 추가했습니다.

API

새 엔드포인트

ElevenAgents

  • 전화번호 페이지 나열 - GET /v1/convai/v2/phone-numbers
    • 선택적 page_size(정수, 1–1,000, 기본값 100) 및 cursor(nullable 문자열) 페이지네이션 매개변수를 추가했습니다.
    • 선택적 search, label, phone_number, provider, supports_outbound, agent_id, branch_id, sort_by, sort_direction 필터를 추가했습니다. sort_by는 label 또는 phone_number를 지원하며, sort_direction의 기본값은 asc입니다.
    • 응답에는 필수 phone_numbers(배열), 선택적 nullable next_cursor(문자열), has_more(불리언, 기본값 false)가 포함됩니다.

업데이트된 엔드포인트

ElevenAgents

  • 에이전트 생성, 에이전트 가져오기 및 에이전트 업데이트
    • 프롬프트 구성에 enable_parallel_tool_calls(불리언, 기본값 true)를 추가했습니다. 워크플로 재정의는 nullable 불리언을 지원합니다.
    • LLM 열거형에 대화 시작 재정의를 포함하여 gpt-6-astra를 추가했습니다.
    • 이제 알림 통합 알리미에서 integration_type을 사용하여 pagerduty 또는 slack을 선택합니다. Slack 알리미에는 connection_id 및 channel_id(문자열)가 필요하며, channel_id는 1~64자를 지원합니다.
  • 대화 나열 및 대화 참조 확인
    • data_collection_params에서 더 이상 missing 연산자를 지원하지 않습니다. 필드가 수집되지 않은 대화를 일치시키려면 빈 값을 사용하세요.
    • dynamic_variable_params의 빈 값은 변수가 설정되지 않은 대화와 일치합니다.
  • Speech Engine 생성, Speech Engine 가져오기 및 Speech Engine 업데이트
    • cascade_timeout_seconds(숫자, 2–15)를 추가했습니다. 생성 요청의 기본값은 4이며, 업데이트 요청은 nullable 값을 지원하고 응답에는 해당 필드가 필요합니다.

이미지 및 비디오

  • 이미지 생성 만들기 - POST /v1/flows/image
    • gpt-image-2.5-flare 및 gpt-image-2.5-sunburst를 위한 요청 변형을 추가했습니다.
    • 두 변형 모두 prompt 및 model_id가 필요하고, 최대 10개의 images를 지원하며, resolution(1K, 2K 또는 4K, 기본값 1K)을 추가합니다.
    • quality는 low, medium, high, xhigh, max를 지원하며 기본값은 high입니다. aspect_ratio는 auto 및 14개의 고정 비율을 지원하며 기본값은 16:9입니다.

더빙

지식 베이스

  • 크롤 작업 생성 - POST /v1/convai/knowledge-base/crawl
    • max_depth(정수, 기본값 3)를 지원 중단했습니다. 이 필드는 이제 아무 작업도 수행하지 않으며 최소 또는 최대 제약 조건도 აღარ 이상 적용되지 않습니다.
    • 크롤 작업 메타데이터에서 더 이상 max_depth가 필요하지 않습니다.

사용자

스키마 변경 사항

텍스트 음성 변환

  • 이제 멀티 컨텍스트 WebSocket audio 및 final 메시지에서 is_final_audio_for_turn을 해당 턴의 버퍼링된 모든 바이트가 전달된 후 발생하는 것으로 정의합니다.