ElevenAgents

  • 테스트별 도구 모의 객체: 이제 에이전트 시뮬레이션 및 단위 테스트에서 도구 ID를 키로 하는 tool_mock_overrides를 정의하여 하나의 테스트에 대해 공유 모의 객체를 대체할 수 있습니다. ToolResponseMockConfig에는 모의 객체가 도구 실패 경로를 테스트할 수 있도록 선택적 is_error(불리언, 기본값 false)도 추가됩니다.
  • 번역된 워크플로 메시지: 리터럴 Say 노드 메시지에 언어 키와 TranslatedString 객체의 맵인 text_translations가 추가됩니다. 이 필드는 입력에서는 선택 사항이고 출력에서는 필수이므로 엄격한 응답 검증기는 이를 허용해야 합니다.
  • 대화 버전 필터: 대화 나열 및 대화 메시지 텍스트 검색에 에이전트 버전별로 결과를 필터링하는 선택적 version_id 쿼리 매개변수(문자열)가 추가됩니다.
  • 지식 베이스 시스템 도구: 에이전트 구성에 구성 가능한 enabled_strategies(SearchStrategy[])를 갖는 knowledge_base 시스템 도구가 추가됩니다. 에이전트 지식 베이스 RAG 쿼리에 선택적 use_agent_defaults(불리언, 기본값 true)가 추가됩니다. 이를 false로 설정하면 에이전트의 임베딩 모델은 유지하면서 중립적인 검색 설정을 사용합니다.
  • 에이전트 음성 활동 감지: 에이전트 생성, 업데이트, 응답 및 워크플로 오버라이드 스키마에 vad 구성이 추가됩니다. 현재 VADConfig는 background_voice_detection(불리언, 기본값 false)을 지원합니다.
  • WebSocket 사용자 지정 LLM: CustomLLMAPIType에 websocket이 추가됩니다.
  • 파일 메모리 제어: 위젯 파일 입력 구성에 max_files_in_memory(정수, 1~30, 기본값 10)가 추가됩니다. 제한을 초과한 파일은 요약된 후 메모리에서 해제되며, max_files_per_conversation은 -1이거나 최소 메모리 제한 이상이어야 합니다.
  • DTMF 입력 마스킹: DTMFInputConfig에 통화자의 키패드 숫자를 트랜스크립트, 대화 로그 및 분석에서 대체하는 선택적 redact_input(불리언, 기본값 false)이 추가됩니다. 에이전트가 반복하거나 도구로 전달한 숫자는 변경되지 않습니다.

음성 텍스트 변환

  • 실시간 엔터티 감지: Scribe v2 Realtime에 entity_detection 쿼리 옵션이 추가됩니다. all, 하나의 엔터티 유형 또는 카테고리, 혹은 유형 및 카테고리 배열을 허용하며 감지된 엔터티를 committed_transcript_entities 이벤트로 내보냅니다. 지원되는 카테고리는 엔터티 감지 가이드를 참조하세요.

음성

  • 데이터 레지던시 간 음성 복제: 동일한 통합 결제 그룹의 워크스페이스로 Instant Voice Clone 또는 Voice Design 음성을 복사하는 POST /v1/voices/{voice_id}/replicate-to-isolated-environment를 추가했습니다. 요청에는 target_workspace_id(문자열)가 필요하며 preserve_voice_id(불리언, 기본값 true)를 받을 수 있습니다. 응답은 대상 voice_id를 반환합니다.
  • 캐릭터 메타데이터: 캐릭터 응답에 recommended_voice_ids(문자열 배열, 기본값 [])가 추가되고, 메타데이터에 nullable role(CharacterRole)이 추가되며, CharacterAge에서는 middle-aged가 middle_aged로 대체됩니다.

SDK 릴리스

패키지

MCP 서버

  • v0.12.1 - v0.11 도구 업데이트와 44개의 보안 경고를 해결하는 종속성 새로 고침을 포함합니다.
  • v0.11.0 - 구성 가능한 시뮬레이션 사용자 동작, 평가 기준, 트랜스크립트 출력, 통과/실패 분석을 갖춘 simulate_conversation을 추가했습니다. 이제 speech_to_text 도구는 기본적으로 scribe_v2를 사용하며, voice_clone은 경로 문자열 대신 오디오 파일 콘텐츠를 전송합니다.

API

새 엔드포인트

음성

  • POST /v1/voices/{voice_id}/replicate-to-isolated-environment
    • Instant Voice Clone 또는 Voice Design 음성을 다른 워크스페이스의 격리된 환경으로 복제합니다.
    • target_workspace_id(문자열)가 필요합니다.
    • 선택적 preserve_voice_id(불리언, 기본값 true)를 받습니다.
    • 필수 voice_id(문자열)를 반환합니다.

업데이트된 엔드포인트

ElevenAgents

  • 대화 나열 - GET /v1/convai/conversations
    • 선택적 version_id(문자열) 쿼리 매개변수를 추가했습니다.
  • 대화 메시지 텍스트 검색 - GET /v1/convai/conversations/messages/text-search
    • 선택적 version_id(문자열) 쿼리 매개변수를 추가했습니다.
  • POST /v1/convai/agents/{agent_id}/knowledge-base/rag-query
    • 선택적 use_agent_defaults(불리언, 기본값 true) 요청 필드를 추가했습니다.

스키마 변경 사항

ElevenAgents

  • 시뮬레이션 및 단위 테스트 페이로드에 선택적 tool_mock_overrides 맵이 추가되고, ToolResponseMockConfig에 선택적 is_error(불리언, 기본값 false)가 추가됩니다.
  • SayNodeLiteralMessage에 text_translations(TranslatedString 맵)가 추가됩니다. 이 필드는 입력에서는 선택 사항이고 출력에서는 필수입니다.
  • 에이전트 구성에 knowledge_base(KnowledgeBaseToolConfig) 및 vad(VADConfig)가 추가됩니다.
  • CustomLLMAPIType에 websocket이 추가됩니다.
  • FileInputConfig에 max_files_in_memory(정수, 1~30, 기본값 10)가 추가됩니다.
  • DTMFInputConfig에 선택적 redact_input(불리언, 기본값 false)이 추가됩니다.
  • 이제 실시간 에이전트 구성의 기본값은 eleven_realtime_v1_mini입니다.

음성

  • 캐릭터 응답에 recommended_voice_ids(문자열 배열, 기본값 [])가 추가됩니다.
  • 캐릭터 메타데이터에 nullable role(CharacterRole)이 추가됩니다.
  • 호환성 깨짐: CharacterAge에서 middle-aged가 middle_aged로 대체됩니다. 이전 값을 전송하는 클라이언트는 마이그레이션해야 합니다.

텍스트 음성 변환

  • 호환성 깨짐: ElevenAgents 텍스트 음성 변환 구성 스키마에서 AudioFilterId 및 audio_filter를 제거했습니다.