ElevenAgents

  • Mocks de herramientas específicos para pruebas: Las simulaciones de agentes y las pruebas unitarias ahora pueden definir tool_mock_overrides, indexados por ID de herramienta, para sustituir los mocks compartidos en una prueba. ToolResponseMockConfig también añade is_error opcional (booleano, valor predeterminado false) para que un mock pueda probar rutas de error de herramientas.
  • Mensajes de workflow traducidos: Los mensajes literales de nodos Say añaden text_translations, un mapa de claves de idioma a objetos TranslatedString. El campo es opcional en la entrada y obligatorio en la salida, por lo que los validadores estrictos de respuestas deben aceptarlo.
  • Filtros de versión de conversaciones: Listar conversaciones y Búsqueda de texto en mensajes de conversaciones añaden el parámetro de consulta opcional version_id (cadena) para filtrar los resultados por versión de agente.
  • Herramienta del sistema de base de conocimientos: La configuración de agentes añade una herramienta de sistema knowledge_base con enabled_strategies (SearchStrategy[]) configurables. Las consultas RAG de la base de conocimientos del agente añaden use_agent_defaults opcional (booleano, valor predeterminado true); establécelo en false para usar una configuración de recuperación neutra y conservar el modelo de incrustaciones del agente.
  • Detección de actividad de voz del agente: Los esquemas de creación, actualización, respuesta y anulación de workflow de agentes añaden la configuración vad. Actualmente, VADConfig admite background_voice_detection (booleano, valor predeterminado false).
  • LLM personalizados mediante WebSocket: CustomLLMAPIType añade websocket.
  • Controles de memoria de archivos: La configuración de entrada de archivos del widget añade max_files_in_memory (entero, 1–30, valor predeterminado 10). Los archivos que superen el límite se resumen y se liberan de la memoria; max_files_per_conversation debe ser -1 o, como mínimo, el límite de memoria.
  • Ocultación de entrada DTMF: DTMFInputConfig añade redact_input opcional (booleano, valor predeterminado false) para sustituir los dígitos del teclado del interlocutor en transcripciones, registros de conversación y análisis. Los dígitos repetidos por el agente o enviados a herramientas no cambian.

Voz a Texto

  • Detección de entidades en tiempo real: Scribe v2 Realtime añade la opción de consulta entity_detection. Acepta all, un tipo o categoría de entidad, o una matriz de tipos y categorías, y emite entidades detectadas en eventos committed_transcript_entities. Consulta la guía de detección de entidades para ver las categorías compatibles.

Voces

  • Replicación de voz entre residencias de datos: Hemos añadido POST /v1/voices/{voice_id}/replicate-to-isolated-environment para copiar una voz de Clonar Voz IA Instantáneo o Diseño de Voz a un espacio de trabajo del mismo grupo de facturación consolidada. Las solicitudes requieren target_workspace_id (cadena) y aceptan preserve_voice_id (booleano, valor predeterminado true); las respuestas devuelven el voice_id de destino.
  • Metadatos de personajes: Las respuestas de personajes añaden recommended_voice_ids (matriz de cadenas, valor predeterminado []), los metadatos añaden role anulable (CharacterRole) y CharacterAge sustituye middle-aged por middle_aged.

Lanzamientos de SDK

Paquetes

Servidor MCP

  • v0.12.1 - Incluye las actualizaciones de herramientas de la v0.11 y una actualización de dependencias que resuelve 44 alertas de seguridad.
  • v0.11.0 - Se ha añadido simulate_conversation con comportamiento de usuario simulado configurable, criterios de evaluación, salida de transcripción y análisis de aprobado/suspenso. La herramienta speech_to_text ahora usa scribe_v2 de forma predeterminada y voice_clone ahora envía el contenido de los archivos de audio en lugar de cadenas de ruta.

API

Nuevas rutas

Voces

  • POST /v1/voices/{voice_id}/replicate-to-isolated-environment
    • Replica una voz de Clonar Voz IA Instantáneo o Diseño de Voz en el entorno aislado de otro espacio de trabajo
    • Requiere target_workspace_id (cadena)
    • Acepta preserve_voice_id opcional (booleano, valor predeterminado true)
    • Devuelve voice_id obligatorio (cadena)

Rutas actualizadas

ElevenAgents

  • Listar conversaciones - GET /v1/convai/conversations
    • Se ha añadido el parámetro de consulta opcional version_id (cadena)
  • Búsqueda de texto en mensajes de conversaciones - GET /v1/convai/conversations/messages/text-search
    • Se ha añadido el parámetro de consulta opcional version_id (cadena)
  • POST /v1/convai/agents/{agent_id}/knowledge-base/rag-query
    • Se ha añadido el campo de solicitud opcional use_agent_defaults (booleano, valor predeterminado true)

Cambios de esquema

ElevenAgents

  • Las cargas de simulaciones y pruebas unitarias añaden mapas tool_mock_overrides opcionales; ToolResponseMockConfig añade is_error opcional (booleano, valor predeterminado false)
  • SayNodeLiteralMessage añade text_translations (mapa de TranslatedString); el campo es opcional en la entrada y obligatorio en la salida
  • La configuración de agentes añade knowledge_base (KnowledgeBaseToolConfig) y vad (VADConfig)
  • CustomLLMAPIType añade websocket
  • FileInputConfig añade max_files_in_memory (entero, 1–30, valor predeterminado 10)
  • DTMFInputConfig añade redact_input opcional (booleano, valor predeterminado false)
  • La configuración de agentes en tiempo real ahora usa eleven_realtime_v1_mini de forma predeterminada

Voces

  • Las respuestas de personajes añaden recommended_voice_ids (matriz de cadenas, valor predeterminado [])
  • Los metadatos de personajes añaden role anulable (CharacterRole)
  • Cambio incompatible: CharacterAge sustituye middle-aged por middle_aged; los clientes que envíen el valor anterior deben migrar

Texto a Voz

  • Cambio incompatible: se han eliminado AudioFilterId y audio_filter de los esquemas de configuración de Texto a Voz de ElevenAgents