Plataforma de Agentes

  • Compatibilidad con LLM personalizados de Azure OpenAI: Se ha añadido compatibilidad con modelos de OpenAI alojados en Azure en configuraciones de LLM personalizados. Al usar una ruta de API de Azure, ahora hay disponible en la interfaz un nuevo campo obligatorio para la versión de la API.
  • Variables de salida de Genesys: Se ha añadido compatibilidad con variables de salida al usar integraciones de Genesys, lo que permite mejorar el análisis de llamadas y la recopilación de datos.
  • Retirada de los modelos de vista previa de Gemini 2.5: Los modelos gemini-2.5-flash-preview-05-20 y gemini-2.5-flash-preview-04-17 se han retirado de la Plataforma de Agentes, ya que Google los retirará el 15 de julio. Todos los agentes que utilicen estos modelos pasarán automáticamente a gemini-2.5-flash la próxima vez que se usen. No tienes que hacer nada.
  • Despliegue de WebRTC: Hemos iniciado el despliegue gradual de capacidades de WebRTC para mejorar la estabilidad y el rendimiento de la conexión. El modo WebRTC se puede seleccionar en el SDK de React y se usa en 11.ai.
  • Tono de teclado: Se ha corregido un problema que afectaba a la reproducción de tonos de teclado en Twilio. Consulta la documentación sobre tonos de teclado.

Voces

  • Navegación por colecciones de idiomas: Se ha añadido una navegación rápida desde las colecciones de vista previa de idiomas para ver todas las voces disponibles en ese idioma, lo que facilita explorar las opciones de voz por idioma.

Texto a Voz

  • Streaming de vistas previas: Se ha añadido una nueva ruta de streaming para vistas previas de Texto a Voz, que permite transmitir en tiempo real las vistas previas de voz generadas mediante /v1/text-to-voice/{generated_voice_id}/stream.
  • Diseño de voz mejorado: Se ha añadido la opción stream_previews a la ruta de diseño de voz, lo que permite generar vistas previas solo por streaming para mejorar el rendimiento.
  • Controles de parámetros mejorados: Se han mejorado las opciones de control de los parámetros loudness, calidad y escala de orientación para generar voces con mayor precisión.

Studio de ElevenCreative

  • Personalización de podcasts: Se ha añadido compatibilidad con texto de introducción y cierre al crear podcasts, junto con prompts de instrucciones personalizadas para controlar mejor el estilo y el tono.

SDK

API

Nuevas rutas de API

Rutas de API actualizadas

Texto a Voz

  • Crear vistas previas de voz - Se han mejorado las descripciones de los parámetros loudness, quality y guidance_scale
  • Diseñar voz - Se ha añadido la propiedad stream_previews para generar vistas previas solo por streaming

Studio de ElevenCreative

  • Crear podcast - Se han añadido las propiedades intro, outro e instructions_prompt

Plataforma de Agentes