Agents Platform

  • Unterstützung für benutzerdefinierte Azure OpenAI-LLMs: Unterstützung für auf Azure gehostete OpenAI-Modelle in benutzerdefinierten LLM-Konfigurationen hinzugefügt. Bei Verwendung eines Azure-Endpunkts ist jetzt ein neues Pflichtfeld für die API-Version in der UI verfügbar.
  • Genesys-Ausgabevariablen: Unterstützung für Ausgabevariablen bei Verwendung von Genesys-Integrationen hinzugefügt. Dies ermöglicht bessere Anrufanalysen und Datenerfassung.
  • Einstellung der Gemini 2.5 Preview-Modelle: Die Modelle gemini-2.5-flash-preview-05-20 und gemini-2.5-flash-preview-04-17 wurden in der Agents Platform eingestellt, da Google sie am 15. Juli einstellt. Alle Agents, die diese Modelle verwenden, werden bei ihrer nächsten Nutzung automatisch auf gemini-2.5-flash umgestellt. Es ist keine Aktion erforderlich.
  • WebRTC-Rollout: Der schrittweise Rollout von WebRTC-Funktionen zur Verbesserung von Verbindungsstabilität und Leistung wurde gestartet. Der WebRTC-Modus kann im React SDK ausgewählt werden und wird in 11.ai verwendet.
  • Tastenton des Tastenfelds: Ein Problem bei der Wiedergabe von Tastentönen auf Twilio wurde behoben. Siehe Dokumentation zu Tastentönen.

Stimmen

  • Navigation in Sprachkollektionen: Schnelle Navigation von Sprachvorschaukollektionen zu allen verfügbaren Stimmen in der jeweiligen Sprache hinzugefügt. So können Sie Stimmen nach Sprache einfacher erkunden.

Text zu Stimme

  • Vorschau-Streaming: Neuer Streaming-Endpunkt für Text-zu-Stimme-Vorschauen hinzugefügt, der das Echtzeit-Streaming generierter Stimmvorschauen über /v1/text-to-voice/{generated_voice_id}/stream ermöglicht.
  • Verbessertes Stimmendesign: Die Option stream_previews zum Stimmendesign-Endpunkt hinzugefügt. Sie ermöglicht die reine Streaming-Generierung von Vorschauen für bessere Leistung.
  • Verbesserte Parametersteuerung: Die Parameter loudness, Qualität und Guidance Scale mit besseren Steuerungsoptionen für präzisere Stimmgenerierung erweitert.

ElevenCreative Studio

  • Podcast-Anpassung: Unterstützung für Intro- und Outro-Text bei der Podcast-Erstellung sowie Prompts für benutzerdefinierte Anweisungen zur besseren Steuerung von Stil und Ton hinzugefügt.

SDKs

API

Neue Endpunkte

Aktualisierte Endpunkte

Text zu Stimme

  • Stimmvorschauen erstellen - Beschreibungen der Parameter loudness, quality und guidance_scale erweitert
  • Stimme designen - Eigenschaft stream_previews für die reine Streaming-Generierung von Vorschauen hinzugefügt

ElevenCreative Studio

  • Podcast erstellen - Eigenschaften intro, outro und instructions_prompt hinzugefügt

Agents Platform