Text to Voice

  • Voice Design: Neues Text to Voice Design mit Eleven v3 zum Erstellen benutzerdefinierter Stimmen aus Textbeschreibungen veröffentlicht.

Speech to Text

  • Verbesserte Sprechertrennung: Parameter diarization_threshold zum Endpunkt Speech to Text hinzugefügt. Passen Sie den Schwellenwert zwischen 0.1 und 0.4 an, um das Verhältnis zwischen Sprechergenauigkeit und Gesamtzahl der Sprecher abzustimmen.

Professionelles KI-Stimme klonen

  • Entfernung von Hintergrundgeräuschen: remove_background_noise hinzugefügt, um Sprachsamples mit Audioisolationsmodellen für hochwertigere Trainingsdaten zu bereinigen.

ElevenCreative Studio

Workspaces

  • Dienstkonto-Gruppen: Dienstkonten können jetzt für eine bessere Berechtigungsverwaltung und Zugriffskontrolle zu Workspace-Gruppen hinzugefügt werden.

  • Workspace-Authentifizierung: Unterstützung für Workspace-Authentifizierungsverbindungen hinzugefügt. Das ermöglicht sichere Webhook-Tool-Integrationen mit externen Diensten.

SDKs

  • Python SDK: v2.6.0 mit aktueller API-Unterstützung und Fehlerbehebungen veröffentlicht.
  • JavaScript SDK: v2.5.0 mit aktueller API-Unterstützung und Fehlerbehebungen veröffentlicht.
  • React Agents Platform SDK: WebRTC-Unterstützung in 0.2.0 hinzugefügt

API

Neue Endpunkte

Aktualisierte Endpunkte

Speech to Text

Stimmenverwaltung