Text to Voice
- Voice Design: Neues Text to Voice Design mit Eleven v3 zum Erstellen benutzerdefinierter Stimmen aus Textbeschreibungen veröffentlicht.
Speech to Text
- Verbesserte Sprechertrennung: Parameter
diarization_thresholdzum Endpunkt Speech to Text hinzugefügt. Passen Sie den Schwellenwert zwischen 0.1 und 0.4 an, um das Verhältnis zwischen Sprechergenauigkeit und Gesamtzahl der Sprecher abzustimmen.
Professionelles KI-Stimme klonen
- Entfernung von Hintergrundgeräuschen:
remove_background_noisehinzugefügt, um Sprachsamples mit Audioisolationsmodellen für hochwertigere Trainingsdaten zu bereinigen.
ElevenCreative Studio
- Erkennung von Videounterstützung: Eigenschaft
has_videozu Kapitelantworten hinzugefügt. Sie zeigt an, ob Kapitel Videoinhalte enthalten.
Workspaces
-
Dienstkonto-Gruppen: Dienstkonten können jetzt für eine bessere Berechtigungsverwaltung und Zugriffskontrolle zu Workspace-Gruppen hinzugefügt werden.
-
Workspace-Authentifizierung: Unterstützung für Workspace-Authentifizierungsverbindungen hinzugefügt. Das ermöglicht sichere Webhook-Tool-Integrationen mit externen Diensten.
SDKs
- Python SDK: v2.6.0 mit aktueller API-Unterstützung und Fehlerbehebungen veröffentlicht.
- JavaScript SDK: v2.5.0 mit aktueller API-Unterstützung und Fehlerbehebungen veröffentlicht.
- React Agents Platform SDK: WebRTC-Unterstützung in 0.2.0 hinzugefügt
API
API-Änderungen anzeigen
Neue Endpunkte
- 2 neue Endpunkte hinzugefügt:
- Stimme entwerfen - Stimmvorschauen aus Textbeschreibungen erstellen
- Stimme aus Vorschau erstellen - Stimmvorschauen in dauerhafte Stimmen umwandeln
Aktualisierte Endpunkte
Speech to Text
- Sprache in Text umwandeln - Parameter
diarization_thresholdzur Feinabstimmung der Sprechertrennung hinzugefügt
Stimmenverwaltung
- Audio eines Sprachsamples abrufen - Abfrageparameter
remove_background_noisehinzugefügt und aus dem Anfragekörper in die Abfrageparameter verschoben