Text to Speech
- Unterstützung von Sprachcodes: Alle Text-to-Speech-Modelle unterstützen jetzt Sprachcodes für eine bessere Ausgabe. Für die Modelle Eleven v3, Flash und Turbo wurde die Normalisierung aktiviert, um Audioqualität und Konsistenz zu verbessern.
Agents Platform
- Verlauf von Multi-Voice-Agenten: Nachrichten von Multi-Voice-Agenten werden jetzt im Gesprächsverlauf klar nach Stimmen getrennt angezeigt. So lässt sich leichter nachvollziehen, welche Stimme welchen Teil eines Gesprächs gesprochen hat.
SDK-Veröffentlichungen
JavaScript SDK
- v2.15.0 - Fügt Unterstützung für die neue Funktion zum Remixen von Stimmen hinzu
Python SDK
- v2.15.0 - Fügt Unterstützung für die neue Funktion zum Remixen von Stimmen hinzu. Außerdem wurde ein Problem mit Pydantic behoben.
React-Komponenten
- @elevenlabs/react@0.6.1 - Ausgabebytes sowie Wechsel zwischen Geräteingabe und -ausgabe korrigiert
- @elevenlabs/client@0.6.1 - Ausgabebytes sowie Wechsel zwischen Geräteingabe und -ausgabe korrigiert
MCP Server
- v0.7.0 - Neueste Version des ElevenLabs MCP Server mit neuen Funktionen und Verbesserungen für die Claude-Desktop-Integration. Enthält den neuen Parameter
loopfür die SFX-Generierung.
API
API-Änderungen anzeigen
Neue Endpunkte
- Stimme remixen - Stimmvarianten aus bestehenden Stimmen erstellen
- Transkript nach ID abrufen - Bestimmte Transkriptionsergebnisse abrufen
Aktualisierte Endpunkte
Abwärtskompatible Änderungen
- Projekt abrufen - Optionalen Abfrageparameter
share_idfür die Projektfreigabe hinzugefügt - Sprache in Text umwandeln - Parameter
enable_loggingfür eine bessere Steuerung der Protokollierung geändert
Alle API-Änderungen in dieser Version sind abwärtskompatibel und beeinträchtigen keine bestehenden Integrationen.