Text to Voice
- Voice Design: Lanserade nya Text to Voice Design med Eleven v3 för att skapa anpassade röster från textbeskrivningar.
Speech to Text
- Förbättrad talardiarisering: Lade till parametern
diarization_thresholdi slutpunkten Speech to Text. Finjustera balansen mellan talarprecision och totalt antal talare genom att justera tröskelvärdet mellan 0,1 och 0,4.
Professional Voice Cloning
- Borttagning av bakgrundsbrus: Lade till
remove_background_noiseför att rensa röstprover med ljudisoleringsmodeller och få träningsdata av bättre kvalitet.
ElevenCreative Studio
- Identifiering av videostöd: Lade till egenskapen
has_videoi kapitelsvar för att indikera om kapitel innehåller videoinnehåll.
Arbetsytor
-
Tjänstkontogrupper: Tjänstkonton kan nu läggas till i arbetsytegrupper för bättre behörighetshantering och åtkomstkontroll.
-
Autentisering för arbetsyta: Lade till stöd för anslutningar med arbetsyteautentisering, vilket möjliggör säkra integreringar av webhook-verktyg med externa tjänster.
SDK:er
- Python SDK: Släppte v2.6.0 med stöd för den senaste API-versionen och felrättningar.
- JavaScript SDK: Släppte v2.5.0 med stöd för den senaste API-versionen och felrättningar.
- React SDK för agentplattformen: Lade till WebRTC-stöd i 0.2.0
API
Visa API-ändringar
Nya slutpunkter
- Lade till 2 nya slutpunkter:
- Designa en röst - Skapa röstförhandsvisningar från textbeskrivningar
- Skapa röst från förhandsvisning - Konvertera röstförhandsvisningar till permanenta röster
Uppdaterade slutpunkter
Speech to Text
- Konvertera tal till text - Lade till parametern
diarization_thresholdför att finjustera talarseparering
Rösthantering
- Hämta ljud för röstprov - Lade till frågeparametern
remove_background_noiseoch flyttade den från begärandetexten till frågeparametrarna