Hoppa till navigering

Text to Voice

  • Voice Design: Lanserade nya Text to Voice Design med Eleven v3 för att skapa anpassade röster från textbeskrivningar.

Speech to Text

  • Förbättrad talardiarisering: Lade till parametern diarization_threshold i slutpunkten Speech to Text. Finjustera balansen mellan talarprecision och totalt antal talare genom att justera tröskelvärdet mellan 0,1 och 0,4.

Professional Voice Cloning

ElevenCreative Studio

Arbetsytor

  • Tjänstkontogrupper: Tjänstkonton kan nu läggas till i arbetsytegrupper för bättre behörighetshantering och åtkomstkontroll.

  • Autentisering för arbetsyta: Lade till stöd för anslutningar med arbetsyteautentisering, vilket möjliggör säkra integreringar av webhook-verktyg med externa tjänster.

SDK:er

  • Python SDK: Släppte v2.6.0 med stöd för den senaste API-versionen och felrättningar.
  • JavaScript SDK: Släppte v2.5.0 med stöd för den senaste API-versionen och felrättningar.
  • React SDK för agentplattformen: Lade till WebRTC-stöd i 0.2.0

API

Nya slutpunkter

Uppdaterade slutpunkter

Speech to Text

Rösthantering

  • Hämta ljud för röstprov - Lade till frågeparametern remove_background_noise och flyttade den från begärandetexten till frågeparametrarna