Vad är Eleven v3?
Vi rekommenderar att du byter till Eleven v4 och testar det med ditt eget innehåll.
Eleven v3 är en känslomässigt rik och uttrycksfull Text to Speech-modell. Den producerar naturligt, verklighetstroget tal med stort känslomässigt omfång och kontextförståelse på över 70 språk.
Eleven v3 erbjuder:
- Stöd för ljudtaggar
- känslor:
[sad][angry][happily] - instruktioner för framförande:
[whispers][shouts] - icke-verbala reaktioner:
[laughs][clears throat][sighs]
- känslor:
- Dialogläge för naturligt ljud med flera talare
- Stöd för över 70 språk
Den här modellen fungerar bra för karaktärssamtal, ljudboksinläsning och känslomässiga dialoger.
Du kan generera med v3 via API:t med våra slutpunkter Create speech och Stream speech genom att ange modell-ID:t eleven_v3.
Du kan också använda våra slutpunkter Create dialogue och Stream dialogue för att skapa en naturligt klingande dialog med flera talare.
Besök följande resurser för mer information: