Hoppa till navigering

Vad är Eleven v3?

Vi rekommenderar att du byter till Eleven v4 och testar det med ditt eget innehåll.

Vi rekommenderar att du byter till Eleven v4 och testar det med ditt eget innehåll. Många av promptteknikerna för Eleven v4 fungerar även för Eleven v3.

Eleven v3 är en känslomässigt rik och uttrycksfull Text to Speech-modell. Den producerar naturligt, verklighetstroget tal med stort känslomässigt omfång och kontextförståelse på över 70 språk.

Eleven v3 erbjuder:

  • Stöd för ljudtaggar
    • känslor: [sad] [angry] [happily]
    • instruktioner för framförande: [whispers] [shouts]
    • icke-verbala reaktioner: [laughs] [clears throat] [sighs]
  • Dialogläge för naturligt ljud med flera talare
  • Stöd för över 70 språk

Den här modellen fungerar bra för karaktärssamtal, ljudboksinläsning och känslomässiga dialoger.

Du kan generera med v3 via API:t med våra slutpunkter Create speech och Stream speech genom att ange modell-ID:t eleven_v3.

Du kan också använda våra slutpunkter Create dialogue och Stream dialogue för att skapa en naturligt klingande dialog med flera talare.

Besök följande resurser för mer information: