Jak wybrać odpowiedni model

Ten poradnik pokaże ci, jak wybrać odpowiedni model ElevenLabs do swojego przypadku użycia.

ElevenLabs oferuje modele zoptymalizowane pod różne wymagania. Właściwy wybór zależy od twojego przypadku użycia, wymagań dotyczących opóźnień i oczekiwanej jakości. Pełną specyfikację znajdziesz w dokumentacji modeli.

Według wymagań

Jakość

Użyj eleven_v4

Flagowy model o najwyższej jakości, najbogatszej ekspresji emocjonalnej i najszerszej obsłudze języków.

Niskie opóźnienie

Użyj eleven_v4_turbo

Zoptymalizowany do aplikacji czasu rzeczywistego z opóźnieniem około 100 ms.

Według przypadku użycia

Tworzenie treści

Użyj eleven_v4

Idealny do profesjonalnych treści, audiobooków i narracji wideo.

Agenci konwersacyjni

Użyj eleven_v4_turbo, aby uzyskać najbardziej ekspresyjną wypowiedź, lub eleven_flash_v2_5 i eleven_flash_v2, aby uzyskać najniższe opóźnienie.

Model 2.5 obsługuje języki inne niż angielski.

Zoptymalizowany do konwersacyjnych aplikacji czasu rzeczywistego.

Transkrypcja

Użyj scribe_v2 do transkrypcji wsadowej, scribe_v2_medical do audio medycznego i klinicznego lub scribe_v2_realtime do transkrypcji w czasie rzeczywistym.

Najwyższa dokładność w ponad 90 językach dzięki diarizacji mówców i znacznikom czasu na poziomie słów.

Zmiana głosu

Użyj eleven_multilingual_sts_v2

Wyspecjalizowany w konwersji Speech-to-Speech.

Kolejne kroki