Introducing Eleven v4Introducing Eleven v4, our fastest and most emotive voice model

Przejdź do treści

Nasze najbardziej emocjonalne modele

Poznaj Eleven v4
i v4 Turbo

Twórz ekspresyjną mowę, którą możesz precyzyjnie kontrolować — z emocjami, zdarzeniami audio i wciągającym tłem dźwiękowym.

Eleven v4

Nasz najszybszy i najbardziej emocjonalnymodel głosowy

Eleven v4 opiera się na całkiem nowej architekturze, która czyta tekst tak jak aktor głosowy. Wie, kto mówi, co właśnie się wydarzyło i jak powinno wybrzmieć każde zdanie.

Szeroki zakres emocji i dźwięków

Mowa w ponad 90 językach i wyjątkowo szerokim zakresie emocji, z wieloma mówcami oraz wbudowanymi efektami dźwiękowymi, które budują scenę.

Demo 1 z 4

Oparte na nowej architekturze

Dodawaj wskazówki do tekstu

Dodawaj do tekstu wskazówki, takie jak [laughs], [whispers] i [door slams]. Eleven v4 lepiej niż v3 rozumie sekwencje tagów, także z efektami dźwiękowymi.

Łącz długie audio bez słyszalnych przejść

Łączenie kontekstowe zachowuje tempo i sposób mówienia w tekście dowolnej długości. Cały audiobook brzmi jak nagrany za jednym podejściem — od pierwszej do ostatniej strony.

Generuj ponownie bez zmiany głosu

Wygeneruj zdanie ponownie raz lub pięćdziesiąt razy, a nadal będzie mówić ta sama osoba. Głos pozostaje stabilny w dialogach, narracji i wszystkim pomiędzy.

Wybierz Professional Voice Clone

Professional Voice Clones nie były obsługiwane w v3. W Eleven v4 wracają i wykorzystują pełen zakres emocji modelu w każdym języku, którym mówią.

Eleven v4 Turbo

Poznaj Eleven v4 Turbodo pracy w czasie rzeczywistym i agentów

Nasz najszybszy model mowy w czasie rzeczywistym z pełnym zakresem ekspresji Eleven v4, dostępny przez API i ElevenAgents. Eleven v4 Turbo ma medianę opóźnienia inferencji ok. 100 ms, czas do pierwszej wypowiedzi ok. 150 ms i zachowuje spójność w długich interakcjach.

Czas odpowiedzi, którego rozmówcy nie zauważą

Przy medianie 150 ms do pierwszej wypowiedzi opóźnienie znika, a rozmowa płynie naturalnie.

Eleven v4 Turbo
150 ms101234567891501234567895001234567890 ms
Cartesia Sonic 3.6
262 ms201234567892601234567896201234567892 ms
OpenAI GPT-4o mini TTS
814 ms801234567898101234567891401234567894 ms
Mediana czasu do pierwszej mowy

Usłysz to w prawdziwej rozmowie

Dowiedz się więcej o Eleven v4 Turbo od agenta, który korzysta z tego modelu.

Zoptymalizowane do rozmów na żywo

Przesyłaj tekst, odbieraj audio

Wysyłaj tekst, gdy generuje go LLM, a audio zacznie wracać przed końcem zdania. Dwukierunkowy streaming stworzony dla pętli agentów.

Ekspresja w tempie rozmowy

Turbo oferuje pełen zakres ekspresji Eleven v4. Potwierdzenia, eskalacje i oczekiwanie brzmią inaczej, zamiast identycznie.

Jeden głos w każdej turze

Professional Voice Clones działają tak samo w obu modelach, więc jeden głos marki pozostaje spójny od pierwszej do ostatniej tury rozmowy.

Mów jak native speaker

Wskaż tekst po japońsku, hiszpańsku lub portugalsku, a głos wypowie go płynnie i z rodzimym akcentem.

Wybieraj spośród ponad 17 500 głosów

Głosy narracyjne Miejsce dla opowiadaczy historii. Ciepłe, wyraziste i spójne w każdym projekcie.

Głosy konwersacyjne Do codziennych rozmów potrzebujesz naturalnego, swobodnego głosu. Nasze głosy konwersacyjne sprawdzają się w dialogach i podcastach, które brzmią spontanicznie.

Głosy do mediów społecznościowych Głosy, które ożywiają krótkie treści. Dodaj energię i charakter, by odbiorca został z twoim TikTokiem lub Reelem do końca.

Głosy postaci Pula głosów dla twojego fikcyjnego świata. Wybierz dynamiczną obsadę, która ożywi grę, audiobook lub animację.

Głosy edukacyjne Wiarygodne, cierpliwe głosy, które prowadzą uczniów przez złożone tematy. Świetne do kursów, samouczków, symulacji szkoleniowych i przewodników na każdym poziomie.

Głosy reklamowe Dopracowane, pewne siebie głosy, które pomogą sprzedać kolejny produkt. Idealne do reklam cyfrowych oraz spotów telewizyjnych i radiowych.

Głosy rozrywkowe Od mocnych zwiastunów filmowych po komediowe głosy stworzone do występów — te głosy mają charakter. Do treści, w których sposób podania jest równie ważny jak sam przekaz.

Głosy wielojęzyczne Głosy stworzone dla globalnych treści. Naturalne tempo, idiomatyczne zwroty i akcenty, które trafiają do odbiorców na każdym rynku.

Wdrożenie Agentforce Voice rozszerzyliśmy dzięki deterministycznej kontroli. Klienci stale mówią nam, że ufają temu rozwiązaniu, bo każde działanie agenta jest oparte na konkretnych zasadach i kontrolowane, a nie improwizowane. Kluczowe jest tu połączenie tej przewidywalności z wysokiej jakości modelami głosowymi o wysokiej inteligencji emocjonalnej. Właśnie tu Eleven v4 Turbo podnosi poprzeczkę — dzięki szybszym, bardziej naturalnym odpowiedziom, które spełniają standard oczekiwany przez naszych klientów i pozwalają wykorzystać Agentforce Voice w jeszcze większej liczbie zastosowań.

Ryan Peterson, SVP Product ds. Agentforce Voice, Salesforce

Współpracujemy z setkami wydawców, by udostępniać ich dziennikarstwo w audio, i z bliska widzimy, jak ważna jest jakość głosu. Od początku współpracy z ElevenLabs wielu naszych wydawców zauważyło większe zaangażowanie i dłuższy czas słuchania. Eleven v4 daje im więcej sposobów, by głosy były angażujące, znajome i wyraźnie ich własne.

Patrick O'Flaherty, Współzałożyciel BeyondWords

ElevenLabs v4 wnosi nowy poziom naturalnego brzmienia do rozmów głosowych. Głosy są nie tylko bardziej ekspresyjne, ale też łatwiejsze do kontrolowania, dzięki czemu możemy tworzyć bogatsze i bardziej wciągające doświadczenia głosowe.

Chrys Bader, Współzałożyciel i CEO

Gdy użyłem go po raz pierwszy — Eleven v4 — brzmiał tak czysto i naturalnie, że poczułem się, jakbym prowadził sesję z aktorem w studiu.

Kyle Gudmundson, Lider ds. muzyki i audio, Accenture Accelerate

Szukaliśmy modelu głosowego, który jest wystarczająco szybki, by rozmowa brzmiała naturalnie, bez kompromisów w jakości. Eleven v4 Turbo jest pierwszym, który oferuje oba te elementy. Dla automatycznych workflow sprzedażowych to moment, gdy tworzenie przestaje być eksperymentem.

Oscar Daniels, Szef produktów Credit Building, Spring Financial

Wybierz jego brzmieniezanim wypowie pierwsze słowo

Każda generacja zaczyna się od głosu. Sklonuj głos, który już masz, zaprojektuj go na podstawie opisu albo popraw wymowę konkretnych słów dzięki obsłudze IPA.

Smiling person in an orange pleated garment and patterned scarf.
Glowing orange sphere with bright curved streaks against a textured orange background.

Voice Cloning

Sklonuj głos z dziesięciu sekund nagrania albo wytrenuj Professional Voice Clone, by uzyskać niemal idealne dopasowanie.

“Kobieta po dwudziestce z jasnym, konwersacyjnym głosem i amerykańskim akcentem. Przyjazny, figlarny i swobodny ton.”

Voice Design

Opisz głos jednym zdaniem i wygeneruj go — bez sesji nagraniowej ani castingu.

OAutho-auth
Hülkenberghul-ken-berg
Reykjavikrej-kja-wik
YAMLjam-el

Słownik wymowy

Określ wymowę nazw, skrótów i terminów technicznych. Ustaw zapis fonetyczny raz, a będzie używany przy każdej generacji.

Zacznij tworzyć za darmoPrzejdź na wyższy plan, gdy potrzebujesz więcej

  • Zacznij

    0 $/mies.

    Zacznij za darmo

    Plan darmowy obejmuje:

    • 10 000 kredytów miesięcznie
    • Do użytku osobistego
    • Karta płatnicza nie jest wymagana
  • Plany Premium

    6 $/mies.

    Zobacz plany

    Płatne plany obejmują:

    • Ponad 30 000 kredytów miesięcznie
    • Profesjonalne klonowanie głosu
    • Wyższe limity i szybsza generacja
  • Enterprise

    Indywidualna wycena

    Napisz do nas

    Plan Enterprise obejmuje:

    • Większa skala
    • Własne SSO
    • Priorytetowe wsparcie

Dostępne przez APIDodaj Eleven v4 do swojej aplikacji

Twórz z Eleven v4 Turbo doświadczenia w czasie rzeczywistym i agentów głosowych — wszystko przez ElevenAPI.

Uzyskaj dostęp do API Eleven v4 i Eleven v4 Turbo

Dodaj ekspresyjną mowę do dowolnego produktu przez nasze REST API, endpointy streamingowe albo SDK TypeScript i Python.

  • Zmieniaj modele jednym parametrem model_id
  • Przesyłaj tekst i odbieraj audio w czasie rzeczywistym
  • Zachowuj ciągłość w długich generacjach
import { ElevenLabsClient, play } from '@elevenlabs/elevenlabs-js';
import 'dotenv/config';

const elevenlabs = new ElevenLabsClient({
  apiKey: process.env.ELEVENLABS_API_KEY
});
const audio = await elevenlabs.textToSpeech.convert(
  's3TPKV1kjDlVtZbl4Ksh', // "George" - browse voices at elevenlabs.io/app/voice-library
  {
    text: 'The first move is what sets everything in motion.',
    modelId: 'eleven_v4',
  }
);
play(audio);

Najczęściej zadawane pytania

Twórz z najwyższej jakości audio AI