Audiobooki
Zamieniaj tekst w studyjnej jakości audio dzięki workflow end-to-end

Przegląd
Audiobooki oferują workflow end-to-end, który zamienia tekst w audio studyjnej jakości.
Możesz wkleić lub przesłać rękopis, wygenerować naturalnie brzmiącą narrację głosami ElevenLabs i podzielić projekt na rozdziały. Dodaj muzykę i efekty dźwiękowe do audiobooka, a następnie edytuj i dopracuj narrację bezpośrednio w edytorze.
Character Casting wykrywa postacie w rękopisie, proponuje głos dla każdej z nich i pozwala odsłuchać je w prawdziwych dialogach z książki. Gdy zmienisz głos postaci, wszystkie jej kwestie zostaną zaktualizowane w całej książce.
Po ukończeniu możesz wyeksportować audiobooka lub opublikować go bezpośrednio na platformach do słuchania, takich jak ElevenReader i marketplace’y partnerów.
Audiobooki obsługują też dynamiczną narrację — tryb, który pozwala słuchaczom wybrać preferowany głos podczas odtwarzania.
Przewodnik

Prześlij plik i wybierz podstawowe ustawienia
Na stronie Audiobooks wybierz Create an Audiobook, aby rozpocząć nowy projekt.
Prześlij manuskrypt
Przeciągnij manuskrypt do obszaru przesyłania lub wybierz plik z urządzenia. Audiobooks obecnie obsługuje:
- EPUB
Wybierz styl narracji

Wybierz sposób narracji audiobooka:
- Single cast — jeden głos lektora czyta całą książkę
- Multi cast — lektor i osobne głosy są przypisywane postaciom wykrytym w manuskrypcie
Wybierz Single cast, gdy całą książkę ma czytać jeden głos. Wybierz Multi cast, jeśli chcesz uzyskać bardziej teatralną produkcję z osobnymi głosami lektora i postaci.
Wybierz model
Wybierz model AI, którego chcesz użyć do audiobooka. Aby uzyskać naturalne, pełne emocji rezultaty, do długich nałożonych głosów i audiobooków polecamy Eleven Multilingual v2 (Studio Quality). Obsługuje 29 języków.
Wybierz Continue, aby rozpocząć przetwarzanie manuskryptu.
Przeanalizuj i sformatuj manuskrypt
Po wybraniu Continue ElevenLabs automatycznie analizuje plik. System sprawdza dokument, aby wyodrębnić metadane, rozdziały i formatowanie.
Po zakończeniu analizy przejdziesz do ekranu Formatting.
Sprawdź obraz okładki
Jeśli EPUB lub PDF zawiera okładkę, system automatycznie ją wyodrębni i wyświetli jako grafikę audiobooka. Możesz:
- Zastąpić okładkę
- Usunąć okładkę
- Zachować wyodrębnioną okładkę
Sprawdź wykryte sekcje
ElevenLabs rozpoznaje sekcje strukturalne w manuskrypcie, takie jak:
- Informacje o prawach autorskich
- Dedykacje
- Prologi
- Rozdziały
- Epilogi
- Inne sformatowane sekcje
Użyj pól wyboru, aby zaznaczyć lub odznaczyć sekcje, które chcesz uwzględnić w audiobooku.
Dokładnie sprawdź wykrytą strukturę przed kontynuowaniem. Formatowanie manuskryptów może się różnić, więc system nie zawsze rozpozna sekcje dokładnie tak, jak chcesz.
Wybierz głosy i obsadź postaci
W kroku Characters wybierasz głosy do audiobooka.

Obsada audiobooka z wieloma głosami
Jeśli wybierzesz Multi cast, ElevenLabs przeanalizuje manuskrypt i wykryje postaci, które według niego wypowiadają się w historii. Następnie możesz przypisać osobny głos do:
- Głównego lektora
- Każdej wykrytej postaci
- Innych mówców rozpoznanych w manuskrypcie
Wykrywanie postaci jest generowane przez AI i należy traktować je jako punkt wyjścia. System może nie rozpoznać każdej postaci, zwłaszcza drugoplanowej, nienazwanej lub trudnej do odróżnienia od otaczającej narracji.
Sprawdź listę wykrytych postaci i w razie potrzeby dostosuj obsadę. Dodaj, zmień lub usuń przypisania głosów, aby końcowa obsada odpowiadała manuskryptowi.
Przeglądaj Voice Library
Przeglądaj dostępne głosy studyjnej jakości albo użyj wyszukiwania i filtrów, aby znaleźć odpowiedni głos. Filtry obejmują:
- Język
- Akcent
- Kategorię
- Płeć
- Wiek
Możesz odsłuchać głosy przed ich przypisaniem.
Sprawdź i dodaj reguły wymowy
Krok Pronunciations pomaga określić wymowę imion, nazw miejsc, wymyślonych słów i innych nietypowych wyrazów.

Sprawdź automatycznie wykryte terminy
ElevenLabs skanuje manuskrypt i sugeruje terminy, które mogą wymagać reguł wymowy. Mogą to być imiona postaci, nazwy miejsc lub fikcyjne terminy.
Sugestie są generowane automatycznie, więc mogą nie obejmować wszystkich słów istotnych dla książki. Sprawdź listę i dodaj reguły dla ważnych terminów, które wymagają specjalnego traktowania.
Dodaj regułę wymowy
Dla każdego terminu możesz utworzyć regułę, na przykład Alias, i wpisać wymagane Output. Wynik określa, jak model ma wymawiać ten termin.
Możesz też wybrać Add rule w prawym górnym rogu, aby ręcznie wyszukać słowo i określić jego wymowę.
Odsłuchaj wymowę w kontekście
Wybierz ikonę Play obok reguły, aby usłyszeć, jak wybrany głos czyta zdanie z manuskryptu, w którym pojawia się dany termin.
Odsłuch w kontekście pomaga sprawdzić:
- Wymowę
- Rytm
- Całe zdanie
- Czy reguła działa z przypisanym głosem
Puste reguły są pomijane, a dla tych terminów model używa domyślnej wymowy.
Utwórz audiobook
Gdy formatowanie, obsada głosowa i reguły wymowy będą gotowe, wybierz Create audiobook w prawym dolnym rogu.
ElevenLabs rozpocznie wtedy tworzenie audiobooka. Po zakończeniu możesz zarządzać projektem, sprawdzać wyniki, eksportować pliki audio lub opublikować gotowy projekt w ElevenReader, gdzie odbiorcy będą mogli go słuchać.
Edycja i odtwarzanie
Po utworzeniu audiobooka możesz go dopracować i ulepszyć w edytorze.
Generowanie i odsłuchiwanie narracji
Po dodaniu treści możesz generować i odsłuchiwać narrację bezpośrednio w edytorze.
- Użyj przycisku Play, aby wygenerować narrację lub odtworzyć już wygenerowane audio
- Generowanie odbywa się na poziomie akapitów w każdym rozdziale
Stan każdego akapitu pokazuje pasek po lewej stronie tekstu:
- Ciemny pasek — narracja została wygenerowana
- Jasnoszary pasek — narracja nie została jeszcze wygenerowana
Tryby odtwarzania
Za pomocą selektora trybu po lewej stronie przycisku Play możesz wybrać sposób działania odtwarzania i generowania:
- Selection — odtwarza lub generuje audio tylko dla wybranego akapitu
- Until end (generate one at a time) — odtwarza od wybranego akapitu do końca rozdziału, generując po jednym akapicie
- Until end (generate clips ahead) — odtwarza od wybranego akapitu do końca rozdziału, generując z wyprzedzeniem wiele akapitów, aby odtwarzanie było płynniejsze
Odtwarzanie już wygenerowanego audio nie zużywa kredytów. Kredyty są używane tylko przy generowaniu nowej narracji.
Edytowanie audiobooka
Możesz edytować tekst, dostosowywać ustawienia głosu lub zmieniać czas, a następnie w razie potrzeby ponownie generować konkretne sekcje.
Oś czasu pozwala sprawdzić, jak narracja, muzyka i efekty dźwiękowe współgrają ze sobą, oraz wprowadzić zmiany przed eksportem.
Ulepszanie audiobooka
Możesz wzbogacić audiobook o dodatkowe warstwy audio:
- Głosy — wybierz lub zmień głos narracji
- Efekty dźwiękowe (SFX) — dodaj efekty z biblioteki lub wygeneruj własne dźwięki
- Muzyka — wybierz utwory z Music Marketplace lub wygeneruj nowe ścieżki
Aby dodać muzykę lub efekty dźwiękowe:
- Kliknij ikonę +, aby zaimportować je do projektu
- Pojawią się jako osobne ścieżki na osi czasu i będą odtwarzane wraz z narracją
Ustawienia głosu i modelu
Możesz dostosować brzmienie audiobooka za pomocą ustawień głosu i modelu na bocznym pasku edytora i w ustawieniach projektu.
Wybór głosu i modelu
- Głos — wybiera lektora używanego w audiobooku
- Model — określa jakość mowy, ekspresję i obsługiwane języki
Możesz zmienić je w dwóch miejscach:
- Boczny pasek edytora — zastosuj ustawienia do wybranych akapitów lub sekcji
- Ustawienia projektu — ustaw domyślny głos i model dla całego projektu
Aby otworzyć ustawienia projektu, otwórz menu w lewym górnym rogu i wybierz Project settings.
Dostępne modele
ElevenLabs obsługuje wiele modeli mowy o różnych mocnych stronach:
- Eleven v4 — nasz najnowszy model o najwyższej jakości i najszerszej obsłudze języków
- Eleven v3 — wcześniejszy ekspresyjny model (wymaga większej kontroli nad promptem)
- Eleven Multilingual v2 — wysokiej jakości, naturalna narracja (domyślnie w większości zastosowań audiobooków)
- Eleven Flash models — zoptymalizowane pod kątem szybkości i niższych opóźnień
Możesz zmienić model w dowolnym momencie. Pamiętaj jednak:
Zmiana modelu nie aktualizuje już wygenerowanego audio — musisz ponownie wygenerować zmienione akapity, co zużyje kredyty.
Ustawienia domyślne
Podczas tworzenia nowego audiobooka:
- Domyślnym modelem jest Eleven Multilingual v2
- Domyślny głos jest wybierany automatycznie (możesz go zmienić w każdej chwili)
- Domyślny język jest ustawiony na automatyczne wykrywanie
Ustawienia głosu (dla zaznaczenia)
Podczas pracy w edytorze możesz zastąpić ustawienia głosu dla konkretnych akapitów. Włącz Override settings na pasku bocznym, aby dostosować sposób wypowiedzi bez wpływu na cały projekt
Sterowanie odtwarzaniem
Kontekstowy pasek boczny zawiera ustawienia odtwarzania, które pozwalają precyzyjnie dostroić narrację:
- Głośność — dostosuj poziom głośności
- Fade in / Fade out — określ sposób rozpoczęcia i zakończenia audio
Te ustawienia dotyczą wybranego akapitu.
Narzędzia AI
Pasek boczny oferuje też narzędzia AI do ulepszania audiobooka:
- Enhance text — dopracuj tekst, aby poprawić sposób wypowiedzi i klarowność
- Remove background audio — usuń tło audio za pomocą izolacji głosu
- Use voice changer — zmień głos w istniejącym audio
- Direct speech with your voice — nagraj audio referencyjne, aby pokierować sposobem wypowiedzi (Actor Mode)
Ustawienia jakości i eksportu
Jakość audio jest automatycznie określana przez plan subskrypcji i ustawienia projektu, a nie wpływa na zużycie kredytów.
Aby sprawdzić dokładną jakość wyjściową projektu, kliknij Publish w prawym górnym rogu, otwórz kartę Export i najedź kursorem na pole Audio format, aby zobaczyć szczegóły, takie jak bitrate i częstotliwość próbkowania.

Ważne informacje
Jeśli zmienisz ustawienia głosu lub modelu po wygenerowaniu audio:
- Istniejące akapity nie zaktualizują się automatycznie
- Aby zmiany zaczęły działać, musisz ponownie wygenerować audio, co zużyje kredyty
Kontekstowy pasek boczny
Kontekstowy pasek boczny aktualizuje się zależnie od tego, co wybierzesz w projekcie.
Dla narracji udostępnia:
- Sterowanie odtwarzaniem
- Wybór głosu i modelu
- Zastępowanie ustawień
- Historię generowania
- Narzędzia AI
Pozwala to dostosowywać i dopracowywać narrację z dużą precyzją.
Słowniki wymowy

Możesz określić sposób wymawiania konkretnych słów za pomocą słowników wymowy.
Przydają się one w przypadku:
- Imion postaci
- Nazw marek
- Akronimów
- Rzadkich lub niejednoznacznych słów
Słowniki wymowy pozwalają określić sposób odczytywania słów za pomocą:
- Reguł fonemicznych — określ wymowę za pomocą zapisu fonetycznego
- Aliasów — zastąp słowo inną pisownią, która daje pożądaną wymowę
Gdy słowo w tekście pasuje do reguły w podłączonym słowniku, system użyje określonej przez ciebie wymowy.
Jak używać słowników wymowy
- Otwórz Pronunciations Editor z paska narzędzi
- Utwórz nowy słownik lub wybierz istniejący
- Dodaj wpisy dla słów, które chcesz kontrolować
- Kliknij Connect, aby zastosować słownik do projektu
Możesz też przesłać plik słownika lub zarządzać wszystkimi słownikami w Pronunciations Editor.
Ważne uwagi
- Słowniki są stosowane po kolei — używana jest pierwsza pasująca reguła
- Zmiany dotyczą tylko nowo wygenerowanego audio. Aby je usłyszeć, musisz ponownie wygenerować akapity
- Reguły fonemiczne są obsługiwane tylko przez modele angielskie, np. Flash v2
Słowniki wymowy są szczególnie pomocne w zachowaniu spójności w długich audiobookach.
Obsada postaci
Obsada postaci pomaga przypisywać głosy postaciom w książce. Gdy przesyłasz manuskrypt, Audiobooks wykrywa postaci, proponuje głos dla każdej z nich i pozwala odsłuchać je na prawdziwych dialogach z książki.
Aktualizowanie postaci po wygenerowaniu
Jeśli zmienisz głos postaci po wygenerowaniu audio, poprzednie audio dla tej postaci zostanie usunięte. Musisz ponownie wygenerować audio z nowym głosem, co zużyje kredyty. Przed kontynuowaniem poprosimy cię o potwierdzenie zmiany.
Każda kwestia wypowiadana przez postać aktualizuje się w całej książce. Nie musisz ręcznie ponownie przypisywać pojedynczych akapitów ani rozdziałów. Aby automatycznie ponownie wygenerować audio dla wszystkich zmienionych akapitów, wyeksportuj nową wersję audiobooka. Kredyty zostaną pobrane tylko za akapity wymagające ponownego wygenerowania.
Biblioteka głosów
Audiobooks obsługuje narrację w ponad 90 językach i oferuje bibliotekę ponad 10 000 głosów. Możesz też w kilka sekund sklonować własny głos, jeśli chcesz samodzielnie narratować lub użyczyć głosów postaciom.
Dobre praktyki
Sprawdź formatowanie, zanim przejdziesz dalej po etapie analizy. Nieprawidłowo wykryte sekcje mogą wpłynąć na końcowy audiobook.
W projektach z wieloma głosami sprawdź każdą wykrytą postać i przypisanie głosu. Zwróć szczególną uwagę na nienazwane lub drugoplanowe postaci, które systemowi może być trudniej poprawnie rozpoznać.
Odsłuchuj podglądy wymowy w kontekście, zamiast polegać wyłącznie na zapisanej regule. Wymowa, która brzmi poprawnie osobno, może wymagać korekty w pełnym zdaniu.
Sprawdź wygenerowany audiobook przed eksportem lub publikacją. Audiobooks może zautomatyzować znaczną część produkcji, ale redakcja i kontrola jakości są niezbędne, by uzyskać dopracowany rezultat.
Rozdziały
Audiobooki dzielą się na rozdziały, które można utworzyć ręcznie lub wykryć automatycznie podczas importowania dokumentu.
Możesz:
- Dodawać nowe rozdziały przyciskiem +
- Zmieniać nazwy lub kolejność rozdziałów
- Generować narrację dla każdego rozdziału
Rozdziały pomagają organizować dłuższe treści i zwiększają elastyczność eksportu.
Tryby narracji
Audiobooks obsługuje dwa różne podejścia do narracji, zależnie od twoich celów.
Oryginalne audio
Audio jest generowane z wyprzedzeniem przy użyciu wybranego głosu i pozostaje stałe dla wszystkich odbiorców.
Ten tryb sprawdzi się najlepiej, jeśli chcesz mieć pełną kontrolę nad:
- Wyborem głosu
- Czasem i sposobem wypowiedzi
- Muzyką i dźwiękiem
Dynamiczna narracja
Zamiast używać stałego głosu, dynamiczna narracja pozwala odbiorcom wybrać preferowany głos podczas odtwarzania.
Ten tryb jest idealny dla:
- Dostępności
- Personalizacji
- Preferencji odbiorców
Muzyka, efekty dźwiękowe i zewnętrzne audio nie są uwzględniane w odtwarzaniu dynamicznej narracji.
Eksport i publikowanie
Opcje eksportu
Aby wyeksportować audiobook, kliknij Publish w prawym górnym rogu i otwórz kartę Export.
Audiobooks oferuje elastyczne opcje eksportu zależnie od tego, jak chcesz wykorzystać swoje treści.
Zakres eksportu
- Cały projekt
- Poszczególne rozdziały
Typy multimediów
- Audio
- Dane osi czasu (AAF)
- Napisy
Struktura plików
- Pojedynczy plik
- ZIP według rozdziałów
Formaty audio
- MP3
- WAV
Jeśli niektóre sekcje nie zostały jeszcze wygenerowane, zostaną ukończone automatycznie podczas eksportu, co zużyje kredyty.
Publikowanie i dystrybucja
Aby rozpowszechniać audiobook, kliknij Publish w prawym górnym rogu i pozostań na karcie Publish.
Możesz publikować bezpośrednio w:
- ElevenReader — do słuchania i dystrybucji w aplikacji
- Platformach partnerskich, takich jak Spotify i InAudio
- ElevenLabs Video lub Audio Native dla dodatkowych formatów
Publikowanie pozwala udostępnić audiobook odbiorcom, a na obsługiwanych platformach, takich jak ElevenReader, zacząć zarabiać na dystrybucji.
Publikowanie w ElevenReader
Podczas publikowania w ElevenReader przejdziesz przez proces zgłoszenia, który przygotuje audiobook do dystrybucji.
Obejmuje on:
- Tworzenie lub wybór profilu autora
- Dodawanie metadanych książki (tytuł, podtytuł, obraz okładki)
- Podawanie informacji o dystrybucji
- Konfigurowanie wypłat i umów
- Sprawdzenie i przesłanie audiobooka
Po przesłaniu audiobook zostanie sprawdzony, zanim stanie się dostępny w aplikacji ElevenReader.
Organizowanie audiobooków w serie
Możesz grupować wiele audiobooków w serie, aby uporządkować powiązane treści i ułatwić ich odkrywanie.
Aby utworzyć serię:
- Przejdź do Bookshelf
- Kliknij przycisk Create series (w prawym górnym rogu)
- Wpisz:
- Nazwa serii
- Opis
- Profil autora
- Język
- Opcjonalnie dodaj do serii istniejące książki
- Kliknij Create Series