Audiobooki

Zamieniaj tekst w studyjnej jakości audio dzięki workflow end-to-end

Audiobooki

Przegląd

Audiobooki oferują workflow end-to-end, który zamienia tekst w audio studyjnej jakości.

Możesz wkleić lub przesłać rękopis, wygenerować naturalnie brzmiącą narrację głosami ElevenLabs i podzielić projekt na rozdziały. Dodaj muzykę i efekty dźwiękowe do audiobooka, a następnie edytuj i dopracuj narrację bezpośrednio w edytorze.

Character Casting wykrywa postacie w rękopisie, proponuje głos dla każdej z nich i pozwala odsłuchać je w prawdziwych dialogach z książki. Gdy zmienisz głos postaci, wszystkie jej kwestie zostaną zaktualizowane w całej książce.

Po ukończeniu możesz wyeksportować audiobooka lub opublikować go bezpośrednio na platformach do słuchania, takich jak ElevenReader i marketplace’y partnerów.

Audiobooki obsługują też dynamiczną narrację — tryb, który pozwala słuchaczom wybrać preferowany głos podczas odtwarzania.

Przewodnik

Audiobooki – utwórz nową książkę
1

Prześlij plik i wybierz podstawowe ustawienia

Na stronie Audiobooks wybierz Create an Audiobook, aby rozpocząć nowy projekt.

Prześlij manuskrypt

Przeciągnij manuskrypt do obszaru przesyłania lub wybierz plik z urządzenia. Audiobooks obecnie obsługuje:

  • EPUB
  • PDF

Wybierz styl narracji

Wybór stylu narracji audiobooka

Wybierz sposób narracji audiobooka:

  • Single cast — jeden głos lektora czyta całą książkę
  • Multi cast — lektor i osobne głosy są przypisywane postaciom wykrytym w manuskrypcie

Wybierz Single cast, gdy całą książkę ma czytać jeden głos. Wybierz Multi cast, jeśli chcesz uzyskać bardziej teatralną produkcję z osobnymi głosami lektora i postaci.

Wybierz model

Wybierz model AI, którego chcesz użyć do audiobooka. Aby uzyskać naturalne, pełne emocji rezultaty, do długich nałożonych głosów i audiobooków polecamy Eleven Multilingual v2 (Studio Quality). Obsługuje 29 języków.

Wybierz Continue, aby rozpocząć przetwarzanie manuskryptu.

2

Przeanalizuj i sformatuj manuskrypt

Po wybraniu Continue ElevenLabs automatycznie analizuje plik. System sprawdza dokument, aby wyodrębnić metadane, rozdziały i formatowanie.

Po zakończeniu analizy przejdziesz do ekranu Formatting.

Sprawdź obraz okładki

Jeśli EPUB lub PDF zawiera okładkę, system automatycznie ją wyodrębni i wyświetli jako grafikę audiobooka. Możesz:

  • Zastąpić okładkę
  • Usunąć okładkę
  • Zachować wyodrębnioną okładkę

Sprawdź wykryte sekcje

ElevenLabs rozpoznaje sekcje strukturalne w manuskrypcie, takie jak:

  • Informacje o prawach autorskich
  • Dedykacje
  • Prologi
  • Rozdziały
  • Epilogi
  • Inne sformatowane sekcje

Użyj pól wyboru, aby zaznaczyć lub odznaczyć sekcje, które chcesz uwzględnić w audiobooku.

Dokładnie sprawdź wykrytą strukturę przed kontynuowaniem. Formatowanie manuskryptów może się różnić, więc system nie zawsze rozpozna sekcje dokładnie tak, jak chcesz.

3

Wybierz głosy i obsadź postaci

W kroku Characters wybierasz głosy do audiobooka.

Obsada postaci w audiobooku

Obsada audiobooka z wieloma głosami

Jeśli wybierzesz Multi cast, ElevenLabs przeanalizuje manuskrypt i wykryje postaci, które według niego wypowiadają się w historii. Następnie możesz przypisać osobny głos do:

  • Głównego lektora
  • Każdej wykrytej postaci
  • Innych mówców rozpoznanych w manuskrypcie

Wykrywanie postaci jest generowane przez AI i należy traktować je jako punkt wyjścia. System może nie rozpoznać każdej postaci, zwłaszcza drugoplanowej, nienazwanej lub trudnej do odróżnienia od otaczającej narracji.

Obecny limit to maksymalnie 150 wykrytych głosów na książkę.

Sprawdź listę wykrytych postaci i w razie potrzeby dostosuj obsadę. Dodaj, zmień lub usuń przypisania głosów, aby końcowa obsada odpowiadała manuskryptowi.

Odsłuchiwanie głosu z własnym audio zużywa kredyty.

Przeglądaj Voice Library

Przeglądaj dostępne głosy studyjnej jakości albo użyj wyszukiwania i filtrów, aby znaleźć odpowiedni głos. Filtry obejmują:

  • Język
  • Akcent
  • Kategorię
  • Płeć
  • Wiek

Możesz odsłuchać głosy przed ich przypisaniem.

Odsłuchiwanie głosu z własnym audio zużywa kredyty.
4

Sprawdź i dodaj reguły wymowy

Krok Pronunciations pomaga określić wymowę imion, nazw miejsc, wymyślonych słów i innych nietypowych wyrazów.

Edytor wymowy audiobooków

Sprawdź automatycznie wykryte terminy

ElevenLabs skanuje manuskrypt i sugeruje terminy, które mogą wymagać reguł wymowy. Mogą to być imiona postaci, nazwy miejsc lub fikcyjne terminy.

Sugestie są generowane automatycznie, więc mogą nie obejmować wszystkich słów istotnych dla książki. Sprawdź listę i dodaj reguły dla ważnych terminów, które wymagają specjalnego traktowania.

Dodaj regułę wymowy

Dla każdego terminu możesz utworzyć regułę, na przykład Alias, i wpisać wymagane Output. Wynik określa, jak model ma wymawiać ten termin.

Możesz też wybrać Add rule w prawym górnym rogu, aby ręcznie wyszukać słowo i określić jego wymowę.

Odsłuchaj wymowę w kontekście

Wybierz ikonę Play obok reguły, aby usłyszeć, jak wybrany głos czyta zdanie z manuskryptu, w którym pojawia się dany termin.

Odsłuch w kontekście pomaga sprawdzić:

  • Wymowę
  • Rytm
  • Całe zdanie
  • Czy reguła działa z przypisanym głosem

Puste reguły są pomijane, a dla tych terminów model używa domyślnej wymowy.

5

Utwórz audiobook

Gdy formatowanie, obsada głosowa i reguły wymowy będą gotowe, wybierz Create audiobook w prawym dolnym rogu.

ElevenLabs rozpocznie wtedy tworzenie audiobooka. Po zakończeniu możesz zarządzać projektem, sprawdzać wyniki, eksportować pliki audio lub opublikować gotowy projekt w ElevenReader, gdzie odbiorcy będą mogli go słuchać.

Edycja i odtwarzanie

Po utworzeniu audiobooka możesz go dopracować i ulepszyć w edytorze.

Generowanie i odsłuchiwanie narracji

Po dodaniu treści możesz generować i odsłuchiwać narrację bezpośrednio w edytorze.

  • Użyj przycisku Play, aby wygenerować narrację lub odtworzyć już wygenerowane audio
  • Generowanie odbywa się na poziomie akapitów w każdym rozdziale

Stan każdego akapitu pokazuje pasek po lewej stronie tekstu:

  • Ciemny pasek — narracja została wygenerowana
  • Jasnoszary pasek — narracja nie została jeszcze wygenerowana

Tryby odtwarzania

Za pomocą selektora trybu po lewej stronie przycisku Play możesz wybrać sposób działania odtwarzania i generowania:

  • Selection — odtwarza lub generuje audio tylko dla wybranego akapitu
  • Until end (generate one at a time) — odtwarza od wybranego akapitu do końca rozdziału, generując po jednym akapicie
  • Until end (generate clips ahead) — odtwarza od wybranego akapitu do końca rozdziału, generując z wyprzedzeniem wiele akapitów, aby odtwarzanie było płynniejsze

Odtwarzanie już wygenerowanego audio nie zużywa kredytów. Kredyty są używane tylko przy generowaniu nowej narracji.

Edytowanie audiobooka

Możesz edytować tekst, dostosowywać ustawienia głosu lub zmieniać czas, a następnie w razie potrzeby ponownie generować konkretne sekcje.

Oś czasu pozwala sprawdzić, jak narracja, muzyka i efekty dźwiękowe współgrają ze sobą, oraz wprowadzić zmiany przed eksportem.

Ulepszanie audiobooka

Możesz wzbogacić audiobook o dodatkowe warstwy audio:

  • Głosy — wybierz lub zmień głos narracji
  • Efekty dźwiękowe (SFX) — dodaj efekty z biblioteki lub wygeneruj własne dźwięki
  • Muzyka — wybierz utwory z Music Marketplace lub wygeneruj nowe ścieżki

Aby dodać muzykę lub efekty dźwiękowe:

  • Kliknij ikonę +, aby zaimportować je do projektu
  • Pojawią się jako osobne ścieżki na osi czasu i będą odtwarzane wraz z narracją

Ustawienia głosu i modelu

Możesz dostosować brzmienie audiobooka za pomocą ustawień głosu i modelu na bocznym pasku edytora i w ustawieniach projektu.

  • Głos — wybiera lektora używanego w audiobooku
  • Model — określa jakość mowy, ekspresję i obsługiwane języki

Możesz zmienić je w dwóch miejscach:

  • Boczny pasek edytora — zastosuj ustawienia do wybranych akapitów lub sekcji
  • Ustawienia projektu — ustaw domyślny głos i model dla całego projektu

Aby otworzyć ustawienia projektu, otwórz menu w lewym górnym rogu i wybierz Project settings.

ElevenLabs obsługuje wiele modeli mowy o różnych mocnych stronach:

  • Eleven v4 — nasz najnowszy model o najwyższej jakości i najszerszej obsłudze języków
  • Eleven v3 — wcześniejszy ekspresyjny model (wymaga większej kontroli nad promptem)
  • Eleven Multilingual v2 — wysokiej jakości, naturalna narracja (domyślnie w większości zastosowań audiobooków)
  • Eleven Flash models — zoptymalizowane pod kątem szybkości i niższych opóźnień

Możesz zmienić model w dowolnym momencie. Pamiętaj jednak:

Zmiana modelu nie aktualizuje już wygenerowanego audio — musisz ponownie wygenerować zmienione akapity, co zużyje kredyty.

Podczas tworzenia nowego audiobooka:

  • Domyślnym modelem jest Eleven Multilingual v2
  • Domyślny głos jest wybierany automatycznie (możesz go zmienić w każdej chwili)
  • Domyślny język jest ustawiony na automatyczne wykrywanie

Podczas pracy w edytorze możesz zastąpić ustawienia głosu dla konkretnych akapitów. Włącz Override settings na pasku bocznym, aby dostosować sposób wypowiedzi bez wpływu na cały projekt

Kontekstowy pasek boczny zawiera ustawienia odtwarzania, które pozwalają precyzyjnie dostroić narrację:

  • Głośność — dostosuj poziom głośności
  • Fade in / Fade out — określ sposób rozpoczęcia i zakończenia audio

Te ustawienia dotyczą wybranego akapitu.

Pasek boczny oferuje też narzędzia AI do ulepszania audiobooka:

  • Enhance text — dopracuj tekst, aby poprawić sposób wypowiedzi i klarowność
  • Remove background audio — usuń tło audio za pomocą izolacji głosu
  • Use voice changer — zmień głos w istniejącym audio
  • Direct speech with your voice — nagraj audio referencyjne, aby pokierować sposobem wypowiedzi (Actor Mode)

Jakość audio jest automatycznie określana przez plan subskrypcji i ustawienia projektu, a nie wpływa na zużycie kredytów.

Aby sprawdzić dokładną jakość wyjściową projektu, kliknij Publish w prawym górnym rogu, otwórz kartę Export i najedź kursorem na pole Audio format, aby zobaczyć szczegóły, takie jak bitrate i częstotliwość próbkowania.

Opublikuj audiobook

Ważne informacje

Jeśli zmienisz ustawienia głosu lub modelu po wygenerowaniu audio:

  • Istniejące akapity nie zaktualizują się automatycznie
  • Aby zmiany zaczęły działać, musisz ponownie wygenerować audio, co zużyje kredyty

Kontekstowy pasek boczny

Kontekstowy pasek boczny aktualizuje się zależnie od tego, co wybierzesz w projekcie.

Dla narracji udostępnia:

  • Sterowanie odtwarzaniem
  • Wybór głosu i modelu
  • Zastępowanie ustawień
  • Historię generowania
  • Narzędzia AI

Pozwala to dostosowywać i dopracowywać narrację z dużą precyzją.

Słowniki wymowy

Audiobooki – słowniki wymowy

Możesz określić sposób wymawiania konkretnych słów za pomocą słowników wymowy.

Przydają się one w przypadku:

  • Imion postaci
  • Nazw marek
  • Akronimów
  • Rzadkich lub niejednoznacznych słów

Słowniki wymowy pozwalają określić sposób odczytywania słów za pomocą:

  • Reguł fonemicznych — określ wymowę za pomocą zapisu fonetycznego
  • Aliasów — zastąp słowo inną pisownią, która daje pożądaną wymowę

Gdy słowo w tekście pasuje do reguły w podłączonym słowniku, system użyje określonej przez ciebie wymowy.

Jak używać słowników wymowy

  1. Otwórz Pronunciations Editor z paska narzędzi
  2. Utwórz nowy słownik lub wybierz istniejący
  3. Dodaj wpisy dla słów, które chcesz kontrolować
  4. Kliknij Connect, aby zastosować słownik do projektu

Możesz też przesłać plik słownika lub zarządzać wszystkimi słownikami w Pronunciations Editor.

Ważne uwagi

  • Słowniki są stosowane po kolei — używana jest pierwsza pasująca reguła
  • Zmiany dotyczą tylko nowo wygenerowanego audio. Aby je usłyszeć, musisz ponownie wygenerować akapity
  • Reguły fonemiczne są obsługiwane tylko przez modele angielskie, np. Flash v2

Słowniki wymowy są szczególnie pomocne w zachowaniu spójności w długich audiobookach.

Obsada postaci

Obsada postaci pomaga przypisywać głosy postaciom w książce. Gdy przesyłasz manuskrypt, Audiobooks wykrywa postaci, proponuje głos dla każdej z nich i pozwala odsłuchać je na prawdziwych dialogach z książki.

Aktualizowanie postaci po wygenerowaniu

Jeśli zmienisz głos postaci po wygenerowaniu audio, poprzednie audio dla tej postaci zostanie usunięte. Musisz ponownie wygenerować audio z nowym głosem, co zużyje kredyty. Przed kontynuowaniem poprosimy cię o potwierdzenie zmiany.

Każda kwestia wypowiadana przez postać aktualizuje się w całej książce. Nie musisz ręcznie ponownie przypisywać pojedynczych akapitów ani rozdziałów. Aby automatycznie ponownie wygenerować audio dla wszystkich zmienionych akapitów, wyeksportuj nową wersję audiobooka. Kredyty zostaną pobrane tylko za akapity wymagające ponownego wygenerowania.

Biblioteka głosów

Audiobooks obsługuje narrację w ponad 90 językach i oferuje bibliotekę ponad 10 000 głosów. Możesz też w kilka sekund sklonować własny głos, jeśli chcesz samodzielnie narratować lub użyczyć głosów postaciom.

Dobre praktyki

Sprawdź formatowanie, zanim przejdziesz dalej po etapie analizy. Nieprawidłowo wykryte sekcje mogą wpłynąć na końcowy audiobook.

W projektach z wieloma głosami sprawdź każdą wykrytą postać i przypisanie głosu. Zwróć szczególną uwagę na nienazwane lub drugoplanowe postaci, które systemowi może być trudniej poprawnie rozpoznać.

Odsłuchuj podglądy wymowy w kontekście, zamiast polegać wyłącznie na zapisanej regule. Wymowa, która brzmi poprawnie osobno, może wymagać korekty w pełnym zdaniu.

Sprawdź wygenerowany audiobook przed eksportem lub publikacją. Audiobooks może zautomatyzować znaczną część produkcji, ale redakcja i kontrola jakości są niezbędne, by uzyskać dopracowany rezultat.

Rozdziały

Audiobooki dzielą się na rozdziały, które można utworzyć ręcznie lub wykryć automatycznie podczas importowania dokumentu.

Możesz:

  • Dodawać nowe rozdziały przyciskiem +
  • Zmieniać nazwy lub kolejność rozdziałów
  • Generować narrację dla każdego rozdziału

Rozdziały pomagają organizować dłuższe treści i zwiększają elastyczność eksportu.

Tryby narracji

Audiobooks obsługuje dwa różne podejścia do narracji, zależnie od twoich celów.

Oryginalne audio

Audio jest generowane z wyprzedzeniem przy użyciu wybranego głosu i pozostaje stałe dla wszystkich odbiorców.

Ten tryb sprawdzi się najlepiej, jeśli chcesz mieć pełną kontrolę nad:

  • Wyborem głosu
  • Czasem i sposobem wypowiedzi
  • Muzyką i dźwiękiem

Dynamiczna narracja

Zamiast używać stałego głosu, dynamiczna narracja pozwala odbiorcom wybrać preferowany głos podczas odtwarzania.

Ten tryb jest idealny dla:

  • Dostępności
  • Personalizacji
  • Preferencji odbiorców

Muzyka, efekty dźwiękowe i zewnętrzne audio nie są uwzględniane w odtwarzaniu dynamicznej narracji.

Eksport i publikowanie

Opcje eksportu

Aby wyeksportować audiobook, kliknij Publish w prawym górnym rogu i otwórz kartę Export.

Audiobooks oferuje elastyczne opcje eksportu zależnie od tego, jak chcesz wykorzystać swoje treści.

  • Cały projekt
  • Poszczególne rozdziały
  • Audio
  • Dane osi czasu (AAF)
  • Napisy
  • Pojedynczy plik
  • ZIP według rozdziałów
  • MP3
  • WAV

Jeśli niektóre sekcje nie zostały jeszcze wygenerowane, zostaną ukończone automatycznie podczas eksportu, co zużyje kredyty.

Publikowanie i dystrybucja

Aby rozpowszechniać audiobook, kliknij Publish w prawym górnym rogu i pozostań na karcie Publish.

Możesz publikować bezpośrednio w:

  • ElevenReader — do słuchania i dystrybucji w aplikacji
  • Platformach partnerskich, takich jak Spotify i InAudio
  • ElevenLabs Video lub Audio Native dla dodatkowych formatów

Publikowanie pozwala udostępnić audiobook odbiorcom, a na obsługiwanych platformach, takich jak ElevenReader, zacząć zarabiać na dystrybucji.

Publikowanie w ElevenReader

Podczas publikowania w ElevenReader przejdziesz przez proces zgłoszenia, który przygotuje audiobook do dystrybucji.

Obejmuje on:

  • Tworzenie lub wybór profilu autora
  • Dodawanie metadanych książki (tytuł, podtytuł, obraz okładki)
  • Podawanie informacji o dystrybucji
  • Konfigurowanie wypłat i umów
  • Sprawdzenie i przesłanie audiobooka

Po przesłaniu audiobook zostanie sprawdzony, zanim stanie się dostępny w aplikacji ElevenReader.

Organizowanie audiobooków w serie

Możesz grupować wiele audiobooków w serie, aby uporządkować powiązane treści i ułatwić ich odkrywanie.

Aby utworzyć serię:

  1. Przejdź do Bookshelf
  2. Kliknij przycisk Create series (w prawym górnym rogu)
  3. Wpisz:
    • Nazwa serii
    • Opis
    • Profil autora
    • Język
  4. Opcjonalnie dodaj do serii istniejące książki
  5. Kliknij Create Series

FAQ

Nie. Jeśli w Audiobooks część sekcji nie została jeszcze wygenerowana, zostaną one automatycznie ukończone podczas eksportu, co wykorzysta środki.

W Audiobooks wygenerowana narracja (oryginalne audio) tworzy stały plik audio z użyciem wybranego głosu.

Dynamiczna narracja pozwala słuchaczom wybrać preferowany głos lektora podczas odtwarzania.

Tak. Możesz dystrybuować swój audiobook na wielu platformach, w tym w ElevenReader i na obsługiwanych platformach partnerów.

Character Casting wykrywa postacie w manuskrypcie, proponuje głos dla każdej wykrytej postaci i pozwala odsłuchać je w rzeczywistych dialogach z twojej książki.

Wykrywanie postaci jest generowane przez AI i należy traktować je jako punkt wyjścia. System może nie rozpoznać każdej postaci, zwłaszcza drugoplanowych, nienazwanych lub mówiących osób, które trudno odróżnić od otaczającej narracji.

Gdy zmienisz głos postaci, wszystkie jej kwestie zostaną zaktualizowane w całej książce.

Możesz użyć tylu głosów, ile potrzebujesz w swoim audiobooku. Voice Library zawiera ponad 10 000 głosów w ponad 90 językach, a dodatkowo możesz sklonować własny głos do narracji lub głosów postaci.

W Character Casting obecny limit to maksymalnie 150 wykrytych głosów na książkę.

Audiobooks obsługuje formaty EPUB i PDF. Po przesłaniu pliku system automatycznie analizuje manuskrypt, aby wyodrębnić metadane, rozdziały i formatowanie. Jeśli plik zawiera obraz okładki, zostanie on automatycznie wyodrębniony.

Bardzo duże manuskrypty lub złożone projekty Audiobooks mogą czasem nie przejść przetwarzania. Jeśli tak się stanie, sprawdź strukturę manuskryptu i spróbuj ponownie.

Zgłaszając problem, podaj informacje o pliku, jego rozmiarze i formacie oraz etapie, na którym przetwarzanie się nie powiodło.

No results