Poznaj Eleven v4Poznaj Eleven v4, nasz najbardziej emocjonalny model. 3× więcej kredytów w planie Creator+ do 12 października

Przejdź do treści

Lista Audio Tags dla Eleven v4: wypróbuj je, a potem stwórz własne

Opublikowano

PosłuchajPosłuchaj tego artykułu

Eleven v4 to przełomowy model Text to Speech, który zamienia tekst w prawdziwą interpretację. Audio Tags pozwalają kierować nią i precyzyjnie sterować emocjami. Dodaj wskazówkę w nawiasach kwadratowych, np. [whispers] lub [excited], i usłysz, jak v4 dopasowuje sposób mówienia.

Ta lista Audio Tags ElevenLabs obejmuje wszystkie emocje z pełnego zakresu emocji Eleven v4, a także tagi dotyczące sposobu mówienia, tempa, reakcji, akcentów i efektów dźwiękowych. Gdy poznasz podstawy, pokażemy też, jak tworzyć własne tagi prostym językiem.

Odkryj emocje Eleven v4

Posłuchaj zakresu
ExcitedPlayfulPeacefulAmazedAnxiousFrustratedScaredTiredExcitedPlayfulPeacefulAmazedAnxiousFrustratedScaredTiredExcitedPlayfulPeacefulAmazedAnxiousFrustratedScaredTiredExcitedPlayfulPeacefulAmazedAnxiousFrustratedScaredTired

Podsumowanie

  • Audio Tags to sygnały zapisane prostym językiem w nawiasach kwadratowych, które Eleven v4 odczytuje jako wskazówki do interpretacji i zmienia sposób wypowiadania kolejnych słów.
  • Eleven v4 to najwyżej oceniany model w Artificial Analysis Speech Arena [wrzesień 2026], a Audio Tags pozwalają kierować interpretacją linijka po linijce.
  • Koło emocji Eleven v4 pozwala szybko posłuchać różnych emocji i poznać możliwości modelu.
  • Tagi nie są ograniczone do stałej listy, więc możesz tworzyć własne — łącząc cechy, np. [whispering, fearful], albo opisując sytuację lub postać stojącą za daną kwestią.
  • Audio Tags działają przez ElevenAPI w Eleven v4, Eleven v4 Turbo i Eleven v3.

Czym są Audio Tags ElevenLabs?

Audio Tags to wskazówki zapisane prostym językiem, które możesz umieszczać w tekście w nawiasach kwadratowych. Eleven v4 odczytuje je jako znaczniki interpretacji i używa ich jako wskazówek zmieniających sposób wypowiadania konkretnych słów lub fraz. Wpisujesz je bezpośrednio w scenariuszu w aplikacji ElevenLabs Text to Speech i obserwujesz, jak nasze modele ożywiają tekst.

Eleven v4 to najwyżej oceniany model TTS w Artificial Analysis Speech Arena, gdzie słuchacze głosują na najbardziej naturalnie brzmiącą zamianę tekstu na mowę.1 Audio Tags pozwalają pójść o krok dalej, precyzyjnie określając sposób interpretacji każdej kwestii.

Jak używać Audio Tags w scenariuszu:

  • Umieść tag przed słowami, na które ma wpływać: Gdy napiszesz „[shouts] Nie wierzę, że mi to powiedziałeś”, cała kwestia zostanie wykrzyczana.
  • Emocja jest kontynuowana: Gdy dodasz tag, jego emocja trwa przez całą kwestię, więc kolejny tag wstawiasz tylko wtedy, gdy chcesz zmienić sposób mówienia. Na przykład: „[proud] Gotuję od ponad dekady. Wiem, jak ugotować jajko. [startled] Co tak pachnie spalenizną?”
  • Łącz tagi, by nakładać wskazówki: Rozdzielaj Audio Tags przecinkiem w jednym zestawie nawiasów, np. [whispering, playful], aby dodać niuansów interpretacji TTS.
  • Łącz tagi z interpunkcją: Audio Tags określają nastrój i sposób mówienia, a tempo możesz naturalnie kontrolować interpunkcją w scenariuszu. Dodaj wielokropki, myślniki lub wielkie litery, aby kształtować prozodię kwestii.

Jeśli chcesz lepiej zrozumieć działanie tagów i to, jak zastępują SSML, przeczytaj nasz pełny przewodnik po Audio Tags.

Text-to-speech leaderboard: Eleven v4 leads with 1319 Elo, ahead of Sonic 3.6. Take this further by selecting from the ElevenLabs Audio Tags list

Lista emocjonalnych Audio Tags

Koło emocji Eleven v4 obejmuje dziesiątki emocji, a każdą z nich v4 odtwarza, by można było usłyszeć różnicę przed napisaniem choćby jednego tagu. 

Kliknij dowolną emocję poniżej, by usłyszeć ją na kole, albo eksperymentuj bezpośrednio ze zdaniem i emocją, by usłyszeć, jak Eleven v4 ożywia emocjonalne Audio Tags.

Pokazaliśmy tu tylko kilka emocji, ale możesz użyć prostego języka, aby zastosować dowolne emocje. W poniższym przykładzie użyliśmy różnych Audio Tags, których nie ma wyżej, aby pokazać możliwości promptowania prostym językiem.

[jittery] Okay, final question of the pub quiz, and we're tied for first. [intrigued] "Which planet has the most moons?" Hmm. [smug] Easy. It's Saturn, everyone knows that. [puzzled] Wait, why is Priya shaking her head? [disgusted] Jupiter? You want to write down Jupiter? [frazzled] We only have ten seconds, just pick one, pick one! [hopeful] [nervous] Fine. Saturn. Hand it in. [long pause] [triumphant] YES! Saturn! We won! [mischievous] [slightly pause] Priya, I believe you owe me a drink.
0:00

Ten przykład ożył dzięki głosowi Jonathan Livingston.

Lista Audio Tags dotyczących sposobu mówienia i głośności

Tagi sposobu mówienia i głośności kontrolują, jak głośno lub intensywnie brzmi kwestia, niezależnie od przypisanej emocji. Jeśli chcesz, by v4 podążał za bardziej konkretną wizją, łącz tagi sposobu mówienia i emocji, by uzyskać większą kontrolę.

Oto kilka przykładów:

  • [whispers] Nie ruszaj się, to jest tuż za tobą.
  • [shouts] Wszyscy natychmiast opuszczają budynek! 
  • [softly] Zrobiłeś wszystko, co mogłeś. 
  • [quietly] Chyba już poszli. 
  • [low, threatening] Naprawdę nie powinieneś tu przychodzić.

Zobaczmy kontrolę głośności i sposobu mówienia w praktyce.

[hushed] Eighteenth hole. One putt to win the championship, and the crowd has gone completely silent. [barely audible] He's lining it up now. The ball is rolling... still rolling... [booming] IT'S IN! HE'S DONE IT! The championship is his, and this place has gone absolutely wild! [disbelief] Twenty years I've been calling golf, and I have never seen anything like that.
0:00

Powyższy przykład ożył dzięki głosowi Rod.

Lista Audio Tags dotyczących tempa

Audio Tags tempa zmieniają szybkość kwestii. Dodaj je, aby budować napięcie lub stworzyć idealny moment komediowy. Gdy timing liczy się tak samo jak słowa, użyj tagów tempa.

Dodatkowa wskazówka: interpunkcja naturalnie pomaga w interpretacji zamiany tekstu na mowę, więc połącz oba sposoby, aby w pełni kontrolować zdanie: 

  • [slowly] A zwycięzcą jest... 
  • [rushed] Przepraszam za spóźnienie, pociąg się zepsuł, biegłem całą drogę. 
  • [pause] Wtedy zadzwonił telefon. 
  • [drawn out] Nieee możliwe.
[slowly] Ten... nine... eight... seven... [rushed] Wait, wait, wait, hold the countdown, someone left their coffee on the console! [snappy] Can you get that out of here? [long pause] [drawn out] Okaaay, thank you. It's been moved. [excited] Resume the count! [speedy] Three... two... one... LIFTOFF!
0:00

Adam to głos, który ożywił ten przykład.

Lista Audio Tags ludzkich reakcji

Tagi reakcji dodają do zdań dźwięki, takie jak śmiech, westchnienia, płacz, kaszel i sapanie. Naprawdę ożywiają tekst i sprawiają, że próbka audio TTS brzmi naturalnie — jak osoba mówiąca spontanicznie, a nie czytająca ze scenariusza.

Oto kilka Audio Tags reakcji:

  • [laughs] Naprawdę dałeś się na to nabrać? 
  • [sighs] Dobra. Pozmywam naczynia. 
  • [gasps] To prawdziwy diament? 
  • [clears throat] Czy mogę prosić wszystkich o uwagę? 
  • [crying] Nie sądziłem, że wrócisz.

Eleven v4 dodaje też drobne ludzkie akcenty, gdy wymaga tego emocja. Posłuchaj koła emocji — usłyszysz kwestie takie jak „T- ty wróciłeś?” i „Ugh, to naprawdę się dzieje?”, w których v4 sam dodał jąkanie lub jęk.

[clears throat] Hi, everyone. For those who don't know me, I'm the best man. [laughs] Well, I'm the only man Tom could find at short notice. [sighs] When Tom first told me about Adam, I thought, there's no way he’s real. [gasps] Sorry, is that the cake? It's enormous. Anyway. [starts crying] I've never seen him this happy. [laughs] Okay, I'm fine. I'm fine. To Tom and Adam!
0:00

Aby użyć tego głosu we własnych produkcjach, wyszukaj Jack John. 

Lista Audio Tags akcentów i postaci

Tworzenie rozbudowanych scen z różnymi akcentami i głosami postaci jest łatwiejsze niż kiedykolwiek dzięki Eleven v4. Kilka Audio Tags pozwala zmienić głos w nową postać, zachowując jego podstawowe cechy. Jeden głos może zagrać całą obsadę w jednej generacji.

  • [British accent] Masz ochotę na herbatę?
  • [French accent] Witaj w mojej małej kawiarni.
  • [Australian accent] Spokojnie, kolego, zaraz to załatwimy.
  • [pirate voice] Stawiać żagle i podawać rum.
Let's visit four stops in thirty seconds. First, London. [British accent] Mind the gap. Lovely weather we're having. [excited] Next, Dublin! [Irish accent] Grand day for it, isn't it? Sure, a bit of rain never hurt anyone. [rushed] No time, no time, on to Sydney! [Australian accent] G'day! Watch out for the seagulls, they'll nick your chips. [pirate voice] Arg, now the high seas, where the tour ends and the treasure begins!
0:00

Lauren pomogła ożywić ten przykład.

Lista Audio Tags efektów dźwiękowych

Audio Tags efektów dźwiękowych wprowadzają do generacji zdarzenia inne niż mowa. Jeśli na przykład tworzysz scenę narracyjną lub ścieżkę do gry, możesz użyć ich do budowania dramatyzmu bez osobnej ścieżki efektów dźwiękowych. Jeśli jednak szukasz czegoś konkretnego, zawsze możesz użyć generatora efektów dźwiękowych AI. 

  • [thunder rumbling] Jest coraz bliżej.
  • [footsteps] Ktoś idzie po schodach.
  • [door creaking] Halo? Jest tu ktoś?
  • [clapping] Dziękuję, dziękuję, jesteście zbyt mili.
[owl hooting] [nervous] Did you hear that? [gulp] It's just an owl, right? [twig snapping] [nervous] Okay, owls don't do that. [many footsteps] [scared] Something's walking around the tent. [zipper opening] [startled] Wait, who just opened the tent? [dog barking] [laughs] Biscuit! You scared me half to death. [sighs] Fine, you can sleep in here too.
0:00

Głos w powyższym klipie to Siren.

Twórz własne Audio Tags prostym językiem

Każdy z pokazanych wyżej Audio Tags to dobry punkt wyjścia. Magia ElevenLabs TTS polega jednak na tym, że możesz napisać dowolny nowy Audio Tag prostym językiem, aby przekazać modelowi dodatkowy kontekst. 

Jeśli pojedynczy tag nie oddaje tego, czego potrzebujesz, napisz bardziej rozbudowaną wskazówkę.

  • Łącz emocje i cechy: [tense, cautious] lub [whispering, fearful]
  • Opisz sposób mówienia: [like a sports commentator, speeding up]
  • Opisz sytuację: [out of breath after running up the stairs]
  • Opisz postać: [a tired detective who has heard it all before]
  • Opisz zmianę: [starting calm, then losing patience]
[hushed and reverent, like a nature documentary narrator] Here, in the quiet of the office kitchen, a rare creature emerges. [barely containing excitement] The intern. [slow and suspenseful] He approaches the last slice of birthday cake. He has been waiting for this moment all afternoon. [speeding up, like a sports commentator] He's going for it, he's reaching, he's almost there, he's- [sudden, crushed disappointment] Someone from accounts got there first. [hushed and reverent] Nature, as always, is cruel.
0:00

Ożyw swoją scenę z głosem Spuds Oxley. 

Wskazówki dotyczące wyboru Audio Tags 

Pisanie prostym językiem daje dużą swobodę przy tworzeniu próbek audio zamiany tekstu na mowę, ale uzyskanie idealnego efektu może wymagać kilku prób.

Aby korzystanie z Eleven v4 TTS było jak najprostsze, oto kilka wskazówek dotyczących Audio Tags:

  • Posłuchaj, zanim napiszesz: Odtwórz kilka emocji na kole emocji — sprawdź, jak v4 interpretuje każdą z nich, lub zainspiruj się nimi, a następnie wybierz najlepsze dopasowanie do swojej kwestii.
  • Zmień tag, zanim przepiszesz kwestię: Jeśli sposób mówienia nie trafia w punkt, wypróbuj sąsiednią emocję, np. [let down] zamiast [despair], i wygeneruj ponownie.
  • Używaj jednego tagu na zdanie podrzędne: Kontrastujące tagi odnoszące się do tych samych słów mogą rozmyć interpretację. Dodaj nowy tag tam, gdzie chcesz zmienić emocję.
  • Daj modelowi pełną scenę: Eleven v4 działa lepiej, gdy ma kontekst. W aplikacji Text to Speech możesz użyć do 10 000 znaków na generację, więc masz miejsce na warstwowe wskazówki, które ożywią scenę.
  • Zacznij od presetu, potem dodaj szczegóły. Jeśli [nervous] jest blisko, ale to jeszcze nie to, opisz, czego brakuje: [nervous, trying to sound confident].

Przede wszystkim jednak najlepiej otworzyć aplikację ElevenLabs TTS i eksperymentować — szybko poznasz jej możliwości i zaczniesz tworzyć wysokiej jakości audio TTS.

Guide to six ElevenLabs audio tag list types and layering multiple cues with comma-separated tags.

Zacznij tworzyć immersyjne audio z Eleven v4

Nie ma jednej ostatecznej listy Audio Tags ElevenLabs, ponieważ możesz tworzyć dowolne kombinacje, pisząc prostym językiem. Każdy tag z tej listy działa w Eleven v4, podobnie jak tagi, które wymyślisz podczas pisania sceny.

Wybierz jeden z ponad 17 500 głosów z Voice Library, wklej scenariusz i dodaj pierwszy Audio Tag, aby zacząć. 

Dowiedz się więcej o Eleven v4 lub zarejestruj się i twórz imponujące interpretacje audio.

FAQ o Audio Tags ElevenLabs

  1. Artificial Analysis, Provider Voice Arena Preference Elo, 30 września 2026

Podobne artykuły

Twórz z najwyższej jakości audio AI