Presentiamo Eleven v4Scopri Eleven v4, il nostro modello più espressivo di sempre. Con 3 volte più crediti inclusi in Creator+ fino al 12 ottobre

Vai al contenuto

Elenco degli Audio Tags di Eleven v4: provali e poi crea i tuoi

Scritto da
Jack Limebear
Pubblicato

AscoltaAscolta questo articolo

Eleven v4 è un rivoluzionario modello Text to Speech che trasforma il testo in un'interpretazione. Gli Audio Tags ti permettono di dirigere quell'interpretazione, con un controllo dettagliato sulla sua resa emotiva. Inserisci un'indicazione in linguaggio naturale tra parentesi quadre, come [whispers] o [excited], e ascolta come v4 adatta la pronuncia.

Questo elenco di Audio Tags di ElevenLabs include tutte le emozioni dell'intera gamma emotiva di Eleven v4, oltre ai tag per pronuncia, ritmo, reazioni, accenti ed effetti sonori. Una volta apprese le basi, ti mostreremo anche come scrivere i tuoi tag in linguaggio semplice.

Scopri le emozioni di Eleven v4

Ascolta la gamma
ExcitedPlayfulPeacefulAmazedAnxiousFrustratedScaredTiredExcitedPlayfulPeacefulAmazedAnxiousFrustratedScaredTiredExcitedPlayfulPeacefulAmazedAnxiousFrustratedScaredTiredExcitedPlayfulPeacefulAmazedAnxiousFrustratedScaredTired

In sintesi

  • Gli Audio Tags sono segnali in linguaggio naturale tra parentesi quadre che Eleven v4 interpreta come indicazioni di performance, modificando il modo in cui pronuncia le parole successive.
  • Eleven v4 è il modello al primo posto nell'Artificial Analysis Speech Arena [settembre 2026] e gli Audio Tags ti permettono di dirigere l'interpretazione riga per riga.
  • La ruota della gamma emotiva di Eleven v4 ti permette di ascoltare emozioni diverse per avere una rapida panoramica delle capacità del modello.
  • I tag non sono limitati a un elenco fisso: puoi crearne di tuoi combinando qualità, come [whispering, fearful], o descrivendo la situazione o il personaggio dietro una battuta.
  • Gli Audio Tags funzionano tramite ElevenAPI su Eleven v4, Eleven v4 Turbo ed Eleven v3.

Cosa sono gli Audio Tags di ElevenLabs?

Gli Audio Tags sono indicazioni in linguaggio naturale che puoi inserire nel testo tra parentesi quadre. Eleven v4 li legge come marcatori di performance e li usa come istruzioni che modificano il modo in cui pronuncia determinate parole o frasi. Li scrivi in linea con il tuo script nell'app Text to Speech di ElevenLabs e guardi i nostri modelli dar loro vita.

Eleven v4 è il modello TTS al primo posto nell'Artificial Analysis Speech Arena, dove gli ascoltatori votano il text to speech dal suono più naturale.1 Gli Audio Tags ti permettono di spingere ancora oltre l'interpretazione, dirigendo esattamente la resa di ogni riga.

Ecco come usare gli Audio Tags in uno script:

  • Inserisci un tag prima delle parole su cui agisce: quando scrivi “[shouts] Non posso credere che mi hai detto questo”, l'intera frase viene gridata.
  • L'emozione continua: quando aggiungi un tag, la sua emozione prosegue per tutta la frase, quindi devi inserire un altro tag solo quando vuoi cambiare la pronuncia. Per esempio, “[proud] Cucino da oltre dieci anni. So come si fa un uovo sodo. [startled] Che cos'è questo odore di bruciato?”
  • Combina i tag per sovrapporre le indicazioni: separa gli Audio Tags con una virgola all'interno della stessa coppia di parentesi quadre, come [whispering, playful], per aggiungere sfumature alla tua interpretazione TTS.
  • Abbina i tag alla punteggiatura: mentre gli Audio Tags definiscono atmosfera e pronuncia, puoi controllare naturalmente il ritmo usando la punteggiatura nello script. Aggiungi puntini di sospensione, trattini o maiuscole per modellare la prosodia di una frase.

Per una spiegazione più approfondita del funzionamento dei tag e di come sostituiscono SSML, abbiamo scritto una guida completa agli Audio Tags.

Text-to-speech leaderboard: Eleven v4 leads with 1319 Elo, ahead of Sonic 3.6. Take this further by selecting from the ElevenLabs Audio Tags list

Elenco degli Audio Tags per le emozioni

La ruota delle emozioni di Eleven v4 include decine di emozioni, ciascuna interpretata da v4, così puoi ascoltare la differenza prima ancora di scrivere un tag. 

Fai clic su un'emozione qui sotto per ascoltarla sulla ruota oppure prova direttamente con la frase e l'emozione per sentire Eleven v4 dar vita agli Audio Tags emotivi.

Anche se qui abbiamo presentato solo alcune emozioni, puoi usare il linguaggio naturale per implementare tutte le emozioni che desideri. Nell'esempio seguente abbiamo usato vari Audio Tags non inclusi sopra per mostrare cosa puoi fare con i prompt in linguaggio naturale.

[jittery] Okay, final question of the pub quiz, and we're tied for first. [intrigued] "Which planet has the most moons?" Hmm. [smug] Easy. It's Saturn, everyone knows that. [puzzled] Wait, why is Priya shaking her head? [disgusted] Jupiter? You want to write down Jupiter? [frazzled] We only have ten seconds, just pick one, pick one! [hopeful] [nervous] Fine. Saturn. Hand it in. [long pause] [triumphant] YES! Saturn! We won! [mischievous] [slightly pause] Priya, I believe you owe me a drink.
0:00

Questo esempio è stato realizzato con Jonathan Livingston.

Elenco degli Audio Tags per pronuncia e volume

I tag di pronuncia e volume controllano quanto forte o intensa suona una frase, indipendentemente dall'emozione che scegli di associarvi. Se vuoi che v4 segua una visione più specifica, sovrapponi tag di pronuncia ed emozione per un controllo più dettagliato.

Ecco alcuni esempi:

  • [whispers] Non muoverti, è proprio dietro di te.
  • [shouts] Tutti fuori dall'edificio, subito! 
  • [softly] Hai fatto tutto il possibile. 
  • [quietly] Credo che se ne siano andati. 
  • [low, threatening] Non saresti proprio dovuto venire qui.

Vediamo in azione il controllo di volume e pronuncia.

[hushed] Eighteenth hole. One putt to win the championship, and the crowd has gone completely silent. [barely audible] He's lining it up now. The ball is rolling... still rolling... [booming] IT'S IN! HE'S DONE IT! The championship is his, and this place has gone absolutely wild! [disbelief] Twenty years I've been calling golf, and I have never seen anything like that.
0:00

L'esempio sopra è stato realizzato con Rod.

Elenco degli Audio Tags per il ritmo

Gli Audio Tags per il ritmo modificano la velocità di una frase. Aggiungili per creare suspense o preparare il momento comico perfetto. Quando il timing conta quanto le parole, usa i tag per il ritmo.

Come consiglio extra, la punteggiatura aiuta naturalmente le prestazioni del text to speech, quindi usala insieme ai tag per avere il pieno controllo della frase: 

  • [slowly] E il vincitore è... 
  • [rushed] Scusa il ritardo, il treno si è fermato, ho corso per tutto il tragitto. 
  • [pause] Poi squillò il telefono. 
  • [drawn out] Nooo, dai.
[slowly] Ten... nine... eight... seven... [rushed] Wait, wait, wait, hold the countdown, someone left their coffee on the console! [snappy] Can you get that out of here? [long pause] [drawn out] Okaaay, thank you. It's been moved. [excited] Resume the count! [speedy] Three... two... one... LIFTOFF!
0:00

Adam è la voce che ha dato vita a questo esempio.

Elenco degli Audio Tags per reazioni umane

I tag di reazione aggiungono alle tue frasi suoni come risate, sussulti, pianti, colpi di tosse e sospiri. Danno davvero vita al testo e rendono naturale un campione audio TTS, come una persona che parla spontaneamente invece di leggere uno script.

Ecco alcuni Audio Tags per le reazioni:

  • [laughs] Ci sei davvero cascato? 
  • [sighs] Va bene. Laverò i piatti. 
  • [gasps] È un diamante vero? 
  • [clears throat] Posso avere l'attenzione di tutti? 
  • [crying] Non pensavo che saresti tornato.

Eleven v4 aggiunge anche piccoli tocchi umani quando l'emozione lo richiede. Ascolta la ruota delle emozioni e sentirai frasi come "T-tu sei tornato?" e "Ugh, è davvero così?", in cui v4 ha aggiunto autonomamente una balbuzie o un gemito.

[clears throat] Hi, everyone. For those who don't know me, I'm the best man. [laughs] Well, I'm the only man Tom could find at short notice. [sighs] When Tom first told me about Adam, I thought, there's no way he’s real. [gasps] Sorry, is that the cake? It's enormous. Anyway. [starts crying] I've never seen him this happy. [laughs] Okay, I'm fine. I'm fine. To Tom and Adam!
0:00

Per usare questa voce nelle tue produzioni, cerca Jack John. 

Elenco degli Audio Tags per accenti e personaggi

Creare scene ricche con accenti diversi o voci di personaggi è più semplice che mai con Eleven v4. Con pochi Audio Tags, puoi trasformare una voce in una nuova persona mantenendone le qualità di base. Una sola voce può interpretare un intero cast in un'unica generazione.

  • [British accent] Gradisci una tazza di tè?
  • [French accent] Benvenuto nel mio piccolo café.
  • [Australian accent] Tranquillo, amico, ci pensiamo noi.
  • [pirate voice] Issate le vele e passate il rum.
Let's visit four stops in thirty seconds. First, London. [British accent] Mind the gap. Lovely weather we're having. [excited] Next, Dublin! [Irish accent] Grand day for it, isn't it? Sure, a bit of rain never hurt anyone. [rushed] No time, no time, on to Sydney! [Australian accent] G'day! Watch out for the seagulls, they'll nick your chips. [pirate voice] Arg, now the high seas, where the tour ends and the treasure begins!
0:00

Lauren ha contribuito a dare vita a questo esempio.

Elenco degli Audio Tags per gli effetti sonori

Gli Audio Tags per gli effetti sonori introducono eventi non vocali direttamente nelle tue generazioni. Per esempio, se stai creando una scena narrativa o una traccia per un videogioco, puoi usarli per renderla più drammatica senza una traccia SFX separata. Detto questo, puoi sempre usare il generatore di effetti sonori IA se cerchi qualcosa di specifico. 

  • [thunder rumbling] Si sta avvicinando.
  • [footsteps] Qualcuno sta salendo le scale.
  • [door creaking] Pronto? C'è qualcuno in casa?
  • [clapping] Grazie, grazie, siete troppo gentili.
[owl hooting] [nervous] Did you hear that? [gulp] It's just an owl, right? [twig snapping] [nervous] Okay, owls don't do that. [many footsteps] [scared] Something's walking around the tent. [zipper opening] [startled] Wait, who just opened the tent? [dog barking] [laughs] Biscuit! You scared me half to death. [sighs] Fine, you can sleep in here too.
0:00

La voce nella clip qui sopra è Siren.

Scrivi i tuoi Audio Tags in linguaggio naturale

Qualsiasi Audio Tag mostrato sopra è un ottimo punto di partenza. Ma la magia del TTS di ElevenLabs è che puoi scrivere qualsiasi nuovo Audio Tag in linguaggio naturale per fornire al modello un contesto aggiuntivo da usare. 

In alternativa, se nessun tag di una sola parola descrive ciò che cerchi, scrivi un'indicazione più completa.

  • Combina emozioni e qualità: [tense, cautious] o [whispering, fearful]
  • Descrivi il modo: [like a sports commentator, speeding up]
  • Descrivi la situazione: [out of breath after running up the stairs]
  • Descrivi il personaggio: [a tired detective who has heard it all before]
  • Descrivi il cambiamento: [starting calm, then losing patience]
[hushed and reverent, like a nature documentary narrator] Here, in the quiet of the office kitchen, a rare creature emerges. [barely containing excitement] The intern. [slow and suspenseful] He approaches the last slice of birthday cake. He has been waiting for this moment all afternoon. [speeding up, like a sports commentator] He's going for it, he's reaching, he's almost there, he's- [sudden, crushed disappointment] Someone from accounts got there first. [hushed and reverent] Nature, as always, is cruel.
0:00

Dai vita alla tua scena con Spuds Oxley. 

Consigli per scegliere gli Audio Tags 

Scrivere in linguaggio naturale ti dà grande flessibilità nella creazione di campioni audio text to speech, ma ottenere il risultato perfetto può richiedere qualche tentativo.

Per rendere la tua esperienza TTS con Eleven v4 il più fluida possibile, ecco alcuni consigli per lavorare con gli Audio Tags:

  • Ascolta prima di scrivere: ascolta alcune emozioni sulla ruota delle emozioni per sentire come v4 interpreta ciascuna di esse, o per trovare ispirazione, poi scegli quella più adatta alla tua frase.
  • Cambia il tag prima di riscrivere la frase: se la pronuncia non funziona, prova un'emozione vicina, come [let down] invece di [despair], e rigenera.
  • Usa un tag per proposizione: tag contrastanti sulle stesse parole possono confondere l'interpretazione. Aggiungi un nuovo tag nel punto in cui vuoi che l'emozione cambi.
  • Dai al modello una scena completa: Eleven v4 funziona meglio con il contesto. Con una finestra fino a 10.000 caratteri per generazione nell'app Text to Speech, hai spazio per creare indicazioni stratificate e rendere speciale la tua scena.
  • Inizia con un preset, poi sii specifico. Se [nervous] è vicino al risultato desiderato ma non del tutto corretto, scrivi cosa manca: [nervous, trying to sound confident].

Ma soprattutto, entra nell'app TTS di ElevenLabs e sperimenta: è il modo migliore per prendere confidenza e iniziare a produrre audio TTS di alta qualità.

Guide to six ElevenLabs audio tag list types and layering multiple cues with comma-separated tags.

Inizia a creare audio immersivo con Eleven v4

Non esiste un elenco definitivo degli Audio Tags di ElevenLabs, perché puoi creare qualsiasi combinazione desideri scrivendo in linguaggio naturale. Tutti i tag di questo elenco funzionano su Eleven v4, ma funzioneranno anche quelli che ti verranno in mente mentre scrivi la tua scena.

Scegli una delle oltre 17.500 voci della Voice Library, incolla il tuo script e aggiungi il primo Audio Tag per iniziare. 

Scopri di più su Eleven v4 oppure registrati per creare interpretazioni audio straordinarie.

Domande frequenti sugli Audio Tags di ElevenLabs

  1. Artificial Analysis, Provider Voice Arena Preference Elo, 30 settembre 2026

Articoli simili

Crea con l'audio IA della massima qualità