Best practice
Impara a creare prompt per Music in ElevenCreative per ottenere massima musicalità e controllo.
Questa guida riassume le tecniche più efficaci per scrivere prompt per Music in ElevenCreative. Spiega come il modello interpreta un prompt, il vocabolario di produzione, il controllo musicale, l’arrangiamento, le voci, i loop, il sound design e la struttura temporale e i testi.
Il modello è progettato per comprendere l’intento e generare audio completo e sensibile al contesto in base ai tuoi obiettivi. Prompt generici come “pubblicità per un brand di sneakers” o “meditazione rilassante con voce fuori campo” sono spesso sufficienti per guidare il modello verso tono, struttura e contenuti adatti al tuo caso d’uso.
Come il modello interpreta un prompt
Un prompt risponde a cinque domande, che tu lo voglia o no: genere, atmosfera, strumentazione, tempo ed epoca di produzione. A ogni domanda che lasci aperta, il modello risponde con la scelta statisticamente più probabile, ovvero la più nella media.
Un prompt che lascia aperte tutte e cinque:
La stessa richiesta con tutte e cinque le risposte:
Il secondo prompt non contiene tecniche speciali: ogni decisione nell’output è stata presa da una persona. Scegli genere, atmosfera, strumenti, tempo ed epoca prima che il modello lo faccia al posto tuo.
Genere e creatività
Il modello segue con precisione le convenzioni dei generi e il tono emotivo. Risponde efficacemente sia a:
- Descrittori astratti dell’atmosfera (ad es. “inquietante”, “minaccioso”)
- Linguaggio musicale dettagliato (ad es. “stridii di violino dissonanti su un sub-basso pulsante”)
La lunghezza e il livello di dettaglio del prompt non corrispondono sempre a output di qualità migliore. Per risultati più creativi e inaspettati, prova a usare parole chiave semplici ed evocative per lasciare che il modello interpreti e componga liberamente.
Vocabolario di produzione
Il modello comprende la musica nel modo in cui se ne parla negli studi. Il linguaggio da studio agisce su leve reali: sidechained, close-mic’d, bone-dry, tape saturation, plate reverb modificano ciascuno il mix in modo percepibile.
La stessa ballata in tre stanze: cambiano solo le parole sulla produzione:
Se non conosci il vocabolario, descrivi lo spazio: “sembra registrato in una tromba delle scale” ti darà una tromba delle scale.
L’epoca di produzione è una manopola come il tempo, e il modello può cambiarla a metà brano. Nominare un’epoca (“rock and roll degli anni ‘50 con slapback echo”, “jungle degli anni ‘90”) definisce l’intero carattere della produzione, mentre descrivere i cambi di epoca nel tempo produce transizioni coerenti all’interno di una singola traccia.
Controllo musicale
Il modello segue accuratamente i BPM e spesso coglie la tonalità musicale desiderata. Per avere maggiore controllo su timing e armonia, includi nel prompt indicazioni di tempo come “130 BPM” e tonalità come “in La minore”. Il modello mantiene BPM e tonalità indicati con precisione sufficiente per sovrapporre l’output ad altro materiale, come una registrazione vocale, un sample o una seconda generazione.
Per influenzare l’interpretazione e il tono vocale, usa descrittori espressivi come “grezzo”, “dal vivo”, “glitchato”, “arioso” o “aggressivo”. Le indicazioni sull’interpretazione funzionano allo stesso modo: sussurrato, a piena voce, conversazionale, impassibile, armonizzazioni sovrapposte. Lo stesso testo con istruzioni opposte:
Il modello può riprodurre efficacemente più voci: usa prompt come “due cantanti che armonizzano in Do” per dirigere l’arrangiamento vocale.
In generale, prompt più dettagliati portano a maggiore controllo ed espressività nell’output.
Arrangiamento
Il modello segue le istruzioni temporali. Descrivi l’arrangiamento in ordine, come faresti dando indicazioni a una band:
Le parole chiave sono piccole: inizia con, solo, poi, aggiungi. Senza solo, il modello riempie il silenzio: indica esplicitamente i silenzi.
Loop
Un prompt per un loop è un esercizio di esclusione. Indica le battute, i BPM, la tonalità e ciò che è vietato:
“Niente melodia, solo batteria” è il motivo per cui il break di batteria resta un break di batteria. Per i loop, lo spazio negativo è il prompt.
Struttura temporale e testi
Puoi specificare la durata del brano (ad es. “60 secondi”) oppure usare la modalità automatica per lasciare che il modello determini la durata. Se non fornisci un testo, il modello genererà testi strutturati che corrispondono alla durata scelta o rilevata automaticamente.
Per impostazione predefinita, la maggior parte dei prompt musicali include testi. Per generare musica senza voce, aggiungi “solo strumentale” al prompt. Puoi anche scrivere i tuoi testi per avere un maggiore controllo creativo. Il modello usa i tuoi testi insieme alla lunghezza del prompt per determinare struttura e posizionamento delle voci.
Per gestire quando iniziano o finiscono le voci, includi indicazioni temporali chiare come:
- “i testi iniziano a 15 secondi”
- “solo strumentale dopo 1:45”
Il modello supporta la generazione di testi multilingue. Per cambiare la lingua di un brano generato nella nostra UI, usa follow-up come “fallo in giapponese” o “traduci in spagnolo”.
Isolamento di strumenti e voci
Per creare stem con maggiore controllo, usa prompt e strutture mirati:
- Usa la parola “solo” prima degli strumenti (ad es. “chitarra elettrica solista”, “pianoforte solista in Do minore”).
- Per le voci, usa “a cappella” prima della descrizione vocale (ad es. “voci femminili a cappella”, “coro maschile a cappella”).
Per migliorare la qualità e il controllo degli stem:
- Includi tonalità, tempo (BPM) e carattere musicale (ad es. “voci a cappella in La maggiore, 90 BPM, intense e grezze”).
- Sii il più descrittivo possibile dal punto di vista musicale per guidare l’output del modello.
Sound design
Il modello riproduce il suono stesso e non giudica se il suono che descrivi potrebbe esistere fisicamente. L’audio non musicale, come effetti sonori, ambienti e texture, può essere richiesto direttamente o incorporato in una traccia:
Il metodo: prendi un suono esistente, attribuiscigli una proprietà che non dovrebbe avere e descrivi il risultato con serietà. Tutte le tecniche di questa guida, come tonalità, BPM, sidechaining e arrangiamento descritto, funzionano su questi suoni come materia prima.
Riferimento audio
Alcune idee resistono alla descrizione: una melodia che hai canticchiato nel telefono, lo swing di una linea di basso specifica, una texture che puoi soltanto indicare. Carica una traccia, anche un memo vocale va bene, come Riferimento audio, e il modello ne riprodurrà atmosfera, groove e palette senza copiarne le note.
Il prompt continua a guidare tutto ciò che il riferimento lascia aperto. L’abbinamento che funziona: un riferimento che porta con sé l’atmosfera e un prompt che indica cosa dovrebbe essere diverso, ad esempio “stessa energia, batteria half-time, voce femminile”.
I caricamenti possono durare circa 30 secondi. Ogni traccia di riferimento supera un controllo del copyright prima della generazione: Riferimento audio è progettato per la musica che hai creato tu.
Prompt di esempio
Il modello ti permette di andare oltre le descrizioni dei brani e concentrarti sull’intento per massimizzare la creatività.
Pubblicità per mascara
Inno synthwave
Sperimentale
Un secolo di registrazioni
Bedroom pop
Riepilogo
Tre abitudini coprono la maggior parte di questa guida:
- Sii specifico. Genere, atmosfera, strumenti, tempo, epoca: sceglili tutti e cinque, altrimenti il modello sceglie per te.
- Parla la lingua della produzione. Il vocabolario da studio agisce su leve reali e il modello rispetta i numeri con precisione.
- Vincola ciò che conta, lascia spazio a tutto il resto. Arrangiamenti descritti, esclusioni esplicite, indicazioni per la voce.
Avanzato: piani di composizione
Per controllare con precisione la struttura delle sezioni, il posizionamento dei testi e gli arrangiamenti con più voci, usa i piani di composizione anziché semplici prompt di testo.