Dobre praktyki

Opanuj tworzenie promptów dla Music w ElevenCreative, aby uzyskać maksymalną muzykalność i kontrolę.

Ten przewodnik podsumowuje najskuteczniejsze techniki promptowania Music w ElevenCreative. Wyjaśnia, jak model odczytuje prompt, omawia słownictwo produkcyjne, kontrolę muzyczną, aranżację, wokale, pętle, sound design oraz timing i teksty.

Model rozumie intencje i tworzy kompletne, świadome kontekstu audio na podstawie twoich celów. Ogólne prompty, takie jak “reklama marki sneakersów” lub “spokojna medytacja z nałożonym głosem”, często wystarczą, by nadać utworowi ton, strukturę i treść pasujące do twojego zastosowania.

Jak model odczytuje prompt

Prompt odpowiada na pięć pytań, niezależnie od tego, czy tego chcesz: gatunek, nastrój, instrumentarium, tempo i era produkcji. Na każde pytanie, które pozostawisz otwarte, model odpowie najbardziej statystycznie prawdopodobnym wyborem — czyli najbardziej przeciętnym.

Prompt, który pozostawia wszystkie pięć otwartych:

upbeat electronic track

To samo żądanie z odpowiedziami na wszystkie pięć:

French house, 122 BPM, filtered disco sample chops, sidechained bass, tight
four-on-the-floor kick, rooftop-at-sunset mood, warm analog glue

Drugi prompt nie zawiera żadnej specjalnej techniki — każdą decyzję w wyniku podjął człowiek. Wybierz gatunek, nastrój, instrumenty, tempo i erę, zanim model wybierze za ciebie.

Gatunek i kreatywność

Model dobrze trzyma się konwencji gatunkowych i tonu emocjonalnego. Skutecznie reaguje zarówno na:

  • Abstrakcyjne opisy nastroju (np. „złowieszczy”, „ponury”)
  • Szczegółowy język muzyczny (np. „dysonansowe skrzypcowe piski nad pulsującym sub-bassem”)

Długość i szczegółowość promptu nie zawsze przekładają się na lepszą jakość wyniku. Aby uzyskać bardziej kreatywne i nieoczekiwane rezultaty, użyj prostych, sugestywnych słów kluczowych, które pozwolą modelowi swobodnie interpretować i komponować.

Słownictwo produkcyjne

Model rozumie muzykę tak, jak mówi się o niej w studiach. Język studyjny steruje konkretnymi parametrami: sidechained, close-mic’d, bone-dry, tape saturation, plate reverb — każde z nich słyszalnie zmienia miks.

Ta sama ballada w trzech pomieszczeniach — zmieniają się tylko słowa dotyczące produkcji:

slow soul ballad, 68 BPM, female vocal — bone-dry drums, close-mic'd vocal, dead room
slow soul ballad, 68 BPM, female vocal — cavernous plate reverb, tape echo throws, gospel room
slow soul ballad, 68 BPM, female vocal — tape saturation, wow and flutter, dusty vinyl crackle

Jeśli nie znasz słownictwa, opisz przestrzeń: „brzmi, jakby nagrano to na klatce schodowej” da ci klatkę schodową.

Era produkcji to pokrętło takie jak tempo, a model może zmieniać ją w trakcie utworu. Wskazanie ery („rock and roll z lat 50. ze slapback echo”, „jungle z lat 90.”) ustawia cały charakter produkcji, a opisywanie zmian er w czasie tworzy spójne przejścia w jednym utworze.

Kontrola muzyczna

Model dokładnie przestrzega BPM i często oddaje zamierzoną tonację. Aby zyskać większą kontrolę nad timingiem i harmonią, dodaj do promptu wskazówki dotyczące tempa, np. „130 BPM”, oraz tonacji, np. „w A minor”. Model utrzymuje określone BPM i tonację na tyle precyzyjnie, że możesz nałożyć wynik na inne materiały — nagranie wokalu, sample czy drugi wygenerowany utwór.

Aby wpłynąć na sposób śpiewania i barwę wokalu, użyj określeń takich jak „surowy”, „na żywo”, „glitchujący”, „oddechowy” lub „agresywny”. Wskazówki dotyczące wykonania działają tak samo: whispered, belted, conversational, deadpan, stacked harmonies. Ten sam tekst przy przeciwnych instrukcjach:

whispered indie folk, close and intimate, fingerpicked acoustic guitar
stadium rock, belted powerhouse vocal, huge drums, wall of guitars

Model dobrze renderuje wielu wokalistów — użyj promptów typu „two singers harmonizing in C”, by określić aranżację wokali.

Ogólnie bardziej szczegółowe prompty dają większą kontrolę i ekspresję w wyniku.

Aranżacja

Model przestrzega instrukcji dotyczących czasu. Opisz aranżację po kolei, tak jak przekazywałbyś wskazówki zespołowi:

UK garage, 132 BPM — start with just a shuffled drum loop, add a warm sub bassline
after four bars, then bring in chopped vocal stabs for the drop

Kluczowe słowa są krótkie: start with, just, then, bring in. Bez just model wypełni ciszę — zaznaczaj ciszę wprost.

Pętle

Prompt dla pętli to ćwiczenie z wykluczania. Podaj liczbę taktów, BPM, tonację — i określ, co jest zakazane:

boom bap drum break, 90 BPM, dusty and swung, four bars, no melody — just drums
dreamy guitar loop, 140 BPM, F sharp minor, emo trap, four bars, instrumental

„No melody, just drums” to cały powód, dla którego break perkusyjny pozostaje breakiem perkusyjnym. W przypadku pętli negatywna przestrzeń jest promptem.

Timing struktury i teksty

Możesz określić długość utworu (np. „60 seconds”) albo użyć trybu automatycznego, aby model ustalił czas trwania. Jeśli nie podasz tekstu, model wygeneruje ustrukturyzowany tekst pasujący do wybranej lub automatycznie wykrytej długości.

Domyślnie większość promptów muzycznych zawiera tekst. Aby wygenerować muzykę bez wokalu, dodaj do promptu „instrumental only”. Możesz też napisać własny tekst, aby zyskać większą kontrolę twórczą. Model używa twojego tekstu wraz z długością promptu, by określić strukturę i rozmieszczenie wokali.

Aby zarządzać momentem rozpoczęcia lub zakończenia wokalu, dodaj wyraźne wskazówki czasowe, np.:

  • „lyrics begin at 15 seconds”
  • „instrumental only after 1:45”

Model obsługuje generowanie tekstów w wielu językach. Aby zmienić język wygenerowanego utworu w naszym interfejsie, użyj kolejnych poleceń, np. „make it Japanese” lub „translate to Spanish.”

Izolacja instrumentów i wokali

Aby tworzyć stemsy z większą kontrolą, używaj precyzyjnych promptów i struktury:

  • Użyj słowa „solo” przed instrumentami (np. „solo electric guitar”, „solo piano in C minor”).
  • W przypadku wokali użyj „a cappella” przed opisem wokalu (np. „a cappella female vocals”, „a cappella male chorus”).

Aby poprawić jakość stemów i kontrolę:

  • Podaj tonację, tempo (BPM) i charakter muzyczny (np. „a cappella vocals in A major, 90 BPM, soulful and raw”).
  • Opisuj muzykę jak najdokładniej, aby ukierunkować wynik modelu.

Sound design

Model renderuje sam dźwięk i nie ocenia, czy opisywany dźwięk mógłby fizycznie istnieć. Niemuzyczne audio — efekty dźwiękowe, ambience, tekstury — możesz promptować bezpośrednio lub włączyć do utworu:

a thunderstorm in 6/8 — thunder lands on the downbeat, rain fills the offbeats,
distant lightning as crash cymbals
one enormous cathedral bell that, as it decays, slowly turns out to have been
a choir all along
an orchestra tuning up that accidentally becomes techno — the A gets a kick drum,
chaos becomes a groove

Metoda: weź dźwięk, który istnieje, nadaj mu jedną właściwość, której nie powinien mieć, i opisz rezultat całkiem serio. Każda technika z tego przewodnika — tonacje, BPM, sidechaining, opisana aranżacja — działa na takich dźwiękach jako surowym materiale.

Referencja audio

Niektóre pomysły trudno opisać — melodia, którą zanuciłeś do telefonu, swing konkretnej linii basu, tekstura, na którą możesz tylko wskazać. Prześlij utwór (notatka głosowa też się liczy) jako Audio Reference, a model dopasuje jego klimat, groove i paletę, nie kopiując nut.

Prompt nadal steruje wszystkim, co referencja pozostawia otwarte. Dobrze działa połączenie referencji niosącej klimat z promptem mówiącym, co ma być inne — „same energy, half-time drums, female vocal.”

Przesłane pliki mogą mieć około 30 sekund. Każdy utwór referencyjny przechodzi kontrolę praw autorskich przed generowaniem — Audio Reference jest przeznaczone do muzyki, którą stworzyłeś samodzielnie.

Przykładowe prompty

Model pozwala wyjść poza opisy utworów i przejść do intencji, by zwiększyć kreatywność.

Track for a high-end mascara commercial. Upbeat and polished. Voiceover only.
The script begins: "We bring you the most volumizing mascara yet." Mention the brand
name "X" at the end.

Podsumowanie

Trzy nawyki obejmują większość tego przewodnika:

  1. Bądź konkretny. Gatunek, nastrój, instrumenty, tempo, era — wybierz wszystkie pięć albo model wybierze za ciebie.
  2. Mów językiem produkcji. Słownictwo studyjne steruje konkretnymi parametrami, a model dokładnie trzyma się liczb.
  3. Ogranicz to, co ważne, a reszcie zostaw przestrzeń. Opisane aranżacje, wyraźne wykluczenia, wskazówki dla głosu.

Zaawansowane: plany kompozycji

Aby precyzyjnie kontrolować strukturę sekcji, rozmieszczenie tekstu i aranżacje z wieloma wokalistami, używaj planów kompozycji zamiast prostych promptów tekstowych.