Voice Design
Utwórz głos na podstawie promptu tekstowego.
Nagłówki
Parametry zapytania
Format wyjściowy wygenerowanego audio.
Żądanie
Opis dla utworzonego głosu.
Tekst do wygenerowania musi mieć od 100 do 1000 znaków.
Czy automatycznie generować tekst odpowiedni do opisu głosu.
Określa poziom głośności wygenerowanego głosu. -1 oznacza najciszej, 1 najgłośniej, a 0 odpowiada około -24 LUFS.
Wyższa jakość daje lepszy głos, ale mniejszą różnorodność.
Liczba losowa sterująca generowaniem głosu. Ten sam seed przy tych samych danych wejściowych daje ten sam głos.
Określa, jak ściśle AI podąża za promptem. Niższe wartości dają AI większą swobodę twórczą, a wyższe zmuszają ją do bliższego trzymania się promptu. Wysokie wartości mogą sprawić, że głos zabrzmi sztucznie lub robotycznie. Przy niższej wartości Guidance Scale zalecamy używać dłuższych, bardziej szczegółowych promptów.
Czy ulepszać opis głosu za pomocą AI, by dodać więcej szczegółów i poprawić jakość generowania głosu. Po włączeniu system automatycznie rozwinie proste prompty w bardziej szczegółowe opisy głosu. Domyślnie False
Odpowiedź
Pomyślna odpowiedź
Podglądy wygenerowanych głosów.
Tekst używany do podglądu głosów.