Professional Voice Cloning-snabbstart
Den här guiden visar hur du skapar en Professional Voice Clone med PVC API.
Den här guiden visar hur du skapar en Professional Voice Clone (PVC) med PVC API. För att skapa en PVC via instrumentpanelen, se produktguiden Professional Voice Clone.
För att skapa en PVC behöver du ha Creator-planen eller högre.
För en djupgående förklaring av hur IVC och PVC fungerar bakom kulisserna och när du ska välja respektive, se Röstkloning: så fungerar det.
Om du är osäker på vad som är tillåtet ur ett juridiskt perspektiv, se användarvillkoren och vår information om AI-säkerhet för mer information.
Att skapa en PVC via API:t omfattar betydligt fler steg än att skapa en Instant Voice Clone. Det beror på att PVC:er är mer komplexa och kräver mer data och finjustering för att skapa en klon av hög kvalitet.
Använda Professional Voice Clone API
Den här guiden förutsätter att du har konfigurerat din API-nyckel och SDK. Slutför snabbstarten först om du inte redan har gjort det.
Skapa en PVC-röst
Skapa en ny fil med namnet example.py eller example.mts, beroende på vilket språk du väljer, och lägg till följande kod för att skapa en PVC-röst:
Ladda upp ljudfiler
Därefter laddar vi upp ljudexempelfilerna som ska användas för att träna PVC:n. Läs avsnittet Tips och förslag i PVC-produktguiden för mer information om hur du får bäst resultat från dina ljudfiler.
Starta talarseparation
I det här steget försöker vi dela upp ljudfilerna i enskilda talare. Det krävs om du laddar upp ljud med flera talare.
Hämta talarljud
Eftersom föregående steg tar en stund att slutföra bör följande steg köras i en separat process när föregående steg har slutförts.
När talarseparationen är klar har du en lista över talare för varje exempel. Om exempel innehåller flera talare måste du välja den talare som du vill använda för PVC:n. För att identifiera talaren kan du hämta ljudet för varje talare och lyssna på dem.
Uppdatera exempel med talar-ID:n
När talarseparationen är klar kan du uppdatera exemplen för att välja vilken talare du vill använda för PVC:n.
Verifiera PVC:n
Innan träningen kan börja krävs ett verifieringssteg för att säkerställa att du har tillstånd att använda rösten. Begär först verifierings-CAPTCHA:n.
Bilden innehåller flera textrader som röstens ägare behöver läsa upp och spela in. När det är klart skickar du inspelningen för att verifiera röstägarens identitet.
(Valfritt) Begär manuell verifiering
Om du inte kan verifiera CAPTCHA:n kan du begära manuell verifiering. Observera att det tar längre tid att behandla.
Detta bör endast användas om de tidigare verifieringsstegen har misslyckats eller inte är möjliga, till exempel om röstens ägare är synskadad.
Kontakta supporten för en lista över filer som krävs för manuell verifiering, eftersom varje fall kan vara unikt.
Träna PVC:n
Starta sedan träningsprocessen. Hur lång tid det tar beror på längden och antalet exempel som har angetts.
Använd den nyss skapade rösten
När PVC:n har verifierats kan du använda den på samma sätt som vilken annan röst som helst. Se Text to Speech-snabbstarten för mer information om hur du använder en röst.