Voice Changer
En guide till hur du omvandlar ljud mellan röster och samtidigt bevarar känsla och leverans.
Översikt
Voice Changer (tidigare Speech to Speech) låter dig omvandla en röst (källröst) till en annan (klonad röst) samtidigt som originalröstens ton och framförande bevaras.
Voice Changer kan användas som komplement till Text to Speech (TTS) för att rätta uttalsfel eller ge uttryck för det särskilda framförande du vill åstadkomma. Voice Changer är särskilt användbart för att efterlikna de subtila, särpräglade egenskaper hos rösten som ger en mer känslosam och mänsklig känsla. Några viktiga funktioner är:
- Större träffsäkerhet vid viskningar
- Möjlighet att skapa hörbara suckar, skratt eller gråt
- Avsevärt förbättrad identifiering av ton och känslor
- Följer taltempot i inmatningen korrekt
- Bevarar språk och accent
Se en video där Voice Changer används
Guide

Du kan antingen ladda upp ljud direkt från en ljudfil eller tala live via en mikrofon. Ljudfilen måste vara mindre än 50 MB, och varken ljudfilen eller din liveinspelning får vara längre än 5 minuter.
Om du har material som är längre än 5 minuter rekommenderar vi att du delar upp det i mindre avsnitt och genererar dem separat. Om filen är för stor kan du också behöva komprimera eller konvertera den till mp3.
Befintlig ljudfil
För att ladda upp en befintlig ljudfil klickar du på ljudrutan eller drar och släpper ljudfilen direkt på den.
Spela in live
Tryck på knappen Spela in ljud i ljudrutan. När du är redo att börja spela in trycker du på knappen Mikrofon. När du har spelat in klart trycker du på knappen Stoppa.
Du ser sedan ljudfilen från inspelningen, som du kan spela upp för att lyssna på den. Det hjälper dig att avgöra om du är nöjd med ditt framförande eller din inspelning. Teckenkostnaden visas i det nedre vänstra hörnet, och du debiteras ingen kvot för själva inspelningen – endast när du trycker på ”Generera”.
Kostnaden för en Voice Changer-generering baseras enbart på längd och är 1 000 tecken per minut.
Inställningar

Läs mer om de olika röstinställningarna här.
Voice Changer lägger till en extra inställning för att automatiskt ta bort bakgrundsbrus från din inspelning.
Språk som stöds
eleven_english_sts_v2
Våra flerspråkiga v2-modeller har stöd för 29 språk:
Engelska (USA, Storbritannien, Australien, Kanada), japanska, kinesiska, tyska, hindi, franska (Frankrike, Kanada), koreanska, portugisiska (Brasilien, Portugal), italienska, spanska (Spanien, Mexiko), indonesiska, nederländska, turkiska, filippinska, polska, svenska, bulgariska, rumänska, arabiska (Saudiarabien, Förenade Arabemiraten), tjeckiska, grekiska, finska, kroatiska, malajiska, slovakiska, danska, tamil, ukrainska och ryska.
Modellen eleven_english_sts_v2 stöder endast engelska.
Bästa praxis
Voice Changer är utmärkt på att bevara accenter och naturligt taltempo mellan olika röster i utdata. Om du till exempel laddar upp ett ljudprov med portugisisk accent behåller resultatet det språket och den accenten. Indataprovets kvalitet är avgörande eftersom det bestämmer resultatets egenskaper. Om du väljer en brittisk röst som ”George” men spelar in med amerikansk accent blir resultatet Georges röst med amerikansk accent.
- Uttryck: Var uttrycksfull i dina inspelningar. Oavsett om du ropar, gråter eller skrattar återger Voice Changer ditt framförande korrekt. Verktyget är utformat för att göra AI mer realistisk och ge utrymme för kreativt uttryck.
- Mikrofonförstärkning: Kontrollera att ingångsförstärkningen är lämplig. En låg inspelningsnivå kan göra det svårare för AI att känna igen ljudet, medan en hög nivå kan orsaka klippning.
- Bakgrundsbrus: Aktivera alternativet Ta bort bakgrundsbrus för att automatiskt ta bort bakgrundsbrus från din inspelning.