Hoppa till navigering

Voice Changer

En guide till hur du omvandlar ljud mellan röster och samtidigt bevarar känsla och leverans.

Översikt

Voice Changer (tidigare Speech to Speech) låter dig omvandla en röst (källröst) till en annan (klonad röst) samtidigt som originalröstens ton och framförande bevaras.

Voice Changer kan användas som komplement till Text to Speech (TTS) för att rätta uttalsfel eller ge uttryck för det särskilda framförande du vill åstadkomma. Voice Changer är särskilt användbart för att efterlikna de subtila, särpräglade egenskaper hos rösten som ger en mer känslosam och mänsklig känsla. Några viktiga funktioner är:

  • Större träffsäkerhet vid viskningar
  • Möjlighet att skapa hörbara suckar, skratt eller gråt
  • Avsevärt förbättrad identifiering av ton och känslor
  • Följer taltempot i inmatningen korrekt
  • Bevarar språk och accent

Guide

Demo av Voice Changer

Du kan antingen ladda upp ljud direkt från en ljudfil eller tala live via en mikrofon. Ljudfilen måste vara mindre än 50 MB, och varken ljudfilen eller din liveinspelning får vara längre än 5 minuter.

Om du har material som är längre än 5 minuter rekommenderar vi att du delar upp det i mindre avsnitt och genererar dem separat. Om filen är för stor kan du också behöva komprimera eller konvertera den till mp3.

Befintlig ljudfil

För att ladda upp en befintlig ljudfil klickar du på ljudrutan eller drar och släpper ljudfilen direkt på den.

Spela in live

Tryck på knappen Spela in ljud i ljudrutan. När du är redo att börja spela in trycker du på knappen Mikrofon. När du har spelat in klart trycker du på knappen Stoppa.

Du ser sedan ljudfilen från inspelningen, som du kan spela upp för att lyssna på den. Det hjälper dig att avgöra om du är nöjd med ditt framförande eller din inspelning. Teckenkostnaden visas i det nedre vänstra hörnet, och du debiteras ingen kvot för själva inspelningen – endast när du trycker på ”Generera”.

Kostnaden för en Voice Changer-generering baseras enbart på längd och är 1 000 tecken per minut.

Inställningar

Inställningar för Voice Changer

Läs mer om de olika röstinställningarna här.

Voice Changer lägger till en extra inställning för att automatiskt ta bort bakgrundsbrus från din inspelning.

Språk som stöds

eleven_english_sts_v2

Våra flerspråkiga v2-modeller har stöd för 29 språk:

Engelska (USA, Storbritannien, Australien, Kanada), japanska, kinesiska, tyska, hindi, franska (Frankrike, Kanada), koreanska, portugisiska (Brasilien, Portugal), italienska, spanska (Spanien, Mexiko), indonesiska, nederländska, turkiska, filippinska, polska, svenska, bulgariska, rumänska, arabiska (Saudiarabien, Förenade Arabemiraten), tjeckiska, grekiska, finska, kroatiska, malajiska, slovakiska, danska, tamil, ukrainska och ryska.

Modellen eleven_english_sts_v2 stöder endast engelska.

Läs mer om modeller

Bästa praxis

Voice Changer är utmärkt på att bevara accenter och naturligt taltempo mellan olika röster i utdata. Om du till exempel laddar upp ett ljudprov med portugisisk accent behåller resultatet det språket och den accenten. Indataprovets kvalitet är avgörande eftersom det bestämmer resultatets egenskaper. Om du väljer en brittisk röst som ”George” men spelar in med amerikansk accent blir resultatet Georges röst med amerikansk accent.

  • Uttryck: Var uttrycksfull i dina inspelningar. Oavsett om du ropar, gråter eller skrattar återger Voice Changer ditt framförande korrekt. Verktyget är utformat för att göra AI mer realistisk och ge utrymme för kreativt uttryck.
  • Mikrofonförstärkning: Kontrollera att ingångsförstärkningen är lämplig. En låg inspelningsnivå kan göra det svårare för AI att känna igen ljudet, medan en hög nivå kan orsaka klippning.
  • Bakgrundsbrus: Aktivera alternativet Ta bort bakgrundsbrus för att automatiskt ta bort bakgrundsbrus från din inspelning.

Vanliga frågor

Voice Changer, tidigare känt som Speech to Speech, gör att du kan omvandla en röst (källröst) till en annan (klonad röst) samtidigt som den ursprungliga röstens ton och framförande bevaras.

Möjligheterna är oändliga. Du kan använda det som ett komplement till Text to Speech för att rätta uttal eller få in det särskilda framförande du har letat efter. Det kan också hjälpa röstskådespelare att utöka sitt omfång genom att ge dem tillgång till ett brett urval av olika röster och tonlägen. Vi erbjuder en komplett lösning för dubbning, men om du fortfarande vill dubba på traditionellt sätt kan du använda Voice Changer för att få rätt röst till ditt projekt.

Den maximala längden på ljud som kan omvandlas är 5 minuter. Aktuella priser finns på ElevenCreative och ElevenAPI.

Mer information finns i vår guide.

Priset för Voice Changer, tidigare känt som Speech to Speech, beror på om du genererar via webbplatsen eller API:t.

Aktuella priser finns på ElevenCreative och ElevenAPI.

Den nuvarande maximala inmatningslängden när du använder Voice Changer, tidigare känt som Speech to Speech, är 300 sekunder eller 5 minuters ljud. Detta gäller för alla abonnemang.

Följande filformat kan användas som indataljud för Voice Changer.

Ljud:

  • MP3
  • M4A
  • FLAC
  • OGA
  • OGG
  • WAV

Video:

  • MKV
  • WEBM
  • MP4
  • MOV

Du kan ladda ner genererade filer på två sätt:

Du kan ladda ner en genererad fil direkt genom att klicka på nedladdningsknappen längst ned till höger efter att innehållet har genererats.

Tidigare genererade filer kan laddas ner från din historik. Du kommer åt historiken genom att logga in på ditt konto, välja Voice Changer i sidofältet och sedan klicka på fliken Historik i panelen på höger sida av skärmen.

Du kan klicka på nedladdningsknappen för att ladda ner valfri fil från din historik som en MP3- eller WAV-fil. Klicka på Avancerat för fler nedladdningsalternativ.

No results