Introducing Eleven v4Introducing Eleven v4, our fastest and most emotive voice model

Hoppa till innehållet

Våra mest uttrycksfulla modeller hittills

Möt Eleven v4
och v4 Turbo

Skapa styrbart, uttrycksfullt tal med känslor, ljudhändelser och uppslukande ljudlandskap.

Eleven v4

Vår snabbaste och mest uttrycksfulla röstmodell

Eleven v4 bygger på en helt ny arkitektur som läser ett manus som en röstskådespelare. Den vet vem som talar, vad som just hände och hur varje replik ska landa.

Ett brett register av känslor och ljud

Tal på över 90 språk med ett enastående känslomässigt register, flera talare och inbyggda ljudeffekter som sätter scenen.

Demo 1 av 4

Byggd på en ny arkitektur

Skriv instruktioner direkt i manuset

Lägg till instruktioner som [laughs], [whispers] och [door slams] direkt i manuset. Eleven v4 följer taggsekvenser mer tillförlitligt än v3, inklusive ljudeffekter.

Sätt ihop långt ljud utan skarvar

Kontextsammanfogning håller tempo och framförande jämna genom manus av valfri längd. En hel ljudbok låter som en enda tagning från första sidan till sista.

Generera om utan att rösten förändras

Gör om en replik en eller femtio gånger – det är fortfarande samma person som talar. Talarens röst förblir stabil i dialog, berättarröst och allt däremellan.

Välj en Professional Voice Clone

Professional Voice Clones stöddes inte i v3. I Eleven v4 är de tillbaka och kan använda modellens hela känslomässiga register på alla språk de talar.

Eleven v4 Turbo

Vi presenterar Eleven v4 Turboför realtid och agenter

Vår snabbaste talmodell för realtid med samma uttrycksfulla omfång som Eleven v4, tillgänglig via API:t och ElevenAgents. Eleven v4 Turbo har en medianlatens för inferens på cirka 100 ms, tid till första tal på cirka 150 ms och är konsekvent även i långa interaktioner.

Svarstider som uppringare aldrig märker

Med en mediantid till första tal på 150 ms försvinner fördröjningen och samtalet flyter på smidigt.

Eleven v4 Turbo
150ms101234567891501234567895001234567890ms
Cartesia Sonic 3.6
262ms201234567892601234567896201234567892ms
OpenAI GPT-4o mini TTS
814ms801234567898101234567891401234567894ms
Median tid till första tal

Hör den i ett riktigt samtal

Läs mer om Eleven v4 Turbo från en agent som drivs av modellen.

Optimerad för livesamtal

Streama in, streama ut

Skicka text medan din LLM genererar den, så börjar ljudet komma tillbaka innan meningen är klar. Dubbelriktad streaming, byggd för agentloopar.

Uttryck i samtalstempo

Turbo har hela Eleven v4:s uttrycksfulla register. Bekräftelser, eskaleringar och väntelägen låter olika i stället för likadant.

Samma röst i varje tur

Professional Voice Clones fungerar identiskt i båda modellerna, så samma varumärkesröst förblir konsekvent från första till sista vändan i ett samtal.

Tala språket som en lokalinvånare

Använd japansk, spansk eller portugisisk text, så talar rösten flytande med naturlig accent.

Välj bland över 17 500 röster

Berättarröster En plats för berättare. Varm, auktoritativ och konsekvent i varje projekt.

Konversationsröster För vardagliga samtal behöver du en naturlig och avslappnad röst. Våra konversationsröster är gjorda för dialoger och poddar som känns improviserade.

Röster för sociala medier Röster som vaknar till liv i kortformat. Fånga energin och personligheten som får användaren att stanna kvar på din TikTok eller Reel från början till slut.

Karaktärsröster En samling röster för din fiktiva värld. Välj bland en dynamisk ensemble som väcker ditt spel, din ljudbok eller din animation till liv.

Utbildningsröster Pålitliga, tålmodiga röster som guidar elever genom komplexa ämnen. De passar utmärkt för kurser, handledningar, träningssimuleringar och guider på alla nivåer.

Reklamröster Välpolerade röster med självförtroende som hjälper dig att sälja nästa produkt. Perfekta för digital reklam eller reklam för tv och radio.

Underhållningsröster Från mäktiga filmtrailrar till komiska röster skapade för uppträdanden – de här rösterna har massor av personlighet. För innehåll där framförandet är lika viktigt som materialet.

Flerspråkiga röster Röster byggda för globalt innehåll. Naturligt tempo, idiomatiska uttryck och accenter som når publiken på varje marknad.

Vi har skalat användningen av Agentforce Voice genom deterministisk styrning, och kunderna säger konsekvent att de litar på lösningen eftersom varje åtgärd en agent utför är förankrad och styrd, snarare än improviserad. En viktig del av strategin är att balansera den determinismen med högkvalitativa röstmodeller med hög emotionell intelligens. Det är precis där Eleven v4 Turbo höjer ribban, med snabbare, mer naturliga svar som når den standard våra kunder förväntar sig – och gör det möjligt för dem att använda Agentforce Voice i ännu fler sammanhang.

Ryan Peterson, SVP Product för Agentforce Voice, Salesforce

När vi arbetar med hundratals publicister för att göra deras journalistik till ljud ser vi på nära håll hur viktig röstkvaliteten är. Sedan samarbetet med ElevenLabs inleddes har många av våra publicister fått högre engagemang och längre lyssningstider. Eleven v4 ger publicister fler sätt att se till att rösterna känns engagerande, välbekanta och tydligt deras egna.

Patrick O'Flaherty, Medgrundare av BeyondWords

ElevenLabs v4 ger röstsamtal en ny nivå av naturligt ljud. Rösterna är inte bara mer uttrycksfulla utan också mer styrbara, vilket låter oss skapa rikare och mer uppslukande röstupplevelser.

Chrys Bader, Medgrundare och VD för Rosebud

Första gången jag använde den, Eleven v4, var den så ren och verklighetstrogen att det kändes som att jag hade en inspelningssession med en röstskådespelare i studion.

Kyle Gudmundson, Chef för musik och ljud, Accenture Accelerate

Vi har letat efter en röstmodell som är tillräckligt snabb för att kännas som ett riktigt samtal utan att kompromissa med kvaliteten, och Eleven v4 Turbo är den första som klarar båda. För automatiserade säljflöden är det här punkten då utvecklingen slutar kännas som ett experiment.

Oscar Daniels, Chef för produkter inom kreditbyggande, Spring Financial

Välj hur den låterinnan den säger ett ord

Varje generering börjar med en röst. Klona en du redan har, skapa en från en beskrivning eller korrigera uttalet av specifika ord med IPA-stöd.

Smiling person in an orange pleated garment and patterned scarf.
Glowing orange sphere with bright curved streaks against a textured orange background.

Voice Cloning

Klona en röst från tio sekunders ljud, eller träna en Professional Voice Clone för en nästintill perfekt träff.

“En kvinna i slutet av 20-årsåldern med en klar, konversationell röst och amerikansk accent. Vänlig, lekfull och avslappnad ton.”

Voice Design

Beskriv en röst i en mening och generera den, utan inspelningssession eller audition.

OAuthå-aut
Hülkenberghylken-berg
Reykjavikrejk-ja-vik
YAMLjam-ul

Uttalslexikon

Definiera hur namn, akronymer och tekniska termer uttalas. Ställ in uttalet en gång, så används det i varje generering.

Börja skapa gratisUppgradera när du behöver mer

  • Kom igång

    0 $/mån

    Kom igång gratis

    Gratisplanen innehåller:

    • 10 000 krediter varje månad
    • Personligt bruk
    • Inget kreditkort krävs
  • Premiumplaner

    6 $/mån

    Utforska planer

    Betalplanerna innehåller:

    • Över 30 000 krediter varje månad
    • Professionell röstkloning
    • Högre gränser och snabbare generering
  • Enterprise

    Anpassad prissättning

    Kontakta oss

    Enterprise-planen innehåller:

    • Större volym
    • Anpassad SSO
    • Prioriterad support

Tillgängligt via APITa Eleven v4 till din app

Bygg med Eleven v4 Turbo för realtidsupplevelser och röstagenter, allt via ElevenAPI.

Få tillgång till API:t för Eleven v4 och Eleven v4 Turbo

Lägg till uttrycksfullt tal i valfri produkt med vårt REST API, streamingändpunkter eller SDK:er för TypeScript och Python.

  • Byt modell med ett enda model_id
  • Streama in text och få ljud i realtid
  • Behåll kontinuiteten mellan genereringar av långt innehåll
import { ElevenLabsClient, play } from '@elevenlabs/elevenlabs-js';
import 'dotenv/config';

const elevenlabs = new ElevenLabsClient({
  apiKey: process.env.ELEVENLABS_API_KEY
});
const audio = await elevenlabs.textToSpeech.convert(
  's3TPKV1kjDlVtZbl4Ksh', // "George" - browse voices at elevenlabs.io/app/voice-library
  {
    text: 'The first move is what sets everything in motion.',
    modelId: 'eleven_v4',
  }
);
play(audio);

Vanliga frågor

Skapa med AI-ljud av högsta kvalitet