Snabbstart för Text to Dialogue
Lär dig skapa uppslukande dialog från text.
Den här guiden visar hur du skapar uppslukande, naturligt klingande dialog från text med Text to Dialogue API:t.
Håll den sammanlagda längden för alla inputs[].text-värden på högst 2 000 tecken per begäran för
tillförlitlig generering. Dela upp längre manus i delar och sammanfoga ljudet på klientsidan.
Använda Text to Dialogue API:t
Skapa en API-nyckel
Skapa en API-nyckel i kontrollpanelen här, som du använder för att säkert få åtkomst till API:et.
Spara nyckeln som en hanterad hemlighet och skicka den till SDK:erna antingen som en miljövariabel via en .env-fil eller direkt i appens konfiguration, beroende på vad du föredrar.
Installera SDK:t
SDK
CLI
Vi använder också biblioteket dotenv för att läsa in vår API-nyckel från en miljövariabel.
Gör API-begäran
SDK
CLI
Skapa en ny fil med namnet example.py eller example.mts, beroende på vilket språk du väljer, och lägg till följande kod.
Lägg till ljudtaggar i varje text-värde för att styra talarens leverans. voice_id
väljer talarrösten för samma indatavärde.
Kör sedan programmet:
Du bör höra dialogljudet spelas upp.
WebSocket-streaming
För stegvis dialog över en långvarig anslutning med Eleven v3-modeller följer du Realtime Text to Dialogue. För att jämföra denna WebSocket med standard-WebSocket för TTS, se Text to Speech vs Text to Dialogue WebSockets.