Snabbstart för Speech to Text
Lär dig hur du omvandlar talat ljud till text.
Den här guiden visar hur du omvandlar talat ljud till text med Speech to Text API:t.
Använd ElevenLabs tal-till-text-skill för att transkribera ljud från din AI-kodningsassistent:
Den här handledningen visar hur du använder batch-API:t för Speech to Text. För en guide om hur du använder API:t för Speech to Text i realtid, se guiderna för streaming på klientsidan eller streaming på serversidan.
Använda Speech to Text API:t
Skapa en API-nyckel
Skapa en API-nyckel i kontrollpanelen här, som du använder för att säkert få åtkomst till API:et.
Spara nyckeln som en hanterad hemlighet och skicka den till SDK:erna antingen som en miljövariabel via en .env-fil eller direkt i appens konfiguration, beroende på vad du föredrar.
Installera SDK:t
SDK
CLI
Vi använder också biblioteket dotenv för att läsa in vår API-nyckel från en miljövariabel.
Gör API-begäran
SDK
CLI
Skapa en ny fil med namnet example.py eller example.mts, beroende på vilket språk du väljer, och lägg till följande kod:
Kör sedan den:
Du bör se transkriberingen av ljudfilen skrivas ut i konsolen.
För medicinskt och kliniskt ljud anger du model_id till scribe_v2_medical. Begärans format
är detsamma som för scribe_v2 och debiteras enligt samma pris. Se Scribe v2
Medical.