Voz a Texto
Una guía para transcribir audio con ElevenLabs
Resumen
Con Voz a Texto, puedes transcribir audio hablado a texto con una precisión puntera. Gracias a la detección automática de idioma, puedes transcribir audio en multitud de idiomas.
Crear una transcripción
Sube audio
En el panel de control de ElevenLabs, ve a la página Voz a Texto y haz clic en el botón «Transcribir archivos». Desde la ventana modal, puedes subir un archivo de audio o vídeo para transcribirlo.

Selecciona las opciones
-
Selecciona el idioma principal del audio si lo conoces. Puedes dejarlo en «Detectar» y los idiomas del audio se detectarán automáticamente.
-
Elige si quieres etiquetar eventos de audio, como risas o aplausos, mediante el interruptor «Etiquetar eventos de audio».
-
Los prompts de términos clave te permiten añadir hasta 1000 palabras o frases para orientar al modelo a transcribirlas. Esto resulta útil para transcribir palabras o frases específicas que no son habituales en el audio, como nombres de productos, nombres propios u otros términos concretos.
Cuando estés listo, haz clic en el botón «Subir archivos» para enviarlos.
Consulta los resultados
Haz clic en el nombre del archivo de audio que has subido en el panel central para ver los resultados. Puedes hacer clic en una palabra para iniciar la reproducción del audio desde ese punto.
Haz clic en el botón «Exportar» de la esquina superior derecha para descargar los resultados en diversos formatos.
Editor de transcripciones
Cuando hayas creado una transcripción, puedes editarla en nuestro Editor de transcripciones. Obtén más información en esta guía.