Transcripciones
General
Las transcripciones solicitadas a Producciones son revisadas y corregidas por hablantes nativos para lograr la máxima precisión. Ofrecemos 2 tipos de transcripciones humanas:
- Para consultar una explicación más detallada de las opciones de transcripción no literal y literal, consulta la sección Guías de estilo de abajo.
- Para obtener más información sobre otros servicios de Producciones, consulta la página de Información general.
Cómo funciona
Solicita una transcripción
Transcribir archivos nuevos
Página de Producciones
La forma más sencilla de solicitar una transcripción nueva a Producciones es desde la página de Producciones de tu cuenta de ElevenLabs.

Cuadro de diálogo de pedido de Voz a Texto
También puedes seleccionar la opción Transcripción humana en el cuadro de diálogo de pedido de Voz a Texto.

Partir de una transcripción existente
Abre una transcripción existente y haz clic en el botón Obtener revisión humana para crear un nuevo pedido de Producciones para esa transcripción.

Exporta la transcripción
Recibirás una notificación por correo electrónico cuando tu transcripción esté lista y la verás marcada como «Hecho» en tu página de Producciones.
Exportación rápida
Abre una transcripción en tu página de Producciones y haz clic en los tres puntos; después, en el botón Exportar.

Exportar desde el visor
Abre una transcripción en tu página de Producciones y haz clic en el icono Ver para abrir el visor de transcripciones.

Precios
El precio de nuestras transcripciones depende de varios factores, como los idiomas, el tipo de transcripción (literal o no literal) y la complejidad del contenido. Habla con ventas para comentarnos tus necesidades concretas y recibir un presupuesto personalizado.
SLA / Plazo de entrega
Nuestro objetivo es entregar todas las transcripciones en un plazo de 48 horas. Si eres una empresa y te interesan plazos de entrega más rápidos, ponte en contacto con nosotros en productions@elevenlabs.io.
Guías de estilo
Al solicitar una transcripción de Producciones, verás la opción de activar el modo «Literal». Consulta el desglose de abajo para obtener más información sobre esta opción.

No literal
La transcripción no literal, también llamada limpia o literal inteligente, se centra en la claridad y la legibilidad. A diferencia de las transcripciones literales, elimina elementos innecesarios como muletillas, tartamudeos y sonidos irrelevantes, pero conserva el mensaje de quien habla.
Qué se omite en las transcripciones no literales:
- Muletillas y tics verbales como «eh», «en plan», «sabes» o «quiero decir»
- Repeticiones, tanto intencionadas como no intencionadas (por ejemplo, tartamudeos)
- Etiquetas de eventos de audio, incluidos sonidos no verbales como [coughing] o [throat clearing], así como sonidos del entorno como [dog barking]
- Jerga o gramática incorrecta (por ejemplo, «na» → «nada»)
Literal
En la transcripción literal, el objetivo es captar todo lo que se puede oír, es decir:
- Todos los elementos verbales detallados: tartamudeos, repeticiones, etc.
- Todos los elementos no verbales, como sonidos humanos ([cough]) y sonidos del entorno ([dog barking])
No literal frente a literal
La siguiente tabla ofrece un desglose completo de nuestros servicios de transcripción no literal y literal.