Há uma forma de pré-visualizar o áudio sem consumir a cota antes de baixá-lo?

Infelizmente, no momento não oferecemos a dedução no download como alternativa à dedução na geração. Atualmente, não há como pré-visualizar gerações sem consumir a cota.

Quando você pressiona “Gerar” no site, créditos são consumidos porque os servidores precisam ser ativados e o áudio precisa ser gerado. Não há como testar ou pré-visualizar uma voz com seu próprio texto sem usar créditos.

Permitimos duas regenerações gratuitas no Text to Speech pelo site nas seguintes circunstâncias:

  • O prompt (para Text to Speech) ou arquivo (para Modificador de Voz IA), a voz e o modelo permanecem os mesmos. Você pode alterar os controles deslizantes das configurações de voz.
  • A primeira geração foi feita há menos de duas horas.
  • Você não atualizou a página desde que gerou o áudio original.

Nesse caso, você verá “Regenerar fala”, e o número de regenerações gratuitas restantes será exibido ao passar o cursor sobre o botão “Regenerar fala”:

Depois que suas regenerações gratuitas forem usadas, o botão voltará a exibir “Gerar fala”, e será mostrado o número de créditos que serão usados para a geração:

As regenerações gratuitas estão disponíveis apenas no Text to Speech pelo site. Elas não estão disponíveis pela API.

Estamos avaliando se há uma forma de disponibilizar pré-visualizações com essa qualidade sem aumentar os preços ou custos. Também estamos explorando maneiras de tornar a IA mais controlável, para que você não precise pré-visualizar e obtenha o resultado desejado, de preferência já na primeira tentativa.