Overview
Voice Cloning pega uma gravação de áudio real e gera uma réplica digital daquela voz, pronta para falar qualquer texto que você der. Se você faz trabalho de áudio regular, ter que re-gravar a mesma voz para cada novo pedaço de conteúdo leva tempo que você não tem. Na Picasso IA, você envia uma amostra da voz alvo, o modelo treina nela, e você recebe um perfil de voz que pode emparelhar com execuções de texto para fala daqui para frente. A gravação pode ser tão curta quanto 10 segundos, e o trabalho inteiro funciona no seu navegador sem instalação ou configuração necessária.
How It Works
- Envie uma gravação MP3, M4A ou WAV da voz que você deseja clonar. Precisa estar entre 10 segundos e 5 minutos, e ter menos de 20 MB.
- Ative a redução de ruído antes de enviar se o arquivo tiver som ambiente, zumbido ou bate-papo de fundo do ambiente de gravação.
- Selecione qual modelo de síntese de fala você deseja treinar a voz clonada. As opções variam de um nível turbo rápido até um nível de saída em alta definição.
- Ajuste a configuração de precisão de validação de texto se você quiser que o modelo aplique correspondência mais rigorosa ou mais flexível ao processar as características da voz.
- Envie o trabalho. Quando terminar, você recebe um ID de voz clonada que pode passar a execuções de texto para fala a qualquer momento que você precise de áudio naquela voz.
Frequently Asked Questions
Preciso de habilidades de programação ou conhecimento técnico para usar isto?
Não, apenas abra Voice Cloning na Picasso IA, ajuste as configurações que você deseja e clique em gerar.
Voice Cloning é gratuita para testar?
Sim, você pode executar o modelo sem um plano pago para ver a qualidade de saída. Verifique a página de preços para o número de execuções gratuitas disponíveis no seu nível de conta.
Quanto tempo leva para clonar uma voz?
A maioria dos trabalhos termina em menos de um minuto. Arquivos mais longos e opções de modelo em alta definição podem levar um pouco mais de tempo, mas os resultados aparecem no seu navegador assim que o processamento terminar.
Em quais formatos de áudio o arquivo de voz precisa estar?
O modelo aceita arquivos MP3, M4A e WAV. Mantenha o arquivo com menos de 20 MB e entre 10 segundos e 5 minutos de comprimento para melhores resultados.
Posso reutilizar a mesma voz clonada em múltiplas execuções de texto para fala?
Sim. Uma vez que a etapa de clonagem é concluída, o ID da voz permanece ativo. Você pode passá-lo para quantas execuções de geração de fala você precisar sem fazer upload ou clonar novamente.
E se a voz clonada não soar precisa?
Uma gravação limpa com um único locutor e ruído de fundo mínimo oferece os melhores resultados. Se seu arquivo atual tiver som ambiente, tente ativar a redução de ruído antes de enviar ou re-grave em um espaço mais silencioso.