Visão geral
Turbo v2.5 é um modelo de texto para fala criado para velocidade e clareza, convertendo texto escrito em áudio com som natural em 32 idiomas. Se você já precisou de uma narração para um vídeo, de uma locução para uma apresentação ou de uma versão falada do seu conteúdo escrito, esperar minutos para o áudio ser renderizado é um verdadeiro ponto de atrito. Turbo v2.5 resolve isso diretamente com geração de baixa latência que entrega áudio limpo e expressivo em segundos. No Picasso IA, você pode acessar este modelo sem configuração, sem código e sem necessidade de experiência em engenharia de áudio.
Como funciona
- Digite ou cole o texto que você quer que seja falado no campo de prompt
- Selecione uma das 26 vozes disponíveis, variando de calmas e profissionais a calorosas e conversacionais
- Defina seu código de idioma, velocidade da fala (de 0.25x a 4x) e intensidade do estilo para combinar com o tom do seu projeto
- Ajuste a estabilidade e o reforço de similaridade para controlar o quão consistente ou expressiva a voz soa ao longo do clipe
- Clique em gerar e baixe seu arquivo de áudio, pronto para colocar em qualquer vídeo, apresentação ou podcast
Perguntas frequentes
Preciso de habilidades de programação ou conhecimento técnico para usar isto?
Não, basta abrir Turbo v2.5 no Picasso IA, ajustar as configurações que quiser e clicar em gerar.
É gratuito para testar?
Sim, você pode executar o modelo e pré-visualizar a saída antes de confirmar. Os custos de geração são mostrados antecipadamente, então não há surpresas.
Quanto tempo leva para obter resultados?
Turbo v2.5 foi criado para baixa latência. A maioria dos textos curtos e médios gera áudio em poucos segundos após clicar em gerar.
Quais idiomas são suportados?
O modelo suporta 32 idiomas. Você seleciona o idioma de destino usando o campo de código de idioma (por exemplo, "en" para inglês, "es" para espanhol ou "fr" para francês).
Posso controlar como a voz soa?
Sim. A estabilidade controla o quanto a voz permanece consistente ao longo de um clipe. O reforço de similaridade influencia o quão de perto a saída acompanha o perfil natural da voz. Aumentar a configuração de estilo adiciona mais variação expressiva à entrega.
Em que formato a saída de áudio é entregue?
O áudio gerado é entregue como um arquivo de áudio padrão que você pode baixar e usar em qualquer editor de vídeo, ferramenta de apresentação ou plataforma de podcast.
O que acontece se eu não ficar satisfeito com o resultado?
Ajuste as configurações de estabilidade ou estilo e gere novamente. Pequenas mudanças nesses parâmetros geralmente produzem resultados visivelmente diferentes sem tocar no texto de entrada.