Visão geral
TTS 1.5 Mini converte texto escrito em fala com som natural em cerca de 120 milissegundos, tornando-se uma das opções de síntese mais rápidas disponíveis. Seja para um rascunho de narração, a locução de uma demonstração de produto ou uma notificação por voz para um aplicativo, você cola o texto, escolhe uma voz e recebe um arquivo de áudio limpo em segundos. Disponível no Picasso IA, ele cobre 15 idiomas, de modo que projetos multilíngues não exigem mais sessões de gravação separadas nem ferramentas diferentes para cada localidade. O resultado é um fluxo de trabalho no qual você pode iterar em várias tomadas no tempo que antes levava para preparar uma única gravação.
Como funciona
- Cole até 2.000 caracteres de texto no campo de entrada. Você pode incluir tags de pausa para intervalos temporizados, marcadores emocionais como [happy] ou [sad], e sons não verbais como [laugh] ou [sigh] para moldar a entrega.
- Selecione uma voz na lista predefinida (Ashley, Dennis, Alex e outras) ou insira um ID de voz personalizado se você tiver uma voz clonada salva.
- Escolha o formato de áudio: MP3, WAV, OGG Opus ou FLAC. Selecione uma taxa de amostragem de 8.000 Hz até 48.000 Hz para corresponder à especificação técnica do seu projeto.
- Ajuste a velocidade da fala se precisar de uma entrega mais rápida ou mais lenta, e defina a temperatura para controlar o quão expressiva ou neutra a voz soa.
- Ative, desative ou deixe no automático a normalização de texto para que números, datas e abreviações sejam lidos de forma natural.
- Clique em gerar. TTS 1.5 Mini processa a entrada e retorna seu arquivo de áudio em cerca de 120 milissegundos.
Perguntas frequentes
Preciso de habilidades de programação ou conhecimento técnico para usar isto?
Não, basta abrir TTS 1.5 Mini no Picasso IA, ajustar as configurações desejadas e clicar em gerar.
É gratuito para testar?
Sim, você pode executar TTS 1.5 Mini sem nenhuma configuração de conta ou pagamento para começar. Envie seu texto, escolha uma voz e baixe o arquivo.
Quanto tempo leva para obter os resultados?
O modelo tem como meta cerca de 120 milissegundos de latência entre a solicitação e a saída de áudio. Para a maioria das entradas, o arquivo fica pronto quase assim que você clica em gerar.
Quais formatos de saída são compatíveis?
TTS 1.5 Mini exporta áudio em MP3, WAV, OGG Opus e FLAC. Você também pode selecionar entre sete opções de taxa de amostragem, de 8.000 Hz a 48.000 Hz, para atender aos requisitos técnicos da sua plataforma.
Posso personalizar a voz ou o estilo de fala?
Sim. Escolha entre nomes de vozes predefinidas ou forneça um ID de voz clonada personalizado. O parâmetro de temperatura controla a expressividade: valores mais baixos fornecem um tom consistente e neutro; valores mais altos adicionam mais variação. O controle deslizante de velocidade da fala permite desacelerar ou acelerar a narração.
Quais idiomas TTS 1.5 Mini suporta?
Ele oferece suporte a 15 idiomas, para que você possa produzir conteúdo de áudio multilíngue a partir de uma única ferramenta sem alternar entre serviços.
Onde posso usar os arquivos de áudio que baixo?
Os arquivos de saída são limpos e sem marcas d'água adicionadas, então você pode colocá-los diretamente em edições de vídeo, podcasts, aplicativos móveis, módulos de e-learning ou qualquer projeto que precise de áudio falado.