Aperçu
TTS 1.5 Mini convertit le texte écrit en parole au son naturel en environ 120 millisecondes, ce qui en fait l'une des options de synthèse les plus rapides disponibles. Que vous ayez besoin d'une ébauche de voix off, d'une narration pour une démonstration de produit ou d'une notification vocale pour une application, vous collez le texte, choisissez une voix et récupérez un fichier audio propre en quelques secondes. Disponible sur Picasso IA, il prend en charge 15 langues, de sorte que les projets multilingues ne nécessitent plus de sessions d'enregistrement séparées ni d'outils différents pour chaque région. Le résultat est un flux de travail dans lequel vous pouvez enchaîner plusieurs prises dans le temps qu'il fallait autrefois pour préparer un seul enregistrement.
- Collez jusqu'à 2 000 caractères de texte dans le champ de saisie. Vous pouvez inclure des balises de pause pour des pauses temporisées, des marqueurs d'émotion comme [happy] ou [sad], et des sons non verbaux comme [laugh] ou [sigh] pour façonner l'interprétation.
- Sélectionnez une voix dans la liste prédéfinie (Ashley, Dennis, Alex et autres) ou saisissez un identifiant de voix personnalisé si vous avez une voix clonée enregistrée.
- Choisissez votre format audio : MP3, WAV, OGG Opus ou FLAC. Sélectionnez une fréquence d'échantillonnage de 8 000 Hz à 48 000 Hz pour correspondre aux spécifications techniques de votre projet.
- Ajustez la vitesse de parole si vous avez besoin d'une prestation plus rapide ou plus lente, et réglez la température pour contrôler à quel point la voix sonne expressive ou neutre.
- Activez, désactivez ou laissez en mode auto la normalisation du texte afin que les nombres, dates et abréviations soient lus naturellement.
- Cliquez sur générer. TTS 1.5 Mini traite l'entrée et renvoie votre fichier audio en environ 120 millisecondes.
Foire aux questions
Ai-je besoin de compétences en programmation ou de connaissances techniques pour l'utiliser ?
Non, ouvrez simplement TTS 1.5 Mini sur Picasso IA, ajustez les paramètres souhaités et cliquez sur générer.
Est-ce gratuit à essayer ?
Oui, vous pouvez utiliser TTS 1.5 Mini sans configuration de compte ni paiement requis pour commencer. Soumettez votre texte, choisissez une voix et téléchargez le fichier.
Combien de temps faut-il pour obtenir les résultats ?
Le modèle vise environ 120 millisecondes de latence entre la requête et la sortie audio. Pour la plupart des entrées, le fichier est prêt presque dès que vous cliquez sur générer.
Quels formats de sortie sont pris en charge ?
TTS 1.5 Mini exporte l'audio en MP3, WAV, OGG Opus et FLAC. Vous pouvez également sélectionner sept options de fréquence d'échantillonnage, de 8 000 Hz à 48 000 Hz, pour répondre aux exigences techniques de votre plateforme.
Puis-je personnaliser la voix ou le style d'élocution ?
Oui. Choisissez parmi les noms de voix prédéfinies ou fournissez un identifiant de voix clonée personnalisé. Le paramètre de température contrôle l'expressivité : des valeurs plus faibles donnent un ton constant et neutre ; des valeurs plus élevées ajoutent davantage de variation. Le curseur de vitesse de parole vous permet de ralentir ou d'accélérer la narration.
Quelles langues TTS 1.5 Mini prend-il en charge ?
Il prend en charge 15 langues, vous pouvez donc produire du contenu audio multilingue à partir d'un seul outil sans changer de service.
Où puis-je utiliser les fichiers audio que je télécharge ?
Les fichiers de sortie sont propres, sans filigrane ajouté, vous pouvez donc les intégrer directement dans des montages vidéo, podcasts, applications mobiles, modules d'apprentissage en ligne ou tout projet nécessitant de l'audio parlé.