Aperçu
Voice Cloning prend un vrai enregistrement audio et génère un double numérique de cette voix, prêt à parler n'importe quel texte que vous lui donnez. Si vous faites du travail audio régulier, devoir réenregistrer la même voix pour chaque nouveau contenu prend du temps que vous n'avez pas. Sur Picasso IA, vous téléchargez un échantillon de la voix cible, le modèle s'entraîne dessus, et vous recevez un profil vocal que vous pouvez associer aux exécutions de synthèse vocale à l'avenir. L'enregistrement peut être aussi court que 10 secondes, et tout le travail s'exécute dans votre navigateur sans aucune installation ou configuration requise.
- Téléchargez un enregistrement MP3, M4A ou WAV de la voix que vous souhaitez cloner. Il doit être entre 10 secondes et 5 minutes, et moins de 20 Mo.
- Activez la réduction de bruit avant de soumettre si le fichier a du bruit ambiant, un bourdonnement ou du bavardage de fond provenant de l'environnement d'enregistrement.
- Sélectionnez le modèle de synthèse vocale sur lequel vous souhaitez entraîner la voix clonée. Les options vont d'un niveau turbo rapide à un niveau de sortie haute définition.
- Ajustez le paramètre de précision de la validation de texte si vous souhaitez que le modèle applique une correspondance plus stricte ou plus lâche lors du traitement des caractéristiques vocales.
- Soumettez le travail. Lorsqu'il est terminé, vous recevez un ID de voix clonée que vous pouvez transmettre aux exécutions de synthèse vocale chaque fois que vous avez besoin d'audio dans cette voix.
Questions fréquemment posées
Ai-je besoin de compétences en programmation ou de connaissances techniques pour utiliser ceci?
Non, ouvrez simplement Voice Cloning sur Picasso IA, ajustez les paramètres souhaités et appuyez sur générer.
Voice Cloning est-il gratuit à essayer?
Oui, vous pouvez exécuter le modèle sans plan payant pour voir la qualité de sortie. Consultez la page de tarification pour connaître le nombre d'exécutions gratuites disponibles selon votre niveau de compte.
Combien de temps faut-il pour cloner une voix?
La plupart des travaux se terminent en moins d'une minute. Les fichiers plus longs et les options de modèle haute définition peuvent prendre un peu plus de temps, mais les résultats apparaissent dans votre navigateur dès que le traitement est terminé.
Quels formats audio le fichier vocal doit-il être?
Le modèle accepte les fichiers MP3, M4A et WAV. Gardez le fichier sous 20 Mo et entre 10 secondes et 5 minutes pour de meilleurs résultats.
Puis-je réutiliser la même voix clonée sur plusieurs exécutions de synthèse vocale?
Oui. Une fois l'étape de clonage terminée, l'ID de voix reste actif. Vous pouvez le transmettre à autant d'exécutions de génération vocale que vous avez besoin sans télécharger ni cloner à nouveau.
Que faire si la voix clonée ne semble pas précise?
Un enregistrement propre avec un seul locuteur et un bruit de fond minimal donne les meilleurs résultats. Si votre fichier actuel a du bruit ambiant, essayez d'activer la réduction de bruit avant de soumettre, ou réenregistrez dans un espace plus calme.