Aperçu
Kling Avatar v2 prend une image fixe et un fichier audio et les transforme en une vidéo d'avatar parlant avec une synchronisation labiale précise et un mouvement facial naturel. Sur Picasso IA, vous pouvez l'exécuter avec une photo de portrait, un personnage de dessin animé, une image d'animal ou n'importe quel artwork stylisé, et le modèle adapte automatiquement les mouvements de la bouche et les micro-expressions à votre audio. Il n'est pas nécessaire d'avoir un écran vert, un équipement de capture de mouvement ou un logiciel d'édition professionnel. Une invite de texte vous permet de spécifier l'humeur ou l'angle de caméra du personnage avant la génération, ce qui vous donne un contrôle supplémentaire sur le résultat final. Cela s'intègre dans tout flux de contenu où vous avez besoin d'un personnage parlant sans le coût d'une séance vidéo.
Fonctionnement
- Téléchargez votre image de référence (JPG ou PNG, au moins 300px sur le côté le plus court, avec un rapport d'aspect entre 1:2,5 et 2,5:1).
- Téléchargez votre fichier audio au format MP3, WAV, M4A ou AAC, jusqu'à 5MB de taille.
- Écrivez optionnellement une invite de texte décrivant les émotions, les actions ou le cadrage de caméra préféré de l'avatar.
- Sélectionnez le mode Standard pour une sortie plus rapide ou le mode Pro pour une plus haute fidélité visuelle.
- Soumettez le travail et téléchargez votre vidéo d'avatar parlant terminée quand elle est prête.
Questions fréquemment posées
Ai-je besoin de compétences en programmation ou de connaissances techniques pour utiliser ceci ?
Non, ouvrez simplement Kling Avatar v2 sur Picasso IA, ajustez les paramètres que vous souhaitez, et cliquez sur générer.
Est-ce gratuit à essayer ?
Oui, vous pouvez exécuter votre première vidéo d'avatar sans entrer vos coordonnées de paiement. Consultez la page des crédits sur Picasso IA pour connaître les limites gratuites actuelles et ce que chaque plan comprend.
Combien de temps faut-il pour obtenir les résultats ?
Le mode Standard se termine généralement en moins d'une minute pour les clips audio courts. Le mode Pro prend un peu plus de temps mais produit des détails faciaux plus nets et un mouvement plus fluide tout au long de la vidéo.
Quels formats de sortie sont pris en charge ?
Le modèle retourne un fichier vidéo que vous pouvez télécharger directement. La longueur de la sortie correspond à la longueur du fichier audio que vous avez fourni, donc un enregistrement de 15 secondes produit une vidéo de 15 secondes.
Puis-je utiliser n'importe quelle image comme référence d'avatar ?
L'image doit être un JPG ou PNG, au moins 300px de son côté le plus court, et dans un rapport d'aspect 1:2,5 à 2,5:1. Les visages doivent être clairement visibles et bien éclairés pour les meilleurs résultats de synchronisation labiale.
Que se passe-t-il si le résultat ne semble pas correct ?
Essayez d'ajuster l'invite de texte pour être plus spécifique sur l'expression ou la position de la tête, ou utilisez une image de référence plus propre avec un meilleur éclairage et un angle plus frontal. Le passage au mode Pro tend également à réduire les artefacts sur les images complexes.
Où puis-je utiliser les vidéos de sortie ?
Le fichier téléchargé est à vous pour l'utiliser dans des présentations, des messages sociaux, des cours numériques, des présentations à des clients ou n'importe quel autre contexte. Il n'y a pas de restrictions de plateforme sur la sortie.