Overview
Voice Cloning एक वास्तविक ऑडियो रिकॉर्डिंग लेता है और उस वॉइस की एक डिजिटल प्रतिलिपि तैयार करता है, किसी भी पाठ को बोलने के लिए तैयार है जो आप इसे देते हैं। यदि आप नियमित ऑडियो कार्य करते हैं, तो सामग्री के हर नए हिस्से के लिए एक ही वॉइस को फिर से रिकॉर्ड करना समय लेता है जो आपके पास नहीं है। Picasso IA पर, आप लक्ष्य वॉइस का एक नमूना अपलोड करते हैं, मॉडल इसे प्रशिक्षित करता है, और आप एक वॉइस प्रोफाइल प्राप्त करते हैं जो आप आगे के टेक्स्ट-टू-स्पीच रन के साथ जोड़ सकते हैं। रिकॉर्डिंग 10 सेकंड जितनी कम हो सकती है, और संपूर्ण कार्य आपके ब्राउज़र में कोई स्थापना या सेटअप की आवश्यकता के बिना चलता है।
How It Works
- क्लोन करने के लिए जिस वॉइस को आप चाहते हैं, उसकी एक MP3, M4A, या WAV रिकॉर्डिंग अपलोड करें। इसे 10 सेकंड और 5 मिनट के बीच होना चाहिए, और 20 MB से कम होना चाहिए।
- यदि फाइल में परिवेश संबंधी शोर, गुनगुनाहट, या रिकॉर्डिंग वातावरण से पृष्ठभूमि चैटर है तो सबमिट करने से पहले शोर में कमी सक्षम करें।
- चुनें कि आप क्लोन की गई वॉइस को किस भाषण संश्लेषण मॉडल पर प्रशिक्षित करना चाहते हैं। विकल्प तेज़ टर्बो स्तर से उच्च-परिभाषा आउटपुट स्तर तक होते हैं।
- यदि आप चाहते हैं कि मॉडल वॉइस विशेषताओं को संसाधित करते समय सख्त या ढीले मिलान को लागू करे तो पाठ सत्यापन सटीकता सेटिंग को समायोजित करें।
- कार्य सबमिट करें। जब यह समाप्त हो जाता है, तो आप एक क्लोन की गई वॉइस ID प्राप्त करते हैं जो आप किसी भी समय टेक्स्ट-टू-स्पीच रन में पास कर सकते हैं जब आपको उस वॉइस में ऑडियो की आवश्यकता हो।
Frequently Asked Questions
क्या मुझे इसका उपयोग करने के लिए प्रोग्रामिंग कौशल या तकनीकी ज्ञान की आवश्यकता है?
नहीं, बस Picasso IA पर Voice Cloning खोलें, जिन सेटिंग को आप चाहते हैं उन्हें समायोजित करें, और जेनरेट हिट करें।
क्या Voice Cloning मुफ्त में आजमाने के लिए है?
हां, आप आउटपुट गुणवत्ता देखने के लिए बिना भुगतान की योजना के मॉडल चला सकते हैं। अपने खाते स्तर के तहत उपलब्ध मुक्त रन की संख्या के लिए मूल्य निर्धारण पृष्ठ की जांच करें।
वॉइस को क्लोन करने में कितना समय लगता है?
अधिकांश कार्य एक मिनट से कम में समाप्त हो जाते हैं। लंबी फाइलें और उच्च-परिभाषा मॉडल विकल्प में थोड़ा अधिक समय लग सकता है, लेकिन परिणाम आपके ब्राउज़र में संसाधन पूर्ण होते ही दिखाई देते हैं।
वॉइस फाइल को किस ऑडियो प्रारूप में होने की आवश्यकता है?
मॉडल MP3, M4A, और WAV फाइलों को स्वीकार करता है। सर्वोत्तम परिणामों के लिए फाइल को 20 MB से कम और 10 सेकंड और 5 मिनट के बीच रखें।
क्या मैं कई टेक्स्ट-टू-स्पीच रन में एक ही क्लोन की गई वॉइस का पुनः उपयोग कर सकता हूं?
हां। एक बार क्लोनिंग चरण पूर्ण होने के बाद, वॉइस ID सक्रिय रहता है। आप इसे अपलोड या क्लोन किए बिना जितने भी भाषण पीढ़ी रन में पास कर सकते हैं।
यदि क्लोन की गई वॉइस सटीक नहीं लगती है तो क्या होगा?
एक एकल स्पीकर और न्यूनतम पृष्ठभूमि शोर के साथ एक स्वच्छ रिकॉर्डिंग सर्वोत्तम परिणाम देती है। यदि आपकी वर्तमान फाइल में परिवेश संबंधी शोर है, तो सबमिट करने से पहले शोर में कमी सक्षम करने का प्रयास करें, या एक शांत स्थान में फिर से रिकॉर्ड करें।