अवलोकन
TTS 1.5 Mini लिखे हुए टेक्स्ट को लगभग 120 मिलीसेकंड में प्राकृतिक-सी लगने वाली स्पीच में बदल देता है, जिससे यह उपलब्ध सबसे तेज़ सिंथेसिस विकल्पों में से एक बन जाता है। चाहे आपको वॉयसओवर ड्राफ्ट चाहिए हो, प्रोडक्ट डेमो नैरेशन, या किसी ऐप के लिए बोले जाने वाला नोटिफ़िकेशन, आप टेक्स्ट पेस्ट करते हैं, एक आवाज़ चुनते हैं, और कुछ ही सेकंड में एक साफ़ ऑडियो फ़ाइल प्राप्त करते हैं। Picasso IA पर उपलब्ध, यह 15 भाषाओं को कवर करता है, इसलिए बहुभाषी प्रोजेक्ट्स के लिए अब अलग रिकॉर्डिंग सत्रों या हर लोकेल के लिए अलग टूल्स की ज़रूरत नहीं रहती। परिणाम एक ऐसा वर्कफ़्लो है जिसमें आप उतने ही समय में कई टेकों से होकर गुजर सकते हैं जितना पहले एक अकेली रिकॉर्डिंग तैयार करने में लगता था।
यह कैसे काम करता है
- इनपुट फ़ील्ड में अधिकतम 2,000 अक्षरों का टेक्स्ट पेस्ट करें। आप समयबद्ध विराम के लिए ब्रेक टैग्स, [happy] या [sad] जैसे इमोशन मार्कर्स, और [laugh] या [sigh] जैसी गैर-मौखिक ध्वनियाँ शामिल कर सकते हैं ताकि डिलीवरी को आकार दिया जा सके।
- प्रीसेट सूची (Ashley, Dennis, Alex, और अन्य) में से एक आवाज़ चुनें, या यदि आपके पास सेव की हुई क्लोन की गई आवाज़ है तो एक कस्टम voice ID दर्ज करें।
- अपना ऑडियो फ़ॉर्मैट चुनें: MP3, WAV, OGG Opus, या FLAC। अपने प्रोजेक्ट की तकनीकी स्पेसिफ़िकेशन से मेल खाने के लिए 8,000 Hz से 48,000 Hz तक का सैंपल रेट चुनें।
- यदि आपको तेज़ या धीमी डिलीवरी चाहिए, तो speaking rate समायोजित करें, और तापमान सेट करके नियंत्रित करें कि आवाज़ कितनी अभिव्यक्तिशील या तटस्थ लगे।
- टेक्स्ट नॉर्मलाइज़ेशन को ऑन, ऑफ़, या ऑटो पर रखें ताकि संख्याएँ, तारीख़ें, और संक्षेप शब्द स्वाभाविक रूप से पढ़े जाएँ।
- जनरेट पर क्लिक करें। TTS 1.5 Mini इनपुट को प्रोसेस करता है और लगभग 120 मिलीसेकंड में आपकी ऑडियो फ़ाइल वापस देता है।
अक्सर पूछे जाने वाले प्रश्न
क्या इसे उपयोग करने के लिए मुझे प्रोग्रामिंग कौशल या तकनीकी ज्ञान चाहिए?
नहीं, बस Picasso IA पर TTS 1.5 Mini खोलें, अपनी इच्छित सेटिंग्स समायोजित करें, और generate दबाएँ।
क्या इसे आज़माना मुफ़्त है?
हाँ, आप शुरू करने के लिए किसी खाते की सेटअप या भुगतान के बिना TTS 1.5 Mini चला सकते हैं। अपना टेक्स्ट सबमिट करें, एक आवाज़ चुनें, और फ़ाइल डाउनलोड करें।
परिणाम मिलने में कितना समय लगता है?
मॉडल अनुरोध से ऑडियो आउटपुट तक लगभग 120 मिलीसेकंड की लेटेंसी का लक्ष्य रखता है। अधिकांश इनपुट्स के लिए, फ़ाइल आपके generate क्लिक करते ही लगभग तैयार होती है।
कौन-कौन से आउटपुट फ़ॉर्मैट समर्थित हैं?
TTS 1.5 Mini ऑडियो को MP3, WAV, OGG Opus, और FLAC में एक्सपोर्ट करता है। आप अपने प्लेटफ़ॉर्म की तकनीकी आवश्यकताओं से मेल खाने के लिए 8,000 Hz से 48,000 Hz तक, सात सैंपल रेट विकल्पों में से भी चुन सकते हैं।
क्या मैं आवाज़ या बोलने की शैली को अनुकूलित कर सकता हूँ?
हाँ। प्रीसेट voice names में से चुनें या एक कस्टम क्लोन की गई voice ID दें। temperature पैरामीटर अभिव्यक्तिशीलता को नियंत्रित करता है: कम मान एक सुसंगत, तटस्थ स्वर देते हैं; अधिक मान अधिक विविधता जोड़ते हैं। speaking rate स्लाइडर आपको नैरेशन को धीमा या तेज़ करने देता है।
TTS 1.5 Mini कौन-कौन सी भाषाओं को सपोर्ट करता है?
यह 15 भाषाओं को सपोर्ट करता है, इसलिए आप सेवाओं के बीच स्विच किए बिना एक ही टूल से बहुभाषी ऑडियो सामग्री बना सकते हैं।
मैं जिन ऑडियो फ़ाइलों को डाउनलोड करता हूँ, उनका उपयोग कहाँ कर सकता हूँ?
आउटपुट फ़ाइलें बिना किसी अतिरिक्त वॉटरमार्क के साफ़ होती हैं, इसलिए आप उन्हें सीधे वीडियो संपादन, पॉडकास्ट, मोबाइल ऐप्स, ई-लर्निंग मॉड्यूल्स, या किसी भी प्रोजेक्ट में डाल सकते हैं जिसे बोले गए ऑडियो की आवश्यकता हो।