lo-fi स्ट्रीम को ऐसे म्यूज़िक की ज़रूरत होती है जो कभी अटेंशन न खींचे, कोई ऐसा हुक नहीं जो viewer को गेम या लेक्चर से दूर ले जाए, चैप्टर बदलने पर कोई अचानक मूड स्विंग नहीं। इस तरह के बैकग्राउंड साउंड के घंटों जुटाना पहले मतलब था स्टॉक लाइब्रेरी खंगालना, यह उम्मीद में कि कोई ट्रैक ठीक से लूप हो जाए। Picasso IA पर Music 2.6, Lyria 3 और Stable Audio 2.5 माहौल के डिस्क्रिप्शन को एक मिनट से कम में इंस्ट्रूमेंटल ट्रैक में बदल देते हैं, तो पढ़ाई या स्ट्रीमिंग के लिए बीट्स का सेट बनाना अब शॉपिंग नहीं, प्रॉम्प्टिंग का मसला बन जाता है।
एक जॉनर के तौर पर lo-fi कुछ पहचाने जाने वाले एलिमेंट्स पर टिका है: सॉफ्ट पियानो या Rhodes कॉर्ड्स, 90 BPM से काफी कम की रिलैक्स्ड ड्रम पैटर्न, टेप हिस या विनाइल क्रैकल, और एक मिक्स जो आगे आने के बजाय बैकग्राउंड में शांत रहता है। यह एक छोटा और डिस्क्राइब करने में आसान ब्रीफ है, और यह ठीक वही तरह का इनपुट है जो टेक्स्ट-टू-म्यूज़िक मॉडल अच्छे से हैंडल करते हैं, क्योंकि इस जॉनर के पास इतने लेबल्ड उदाहरण हैं कि सिर्फ शब्द भरोसे से नतीजा तय कर सकते हैं।
Picasso IA एक ही इंटरफेस के पीछे 488 मॉडल चलाता है, और इनमें से तीन lo-fi जनरेशन को अलग-अलग एंगल से कवर करते हैं। Music 2.6 पूरा अरेंजमेंट बनाता है और इसमें एक डेडिकेटेड इंस्ट्रूमेंटल मोड है, तो आप लिरिक्स जनरेट करने वाला स्टेप स्किप कर देते हैं जिसे आप बस म्यूट ही करते। Lyria 3 एक छोटे प्रॉम्प्ट को, चाहें तो एक रेफरेंस इमेज के साथ, 30 सेकंड के क्लिप में बदल देता है, इतनी तेज़ी से कि कुछ ही मिनटों में कई मूड ट्राई किए जा सकें। Stable Audio 2.5 एक टेक में 190 सेकंड तक जनरेट करता है और एक गाइडेंस स्केल देता है, जो इस बात के सबसे करीब है कि रिज़ल्ट आपके शब्दों को कितनी सख्ती से फॉलो करे। पूरी कैटलॉग में बाकी सब कुछ देखा जा सकता है, और नए अकाउंट फ्री क्रेडिट के साथ शुरू होते हैं, जो तीनों को कंपेयर करने के लिए काफी हैं।
lo-fi कोई एक साउंड नहीं है। यह शब्द एक खास मूड से ज़्यादा एक प्रोडक्शन टेक्सचर बताता है, और प्रॉम्प्ट में एक खास सब-जॉनर का नाम लेना रिलैक्सिंग या चिल जैसे शब्दों से कहीं ज़्यादा रिज़ल्ट को दिशा देता है।
| स्टाइल | प्रॉम्प्ट के शब्द जो इसे दिशा देते हैं | किसके लिए सबसे बेहतर |
|---|
| स्टडी lo-fi हिप-हॉप | सॉफ्ट पियानो, धीमे boom bap ड्रम, विनाइल क्रैकल, 70 से 85 BPM | पढ़ाई और रीडिंग स्ट्रीम |
| jazzhop | Rhodes कॉर्ड्स, अपराइट बास, ब्रश्ड ड्रम, गर्म सैक्स की झलक | रात की वर्क सेशन |
| ambient chillhop | पैड्स, बहुत कम या बिना पर्कशन, धीमा बदलता टेक्सचर | नींद और लो-एनर्जी बैकग्राउंड |
| बारिश वाले दिन का lo-fi | सॉफ्ट पियानो, बारिश और खिड़की का माहौल, दबे हुए लो एंड | कोज़ी या नॉस्टैल्जिक स्ट्रीम थीम |
| synth chill | एनालॉग सिंथ पैड्स, हल्के आर्पेजियो, हल्का साइडचेन पंप | कोडिंग और गेमिंग स्ट्रीम |
इंस्ट्रूमेंटेशन, BPM और विनाइल क्रैकल या टेप हिस जैसा एक टेक्सचर क्यू बताना पहली ही कोशिश में सिर्फ एक मूड वाले शब्द से कहीं ज़्यादा पास ले जाता है, और यही वह चीज़ भी है जो टेक कंपेयर करते वक्त इस टेबल के एक स्टाइल को दूसरे से अलग करती है।
ये आदतें उससे निकली हैं जो lo-fi जनरेशन को असल में बिगाड़ता है: एक भटका हुआ वोकल ad-lib, बीच ट्रैक में डगमगाता टेम्पो, या एक ट्रैक जो तेज़ शुरू होकर आखिर में साइलेंस में फीका पड़ जाए।
- टेम्पो को BPM में बताएं: 75 BPM जैसा नंबर slow जैसे शब्द से कहीं ज़्यादा भरोसे से पेस तय करता है, जिसे हर मॉडल अलग तरह से समझता है।
- इंस्ट्रूमेंटल साफ शब्दों में मांगें: पूरे गाने बनाने वाले मॉडल्स पर, साफ शब्दों में या एक डेडिकेटेड टॉगल से इंस्ट्रूमेंटल मांगना भटके हुए वोकल ad-lib और हमिंग को मिक्स से बाहर रखता है।
- एग्ज़ैक्ट इंस्ट्रूमेंट का नाम लें: Rhodes पियानो, अपराइट बास और ब्रश्ड ड्रम jazzy जैसे शब्द से कहीं ज़्यादा खास टेक्सचर देते हैं, जिसे मॉडल को खुद समझना पड़ता है।
- स्टेबल, इवन मिक्स मांगें: पूरे ट्रैक में कॉन्स्टेंट वॉल्यूम जैसा वाक्य उस बिल्ड-अप और ड्रॉप वाले आर्क से बचाता है जो पॉप प्रोडक्शन डिफॉल्ट रूप से करता है, जो बैकग्राउंड म्यूज़िक को नहीं चाहिए।
- हर प्रॉम्प्ट के तीन-चार टेक जनरेट करें: lo-fi जनरेशन में इतनी रैंडमनेस होती है कि टेक साथ-साथ कंपेयर करने से लूप कमिट करने से पहले सबसे साफ शुरुआत और आखिर वाला टेक मिल जाता है।
यह एक खाली प्रॉम्प्ट बॉक्स से लेकर स्ट्रीम ओवरले के नीचे या पढ़ाई की प्लेलिस्ट में बजते ट्रैक तक का रास्ता है, और इसके लिए बस माहौल का एक आइडिया चाहिए।
- एक लाइन का ब्रीफ लिखें। जॉनर, टेम्पो और दो-तीन इंस्ट्रूमेंट: jazzhop, 78 BPM, Rhodes कॉर्ड्स, ब्रश्ड ड्रम, विनाइल क्रैकल, यह पहले से ही एक पूरा प्रॉम्प्ट है।
- दो-तीन मॉडल पर जनरेट करें। एक ही प्रॉम्प्ट को Music 2.6 पर इंस्ट्रूमेंटल मोड ऑन करके, Lyria 3 पर तेज़ 30 सेकंड की रीड के लिए, और Stable Audio 2.5 पर एक लंबे टेक के लिए ट्राई करें, फिर वही रखें जो असल में बैकग्राउंड में टिका रहता है।
- विनर के चार टेक बनाएं। सबसे मज़बूत प्रॉम्प्ट को कुछ बार फिर से जनरेट करें और सुनें कि पहले से आखिरी सेकंड तक किसका मिक्स सबसे साफ और इवन है।
- लूप के लिए सीम चेक करें। आखिरी पाँच सेकंड को पहले पाँच के मुकाबले सुनें; जो ट्रैक एक जैसे लो-एनर्जी टेक्सचर पर शुरू और खत्म होता है, वह साइलेंस से शुरू होने वाले ट्रैक से कहीं ज़्यादा अच्छा लूप करेगा।
- एक्सपोर्ट करें और स्ट्रीम या प्लेयर में डालें। फाइल Toolkit से डाउनलोड करें, इसे अपने स्ट्रीमिंग सॉफ्टवेयर या म्यूज़िक ऐप में लोड करें, और इसे लूप पर सेट करें या लंबे सेशन के लिए कई ट्रैक एक के बाद एक जोड़ दें।
इनमें से कोई भी मॉडल इनफिनिट ट्रैक जनरेट नहीं करता। Music 2.6 अरेंजमेंट जितनी लंबाई मांगे उतने में पूरे गाने देता है, Lyria 3 हर जनरेशन को करीब 30 सेकंड पर कैप करता है, और Stable Audio 2.5 एक टेक में करीब 190 सेकंड तक जा सकता है। तीन घंटे की स्ट्रीम या पूरे स्टडी ब्लॉक के लिए, असली तरीका है एक ही स्टाइल में कई टेक जनरेट करके उन्हें एक के बाद एक चलाना, या एक साफ टेक को छोटे क्रॉसफेड के साथ लूप करना ताकि सीम सुनाई न दे।
प्रो टिप: एक ही प्रॉम्प्ट को दूसरी बार जनरेट करें और दोनों टेक को एक लूप पेयर की तरह इस्तेमाल करें, एक चलाएं, फिर दूसरा, फिर वापस पहले पर। दो मिलते-जुलते लेकिन एक जैसे न होने वाले टेक तीन घंटे तक एक ही पंद्रह सेकंड के क्लिप को लूप करने से कहीं बेहतर रिपीटिशन छिपाते हैं।
ज़्यादातर स्ट्रीमिंग और प्लेबैक सॉफ्टवेयर, जिसमें OBS का बिल्ट-इन मीडिया सोर्स और कोई भी स्टैंडर्ड म्यूज़िक प्लेयर शामिल है, ऑडियो फाइल को खुद ही क्रॉसफेड या गैपलेस लूप कर देते हैं, तो आपके हिस्से का एडिटिंग काम अक्सर बस उस ट्रैक को चुनना है जिसकी शुरुआत और आखिर पहले से मिलते-जुलते वॉल्यूम और एनर्जी में हों।
एक ईमानदार टूल पेज बताता है कि वह कहाँ कम पड़ता है, और AI से जनरेट किए गए lo-fi के लिए कुछ असली लिमिट हैं जो पूरा स्ट्रीम शेड्यूल इस पर बनाने से पहले जान लेनी चाहिए। जनरेशन की लंबाई सबसे पहली है: इनमें से कोई मॉडल एक घंटे की परफेक्ट फाइल नहीं देता, तो कुछ मिनटों से लंबा कुछ भी मतलब है खुद कई टेक को जोड़ना, और वह सीम क्रॉसफेड के साथ भी कभी-कभी सुनाई दे जाती है। इंस्ट्रूमेंटल मोड भी पूरी तरह फुलप्रूफ नहीं है, खासकर Music 2.6 जैसे फुल-सॉन्ग मॉडल पर, जो डिफॉल्ट रूप से गाए गए म्यूज़िक पर ट्रेन होते हैं, और अब भी कोई हमिंग, सांस की आवाज़ या भटकी हुई सिलेबल दे सकते हैं जो इंस्ट्रूमेंटल ब्रीफ ने नहीं मांगी थी, तो बिना निगरानी के भरोसा करने से पहले पूरा टेक सुन लेना समझदारी है। Stable Audio 2.5 पर लंबे टेक 190 सेकंड में एक जैसा टेक्सचर बनाए रखने के बजाय एनर्जी में थोड़ा भटक भी सकते हैं, जो बैकग्राउंड म्यूज़िक के लिए एक्टिव सुनने वाले ट्रैक से कहीं ज़्यादा मायने रखता है। और भले ही जनरेट किया गया ट्रैक किसी मौजूदा गाने का सैंपल नहीं बल्कि आपका अपना ऑडियो है, लाइव स्ट्रीमिंग प्लेटफॉर्म पर AI-जनरेटेड म्यूज़िक चलाना कॉपीराइट या कंटेंट-ID से जुड़ी हर दिक्कत से अपने आप बचाव नहीं देता: पॉलिसी हर प्लेटफॉर्म पर अलग है और समय के साथ बदलती है, तो अगर स्ट्रीम को मोनेटाइज़ करने का प्लान है, तो भरोसा करने से पहले प्लेटफॉर्म की मौजूदा रूल्स चेक कर लेना दस मिनट के लायक है।
क्या AI lo-fi बीट्स जनरेट करने का कोई फ्री तरीका है?
Picasso IA नए अकाउंट को फ्री क्रेडिट देता है, और एक इंस्ट्रूमेंटल ट्रैक की कीमत वीडियो या 3D जनरेशन से कम होती है, तो Music 2.6, Lyria 3 और Stable Audio 2.5 पर कई प्रॉम्प्ट ट्राई करके पसंदीदा स्टाइल ढूंढना उस क्रेडिट का बड़ा हिस्सा नहीं लेगा। फ्री क्रेडिट के बाद के पेड प्लान प्राइसिंग पेज पर लिस्टेड हैं, और चूँकि वे बदलते रहते हैं, यही पेज असली नंबर के लिए भरोसे लायक है।
lo-fi बीट्स के लिए कौन सा मॉडल सबसे अच्छा है?
कोई एक सबसे अच्छा नहीं है, और यही वजह है कि एक से ज़्यादा ट्राई करना चाहिए। Music 2.6 सबसे मज़बूत चॉइस है जब पूरा अरेंजमेंट डेडिकेटेड इंस्ट्रूमेंटल टॉगल के साथ चाहिए, Lyria 3 30 सेकंड के क्लिप में कई मूड ऑडिशन करने के लिए सबसे तेज़ है, और Stable Audio 2.5 सबसे लंबा सिंगल टेक देता है और यह भी दिखाता है कि रिज़ल्ट आपके शब्दों को कितनी सख्ती से फॉलो कर रहा है। एक ही प्रॉम्प्ट को दो मॉडल पर चलाकर टेक कंपेयर करने से आमतौर पर कुछ ही मिनटों में साफ विनर मिल जाता है।
क्या मुझे ऐसा ट्रैक मिल सकता है जो हमेशा के लिए परफेक्टली लूप हो?
एक सिंगल जनरेशन से नहीं। इनमें से कोई भी मॉडल गणितीय रूप से परफेक्ट इनफिनिट लूप नहीं देता; जो मिलता है वह एक फिनाइट ट्रैक है जो इस पर लूप करता है कि उसकी शुरुआत और आखिर कितने मिलते-जुलते सुनाई देते हैं। सबसे भरोसेमंद तरीका है एक ही स्टाइल में दो-तीन टेक जनरेट करके स्ट्रीमिंग सॉफ्टवेयर में उनके बीच क्रॉसफेड करना, या वह सिंगल टेक चुनना जिसके शुरुआती और आखिरी सेकंड पहले से ही एनर्जी और वॉल्यूम में मैच करते हों।
क्या AI-जनरेटेड lo-fi स्ट्रीम करने से मेरी स्ट्रीम फ्लैग हो सकती है?
आपके लिए ताज़ा जनरेट किया गया ट्रैक किसी मौजूदा कॉपीराइट वाले गाने का सैंपल नहीं है, जो कंटेंट-ID मैच की सबसे कॉमन वजह से बचाता है। फिर भी, AI-जनरेटेड ऑडियो पर प्लेटफॉर्म की पॉलिसी अलग-अलग होती हैं और अभी भी बदल रही हैं, तो अगर स्ट्रीम मोनेटाइज़ करने का प्लान है, तो यह मानने के बजाय कि सवाल पूरी तरह सुलझ चुका है, अपने प्लेटफॉर्म के मौजूदा रूल्स चेक करना बेहतर है।
क्या मैं जनरेट किए गए इंस्ट्रूमेंटल पर अपनी आवाज़ या नैरेशन जोड़ सकता हूँ?
हाँ, और यह इसी वर्कफ्लो के सबसे कॉमन इस्तेमालों में से एक है। ट्रैक को इंस्ट्रूमेंटल मोड में जनरेट करें ताकि कोई कॉम्पिटिंग वोकल लाइन न हो, इसे एक्सपोर्ट करें, और अपनी आवाज़ ऊपर लेयर करें, चाहे वह स्ट्रीम कमेंट्री हो, लेक्चर रिकॉर्डिंग हो या वॉइसओवर, अपने रिकॉर्डिंग या स्ट्रीमिंग सॉफ्टवेयर में। प्रॉम्प्ट में इंस्ट्रूमेंटल मांगना ही वह चीज़ है जो मिक्स को आपकी आवाज़ के बैठने के लिए खुला रखती है।
जनरेट किया गया एक ट्रैक कितना लंबा हो सकता है?
यह मॉडल पर निर्भर करता है। Lyria 3 हर जनरेशन में करीब 30 सेकंड पर रुक जाता है, जो फिनिश्ड ट्रैक से ज़्यादा तेज़ ऑडिशनिंग के लिए सही है। Stable Audio 2.5 एक सिंगल टेक में करीब 190 सेकंड तक जा सकता है, जो एक इस्तेमाल लायक इंडिपेंडेंट लूप के करीब है। Music 2.6 अरेंजमेंट जितनी लंबाई मांगे उतने में पूरे गाने देता है। एक टेक से लंबे किसी भी चीज़ के लिए, कई जनरेशन एक के बाद एक चलाएं।
क्या इंस्ट्रूमेंटल ट्रैक के लिए मुझे लिरिक्स लिखने पड़ेंगे?
नहीं। Music 2.6 पर इंस्ट्रूमेंटल मोड ऑन करना, या बस Lyria 3 या Stable Audio 2.5 पर माहौल और इंस्ट्रूमेंटेशन डिस्क्राइब करना, बिना किसी लिरिक्स फील्ड भरे ट्रैक दे देता है। लिरिक्स तभी मायने रखते हैं जब आपको वोकल ट्रैक चाहिए, जो बैकग्राउंड lo-fi से अलग यूज़ केस है।
क्या मैं एक ही प्रॉम्प्ट से पूरा सेट कंसिस्टेंट साउंड वाले ट्रैक जनरेट कर सकता हूँ?
हाँ। कई जनरेशन में जॉनर, टेम्पो और इंस्ट्रूमेंट लिस्ट को एक जैसा रखते हुए, बस दिन के समय या सीन के मौसम जैसी एक छोटी डिटेल बदलकर, ऐसे ट्रैक का सेट मिलता है जो एक ही साउंड नेबरहुड में रहते हैं बिना एक जैसा लूप बार-बार लगने के। यही कंसिस्टेंसी घंटों की स्ट्रीम या स्टडी प्लेलिस्ट को रैंडम की बजाय इंटेंशनल महसूस कराती है।
क्या जनरेट किया गया म्यूज़िक असल में रॉयल्टी-फ्री है?
हर ट्रैक एक ओरिजिनल जनरेशन है, न कि किसी मौजूदा रिकॉर्डिंग से निकाला गया सैंपल, और यही वह प्रॉपर्टी है जो किसी और के गाने के साथ कॉपीराइट मैच से बचने के लिए मायने रखती है। AI-जनरेटेड ऑडियो के ओनरशिप और यूज़ राइट्स अभी भी जगह के हिसाब से अलग हैं और एक बदलता हुआ कानूनी क्षेत्र हैं, तो बड़े स्केल के कमर्शियल इस्तेमाल के लिए, मान लेने के बजाय Picasso IA की मौजूदा शर्तें और अपने देश के नियम चेक कर लेना बेहतर है।
lo-fi ट्रैक जनरेट करने में कितना खर्च आता है?
जनरेशन क्रेडिट में पे किए जाते हैं, और एग्ज़ैक्ट कॉस्ट चुने गए मॉडल और सेटिंग्स पर डिपेंड करती है, तो यहाँ लिखा कोई भी सटीक नंबर कुछ महीनों में गलत हो जाएगा। ऑडियो जनरेशन वीडियो या 3D के मुकाबले कैटलॉग के सस्ते सिरे पर आती है। नए अकाउंट फ्री क्रेडिट के साथ शुरू होते हैं, और मौजूदा प्लान प्राइसिंग प्राइसिंग पेज पर है, जो नंबरों के लिए इकलौता भरोसेमंद सोर्स है।
स्ट्रीम या स्टडी सेशन उतना ही शांत होता है जितना उसके नीचे का साउंड। अगला सेशन शुरू होने से पहले Picasso IA toolkit खोलें और पहला टेक जनरेट करें।