विचार नेता
जनरेटिव एआई के युग में ओपन सोर्स को पुनः विचार करना

ओपन-सोर्स मॉडल – एक सॉफ्टवेयर विकास नीति जिसमें स्रोत कोड को सार्वजनिक रूप से पुनर्वितरण या संशोधन के लिए स्वतंत्र रूप से उपलब्ध कराया जाता है – लंबे समय से नवाचार का एक उत्प्रेरक रहा है। यह आदर्श 1983 में पैदा हुआ था जब रिचर्ड स्टॉलमैन, एक सॉफ्टवेयर डेवलपर, अपने बंद-स्रोत प्रिंटर की ब्लैक बॉक्स प्रकृति से निराश हो गए थे।
उनकी दृष्टि ने मुक्त सॉफ्टवेयर आंदोलन को जन्म दिया, जिसने आज के इंटरनेट और सॉफ्टवेयर नवाचार के अधिकांश हिस्से को शक्ति प्रदान करने वाले ओपन-सोर्स पारिस्थितिकी तंत्र के लिए मार्ग प्रशस्त किया।
लेकिन यह 40 से अधिक वर्ष पूर्व की बात है।
आज, जनरेटिव एआई, जिसमें अद्वितीय तकनीकी और नैतिक चुनौतियाँ हैं, “खुलापन” के अर्थ को फिर से परिभाषित कर रहा है, जिससे हमें ओपन-सोर्स परिदृश्य को पुनः विचार करने और उसे अनुकूल बनाने की आवश्यकता है – इसे त्यागने के लिए नहीं, बल्कि इसे अनुकूल बनाने के लिए।
एआई और ओपन-सोर्स स्वतंत्रता
ओपन-सोर्स सॉफ्टवेयर की चार मूलभूत स्वतंत्रताएं – किसी भी सॉफ्टवेयर कोड को चलाने, अध्ययन करने, संशोधित करने और पुनर्वितरित करने की क्षमता – कई मायनों में जनरेटिव एआई की प्रकृति से टकराती हैं:
- चलाना: एआई मॉडल अक्सर बहुत उच्च बुनियादी ढांचे और गणना लागत की आवश्यकता होती है, जो सीमित पहुंच को संसाधन प्रतिबंधों के कारण सीमित करती है।
- अध्ययन और संशोधन: एआई मॉडल अत्यधिक जटिल हैं, इसलिए समझने और उन्हें संशोधित करने के लिए कोड और डेटा की आवश्यकता होती है जो इसे सूचित करता है।
- पुनर्वितरण: कई एआई मॉडल पुनर्वितरण को प्रतिबंधित करते हैं जो प्रशिक्षित वजन और स्वामित्व वाले डेटासेट के साथ विशेष रूप से डिज़ाइन किए गए हैं।
इन मूल सिद्धांतों का क्षरण दुर्भावनापूर्ण इरादे के कारण नहीं है, बल्कि आधुनिक एआई प्रणालियों की भारी जटिलता और लागत के कारण है। वास्तव में, राज्य-कला एआई मॉडल को प्रशिक्षित करने की वित्तीय मांगें हाल के वर्षों में नाटकीय रूप से बढ़ गई हैं – ओपनएआई के जीपीटी-4 को 78 मिलियन डॉलर तक की प्रशिक्षण लागत का अनुमान है, कर्मचारी वेतन को छोड़कर, कुल व्यय 100 मिलियन डॉलर से अधिक।
“ओपन सोर्स” एआई की जटिलता
एक वास्तविक रूप से खुला एआई मॉडल अनुमान स्रोत कोड, प्रशिक्षण स्रोत कोड, मॉडल वजन और प्रशिक्षण डेटा की कुल पारदर्शिता की आवश्यकता होगी। हालांकि, कई मॉडल जो “खुले” होने का दावा करते हैं, वे केवल अनुमान कोड या आंशिक वजन जारी करेंगे, जबकि अन्य सीमित लाइसेंसिंग प्रदान करते हैं या व्यावसायिक उपयोग पर प्रतिबंध लगाते हैं।
यह तटस्थ खुलापन खुले स्रोत सिद्धांतों का भ्रम पैदा करता है, जबकि व्यवहार में कमी है।
ओपन सोर्स इनिशिएटिव (ओएसआई) द्वारा किए गए एक विश्लेषण पर विचार करें कि कई लोकप्रिय बड़े भाषा मॉडल – जिनमें लामा2 और लामा 3.x (मेटा द्वारा विकसित), ग्रोक (एक्स), फाई-2 (माइक्रोसॉफ्ट), और मिक्सट्रल (मिस्ट्रल एआई) शामिल हैं – संरचनात्मक रूप से खुले स्रोत सिद्धांतों के साथ असंगत हैं।
स्थिरता और प्रोत्साहन चुनौतियाँ
अधिकांश ओपन-सोर्स सॉफ्टवेयर स्वयंसेवक-संचालित या अनुदान-संचालित प्रयासों पर बनाया गया था, न कि कम्प्यूटेशनल-गहन, उच्च-लागत बुनियादी ढांचे पर। एआई मॉडल, दूसरी ओर, प्रशिक्षित और बनाए रखने के लिए महंगे हैं, और लागत केवल बढ़ने की उम्मीद है। एंथ्रोपिक के सीईओ, डारियो अमोडेई, का अनुमान है कि यह अंततः एक उन्नत मॉडल को प्रशिक्षित करने के लिए $100 बिलियन तक की लागत आ सकती है।
बिना एक स्थायी वित्त पोषण मॉडल या प्रोत्साहन संरचना के, डेवलपर्स को सीमित पहुंच के माध्यम से बंद-स्रोत या गैर-व्यावसायिक लाइसेंस को प्रतिबंधित करने के बीच एक विकल्प का सामना करना पड़ता है या वित्तीय पतन का जोखिम उठाना पड़ता है।
“ओपन वेट” और लाइसेंसिंग के बारे में गलतफहमी
एआई मॉडल की पहुंच बढ़ती जा रही है, जिसमें कई प्लेटफ़ॉर्म खुद को “खुले” के रूप में विपणन कर रहे हैं जबकि प्रतिबंध लगा रहे हैं जो मूल रूप से खुले स्रोत सिद्धांतों के विरोधी हैं。 यह “स्लेट-ऑफ-हैंड” कई तरह से प्रकट होता है:
- मॉडल जो “ओपन वेट” के रूप में लेबल किए जाते हैं वे व्यावसायिक उपयोग को पूरी तरह से प्रतिबंधित कर सकते हैं, उन्हें अधिक शैक्षिक जिज्ञासा के रूप में बनाए रखने के लिए तैयार किए जाते हैं जो व्यावसायिक उपकरणों की तुलना में सार्वजनिक रूप से अन्वेषण और विकास के लिए तैयार किए जाते हैं।
- कुछ प्रदाता पूर्व-प्रशिक्षित मॉडल तक पहुंच प्रदान करते हैं लेकिन अपने प्रशिक्षण डेटासेट और विधियों की सुरक्षा करते हैं, जिससे उनके निष्कर्षों को अर्थपूर्ण रूप से पुनरुत्पादित या सत्यापित करना असंभव हो जाता है।
- मॉडल के निर्माण या सुधार को रोकने के लिए कई प्लेटफ़ॉर्म पुनर्वितरण प्रतिबंध लगाते हैं, भले ही वे कोड तक पूरी तरह से “पहुंच” प्राप्त कर सकें।
इन मामलों में, “शोध के लिए खुला” वास्तव में “व्यवसाय के लिए बंद” है। परिणाम एक दुर्भावनापूर्ण रूप से विक्रेता लॉक-इन है, जहां संगठन समय और संसाधनों में निवेश करते हैं जो खुले तौर पर सुलभ प्रतीत होते हैं, केवल यह पता लगाने के लिए कि महत्वपूर्ण सीमाएं हैं जब वे अनुप्रयोगों को स्केल या व्यावसायिक बनाने का प्रयास करते हैं।
कानूनी अंतराल
जेनएआई की तेजी से प्रगति पहले से ही उपयुक्त कानूनी ढांचे के विकास को पार कर रही है, जो बौद्धिक संपदा चुनौतियों के जटिल जाल का निर्माण कर रही है जो पहले से मौजूद चिंताओं को जोड़ती है।
पहला प्रमुख कानूनी युद्धक्षेत्र प्रशिक्षण डेटा के उपयोग पर केंद्रित है। गहरे शिक्षण मॉडल इंटरनेट से बड़े डेटासेट का अध्ययन करते हैं, जैसे सार्वजनिक रूप से उपलब्ध छवियां और वेब पेजों का पाठ। इस बड़े डेटा संग्रह ने कॉपीराइट धारकों के साथ-साथ तकनीकी कंपनियों के बीच कॉपीराइट अधिकारों के बारे में तीव्र बहस को जन्म दिया है।
एआई-जनित व्युत्पन्न कार्यों का स्वामित्व एक और कानूनी अस्पष्टता है। कोई नहीं जानता कि एआई-जनित सामग्री को कैसे वर्गीकृत किया जाए, सिवाय यूएस कॉपीराइट कार्यालय के, जो कहता है कि “यदि एआई पूरी तरह से सामग्री बनाता है, तो इसे कॉपीराइट द्वारा संरक्षित नहीं किया जा सकता है।”
जेनएआई – विशेष रूप से कॉपीराइट उल्लंघन, एआई-जनित कार्यों के स्वामित्व और प्रशिक्षण डेटा में लाइसेंस प्राप्त सामग्री के संबंध में – कानूनी अनिश्चितता और भी अधिक जटिल हो जाती है क्योंकि मूल एआई मॉडल भू-राजनीतिक महत्व के उपकरण के रूप में उभर रहे हैं: एआई क्षमताओं को विकसित करने के लिए दौड़ लगा रहे राष्ट्र डेटा पहुंच को प्रतिबंधित करने के लिए कम इच्छुक हो सकते हैं, जिससे सख्त आईपी सुरक्षा वाले देशों को प्रतिस्पर्धी नुकसान हो सकता है।
एआई युग में ओपन सोर्स क्या होना चाहिए
जेनएआई ट्रेन पहले ही स्टेशन से गुजर चुकी है और धीमी होने के कोई संकेत नहीं दिखा रही है। हम एक भविष्य का निर्माण करना चाहते हैं जहां एआई नवाचार को प्रोत्साहित करने के बजाय दबा देता है। इस मामले में, प्रौद्योगिकी नेताओं को एक ढांचे की आवश्यकता है जो सुरक्षित और पारदर्शी व्यावसायिक उपयोग को सुनिश्चित करता है, जिम्मेदार नवाचार को बढ़ावा देता है, डेटा स्वामित्व और लाइसेंसिंग को संबोधित करता है, और “खुले” और “मुफ्त” के बीच अंतर करता है।
एक उभरती हुई अवधारणा, ओपन कमर्शियल सोर्स लाइसेंस, आगे बढ़ने का एक मार्ग प्रस्तावित कर सकता है जो गैर-व्यावसायिक उपयोग के लिए मुफ्त पहुंच, व्यावसायिक उपयोग के लिए लाइसेंस प्राप्त पहुंच और डेटा की उत्पत्ति और स्वामित्व के प्रति सम्मान का प्रस्ताव करता है।
इस नई वास्तविकता के अनुकूल होने के लिए, ओपन-सोर्स समुदाय को एआई-विशिष्ट ओपन लाइसेंसिंग मॉडल विकसित करने की आवश्यकता है, इन मॉडलों को वित्त पोषित करने के लिए सार्वजनिक-निजी साझेदारी बनाने की आवश्यकता है, और पारदर्शिता, सुरक्षा और नैतिकता के लिए विश्वसनीय मानक स्थापित करने की आवश्यकता है।
ओपन सोर्स ने एक बार दुनिया को बदल दिया। जनरेटिव एआई इसे फिर से बदल रहा है। खुलापन की भावना को संरक्षित करने के लिए, हमें इसके कानून को विकसित करने की आवश्यकता है, एआई की विशिष्ट मांगों को स्वीकार करते हुए और चुनौतियों का सामना करते हुए एक समावेशी और स्थायी पारिस्थितिकी तंत्र बनाने के लिए।












