कृत्रिम मीडिया

Dec 26 2022
2022 इतिहास में उस वर्ष के रूप में दर्ज होगा जब आर्टिफिशियल इंटेलिजेंस को उसकी रचनात्मक क्षमताओं के लिए मान्यता दी गई थी।
30 नवंबर को OpenAI ने एक AI सहायक, ChatGPT को मुफ्त में वेब पर डाला, जिसे केवल 5 दिनों में एक मिलियन से अधिक उपयोगकर्ता मिल गए, जो इसकी असाधारण संवादात्मक क्षमताओं के संपर्क में आने की जिज्ञासा से भर गए। इसमें हमें जो कई खामियां मिलीं - तथ्यात्मक त्रुटियां, डेटा निर्माण, अति आत्मविश्वास, या "आवाज" की कमी - के बीच, हम सभी को यह स्वीकार करना पड़ा कि हमने कभी ऐसा कुछ नहीं देखा।

30 नवंबर को OpenAI ने एक AI सहायक, ChatGPT को मुफ्त में वेब पर डाला, जिसे केवल 5 दिनों में एक मिलियन से अधिक उपयोगकर्ता मिल गए, जो इसकी असाधारण संवादात्मक क्षमताओं के संपर्क में आने की जिज्ञासा से भर गए। इसमें हमें जो कई खामियां मिलीं - तथ्यात्मक त्रुटियां, डेटा निर्माण, अति आत्मविश्वास, या "आवाज" की कमी - के बीच, हम सभी को यह स्वीकार करना पड़ा कि हमने कभी ऐसा कुछ नहीं देखा । सहायक के साथ एक संवाद में प्रवेश करना, विषयों की व्यापक श्रेणी के बारे में बात करना और सहायक की स्वाभाविकता, वाक्पटुता और विवेकपूर्ण समझ के आधार पर आत्म-भ्रम से निर्मित गहरी समानुभूति साझा करने के क्षण उत्पन्न करना संभव है।

लेकिन यह सिर्फ बातचीत नहीं थी जिसे तूफ़ान ने ले लिया। महीनों पहले, 12 जुलाई को, एक अन्य सहायक, मिडजर्नी को रिहा कर दिया गया था; फिर, 22 अगस्त को, म्यूनिख विश्वविद्यालय के स्थिर प्रसार को भी जारी किया गया, और 28 सितंबर को, OpenAI ने Dall-E 2 को सभी के लिए उपलब्ध कराया। ये तीन एआई सहायक समान छवि ड्राइंग कौशल साझा करते हैं, मूल परिणामों को प्रस्तुत करने की विशिष्टता के साथ और साथ ही बहुत मानवीय जैसे कि वे मनुष्यों द्वारा बनाए गए थे।

बातचीत और ड्राइंग बहुत करीबी और गहरी रचनात्मक गतिविधियाँ हैं। जिस तरह हम कागज पर एक पेंसिल के साथ सुधार करते हैं, उसी तरह हम दूसरों के साथ बातचीत करने के लिए वास्तविक समय में प्रतिक्रियाओं के निर्माण में सुधार करते हैं। इसलिए, यह समझना महत्वपूर्ण है कि मशीनों की इन नई क्षमताओं को किसने जन्म दिया, यह देखते हुए कि एआई लगभग 70 वर्षों से है।

कुछ साल पहले तक, एआई को केवल एल्गोरिदम से बनाया गया था, जैसे कि हम सोच के एक मॉडल को गढ़ रहे थे, जो दुनिया और खुद को पहचानने में सक्षम होने की उम्मीद कर रहे थे। लेकिन एआई के विकास ने डीप ब्लू के साथ बदलना शुरू कर दिया, जिसने 1997 में गैरी गैस्पारोव को हराने के लिए शतरंज की हजारों चालों का पहले से अध्ययन किया। तब से दृष्टिकोण लर्निंग, टीचिंग और सेल्फ-टीचिंग एआई सिस्टम, मशीन लर्निंग (एमएल) पर केंद्रित हो गया है, जिसमें इंटरनेट ने कभी-कभी बड़े डेटाबेस तक पहुंच के साथ योगदान दिया है। एआई की प्रशिक्षण प्रक्रिया परिवर्तनकारी थी, न केवल इसलिए कि इसने सहायकों को समान पैटर्न खोजने की अनुमति दी और इस प्रकार केवल तुलना करके शब्दार्थ की कुंजी की खोज की, बल्कि मुख्य रूप से इस प्रक्रिया में तथाकथित कृत्रिम तंत्रिका नेटवर्क विकसित होते हैं,

सरलता से, जब हम एक पेन को देखते हैं, तो हम इसे परिभाषित करने के लिए 4 से 6 से अधिक पैरामीटर स्थापित नहीं कर सकते — उदाहरण के लिए रंग: नीला; प्रभाव: धातु; चमक: सुनहरा; लंबाई: 7 सेमी; चौड़ाई: 0.5 सेमी। दूसरी ओर, एमएल एल्गोरिदम के एक सेट से लैस एक सहायक, इन विशाल डेटाबेसों के भीतर स्थापित तुलनाओं के माध्यम से, न केवल कुछ दर्जन बल्कि सैकड़ों पैरामीटर भी ढूंढ सकता है और परिभाषित कर सकता है जो एक ही पेन को परिभाषित करते हैं (चित्र 1 देखें)। पैरामीटर्स जिन्हें हम इंसान सचेत रूप से देखने, सुनने, महसूस करने या यहां तक ​​कि समझने में सक्षम नहीं हो सकते हैं। लेकिन यह ये पैरामीटर हैं जो मानव मस्तिष्क के लिए शायद दुर्गम, बेहद सूक्ष्म वास्तविकता तक पहुंच की अनुमति देते हैं, और सहायक को एक के बाद एक लिखने के लिए सबसे अच्छे शब्दों के साथ-साथ सबसे अच्छे रंग, स्ट्रोक, छाया, मात्रा की भविष्यवाणी करने में सक्षम बनाते हैं। , एक छवि बनाते समय ग्रहण करने के लिए पैमाना।

चित्रा 1: एक गहरे तंत्रिका नेटवर्क में पैरामीटर की कई परतें, और उनके इंटरकनेक्शन। GPT-3, जो इस समय सबसे उन्नत प्रणाली है, में कृत्रिम न्यूरॉन्स की 96 परतें हैं, कुल मिलाकर 175 बिलियन इंटरकनेक्शन [1]।

मनुष्यों द्वारा बनाए गए बड़े डेटाबेस से सीखने की यह प्रक्रिया अंतर्निहित पूर्वाग्रहों से लेकर इसकी सामग्री के कॉपीराइट तक प्रमुख समस्याएँ प्रस्तुत करती है। यदि पाठ के रूप में, पूर्वाग्रह जल्दी से स्पष्ट हो सकता है, सहायकों के साथ कई नैतिक पूर्वाग्रह जो इंटरनेट पर व्याप्त हैं, यह उन छवियों में है जहां सबसे अधिक समस्याएं उत्पन्न हुई हैं। सहायक छवि डेटाबेस का उपयोग कर रहे हैं, जैसे LAION , जिसे वैज्ञानिक अनुसंधान उद्देश्यों के लिए बनाया गया है। चूंकि लक्ष्य संभव सबसे उन्नत सहायकों का निर्माण करना था और इस प्रकार मानव नवाचार में योगदान देना था, इसलिए इन डेटाबेसों को नेट पर मिलने वाली लगभग हर चीज को सूचीबद्ध करने की अनुमति थी।

चित्र 2: स्थिर प्रसार "के अनुसार सपने देखना", बाएं से दाएं, गुस्ताव डोरे, सेबास्टियो सालगाडो और लोइश।

इस प्रकार, फोटोग्राफरों द्वारा विस्तृत तस्वीरों के साथ-साथ कलाकारों द्वारा अत्यधिक विस्तृत चित्रों या चित्रों के लिए, सबसे सामान्य नागरिक द्वारा ली गई तस्वीरों और फ़्लिकर पर पोस्ट की गई तस्वीरों से, सभी से संबंधित सैकड़ों लाखों चित्रों को सूचीबद्ध किया गया है - जो में पाया जा सकता है समाचार पत्रों, पत्रिकाओं, संग्रहालयों, जैसे ऑनलाइन पोर्टफोलियो में DeviantArt, ArtStation, Behance, आदि। इसलिए यदि हम इन सहायकों में से किसी से गुस्ताव डोरे, सेबस्टियाओ सालगाडो या लोइश की शैली के बाद हमें एक छवि देने के लिए कहते हैं, तो उसे हमारी इच्छा पूरी करने में कोई समस्या नहीं है। , जैसा कि चित्र 2 में देखा जा सकता है।

यदि एआई की यह रचनात्मक क्षमता उल्लेखनीय है, तो अंतर्निहित दो अपरिहार्य प्रश्न उठते हैं: 1) इन लेखकों की छवियों का उपयोग करने की अनुमति किसने दी?; 2) उन्हें इन छवियों की प्रतिलिपि बनाने और संस्करण बनाने की अनुमति किसने दी? 2022 के अंत में हमारे पास जो उत्तर हैं, वे अच्छे नहीं हैं। स्थिर प्रसार के मामले में, प्रोफेसर ब्योर्न ओमर के कहने के बावजूद "हम इंटरनेट के माध्यम से नहीं गए और छवियों को स्वयं नहीं ढूंढ पाए", वे वास्तव में लायन का उपयोग कर रहे हैं। मिडजर्नी में, डेविड होल्ज़ मानते हैं कि उन्होंने बिना किसी सहमति के इंटरनेट से ली गई छवियों का उपयोग किया है, और उन्हें पता नहीं है कि जिन छवियों का उन्होंने उपयोग किया है, वे कौन हैं।

चित्रा 3: मिडजर्नी द्वारा बनाई गई छवियां।

इन समस्याओं के बावजूद, जो अगले वर्षों में बहुत अधिक चर्चा प्रदान करेगी और शायद नए कानून, हम कह सकते हैं कि रचनात्मक क्षेत्र में हम वापसी के बिंदु पर पहुंच गए हैं। ध्यान दें कि रचनात्मकता को "परिचित विचारों के अपरिचित संयोजन बनाने" [2] में मनुष्य की क्षमता द्वारा परिभाषित किया गया है, जो कि ये एआई सिस्टम हमें प्रदान करते हैं, जैसा कि हम चित्र 3 में देख सकते हैं। केवल पाठ और छवियों के क्षेत्र में होता है, इस "सरल" कम्प्यूटेशनल प्रक्रिया से मीडिया निर्माण की पूरी दुनिया पूरी तरह से नई कृत्रिम दुनिया में परिवर्तित हो रही है। आज कोई भी सरल संकेतों के माध्यम से एआई सहायकों को कहानियां, समाचार, चित्र, शीर्षक, पेंटिंग, फोटोग्राफ, ग्राफिक्स, संगीत, आवाज या एनिमेशन बनाने के लिए कह सकता है। यह नया आर्टिफिशियल मीडिया (चित्र 4 देखें) त्योहारों और प्रतियोगिताओं को भी जीत सकता है [3]। अभी इस वक्त,

चित्रा 4 - कृत्रिम मीडिया को एआई सहायकों द्वारा परिभाषित किया गया है जो संचार और कला निर्माण को सक्षम बनाता है। एआई सहायकों की विस्तृत सूची के लिए Futurepedia https://www.futurepedia.io पर जाएं।

इस नई कृत्रिम दुनिया में, मनुष्य कम और कर्ता कम होंगे। कंप्यूटर एक घंटे में दर्जनों या सैकड़ों बार बना, बना, मिश्रण और दोहरा सकता है जब तक कि यह हमें वह नहीं देता जो हम खोज रहे हैं। इस प्रकार मानव को अब कला की व्यावहारिकताओं के साथ-साथ प्रत्येक माध्यम की भौतिक जटिलताओं के बारे में चिंता करने की आवश्यकता नहीं होगी। कोई भी कुछ भी बनाने में सक्षम होगा, जो सच होने के कारण किसी को भी ऐसा बनाने में सक्षम नहीं होगा जो हम में से कई लोग अनुभव करना चाहते हैं। लेकिन वेब 2.0 (जैसे 4, 5) के बारे में हम पहले ही यही बातचीत कर चुके हैं। आर्टिफिशियल मीडिया द्वारा बनाई गई इस नई दुनिया में, मानव एक कला और संचार निदेशक होगा, जिसके लिए उसे मीडिया कलाओं के बारे में कम नहीं, बल्कि अधिक, अधिक साक्षरता की आवश्यकता होगी।

टिप्पणियाँ:

[1] ब्राउन, टीबी, मान, बी।, राइडर, एन।, सुब्बैया, एम।, एट अल। (2020)। भाषा मॉडल कम-शॉट सीखने वाले होते हैं। आर्क्सिव: 2005.14165 ।https://arxiv.org/pdf/2005.14165.pdf.

[2] बोडेन, एम। (2007)। संक्षेप में रचनात्मकता। सोचो, 5 (15), 83-96। डीओआई:10.1017/S147717560000230X.

[3] ग्लेन मार्शल ने " द क्रो " (2022) के साथ कान्स शॉर्ट फिल्म फेस्टिवल में बेस्ट शॉर्ट शॉर्ट जीता , जबकि जेसन एलेन ने " थिएटर डी'ओपेरा स्पैटियल " के साथ एक डिजिटल फोटोग्राफी प्रतियोगिता जीती।

[4] कीन, ए. (2007)। द कल्ट ऑफ द एमेच्योर: हाउ ब्लॉग्स, माइस्पेस, यूट्यूब और आज के बाकी उपयोगकर्ता-जनित मीडिया हमारी संस्कृति और अर्थव्यवस्था को मार रहे हैं । हैचेट यूके।

[5] एंडरसन, सी। (2006)। द लॉन्ग टेल: व्हाई द फ्यूचर ऑफ बिजनेस इज लेस ऑफ मोर ज्यादा बिक रहा है , हाइपरियन एनवाई।

आभासी भ्रम में पुर्तगाली में प्रकाशित ।