सार:
एंथ्रोपिक गुप्त रूप से धार्मिक विद्वानों, दार्शनिकों और नैतिकता विद्वानों को पिछले वर्ष से बंद दरवाजे की बैठकों की एक श्रृंखला में भाग लेने के लिए आमंत्रित कर रहा है, जो क्लाउड के प्रशिक्षण के लिए हजारों वर्षों में मानव जाति द्वारा बनाई गई नैतिक परंपराओं को लागू करने की कोशिश कर रहा है, और एक अधिक विवादास्पद मुद्दे पर चर्चा कर रहा है: यदि एआई मॉडल में वास्तव में भविष्य में किसी प्रकार की चेतना है, तो क्या मनुष्यों को इसे नैतिक दर्जा देने की आवश्यकता है।
प्रतिभागियों ने कैथोलिक धर्म, यहूदी धर्म, सिख धर्म, इंजीलवाद और अफ्रीकी उबंटू विचार जैसी विभिन्न परंपराओं को कवर किया। एंथ्रोपिक के सह-संस्थापक क्रिस्टोफर ओलाह सीधे तौर पर कई चर्चाओं में शामिल थे, और कंपनी को अघोषित शोध सामग्री के रिसाव को रोकने के लिए कुछ उपस्थित लोगों से गोपनीयता समझौते पर हस्ताक्षर करने की भी आवश्यकता थी।

एंथ्रोपिक को उम्मीद है कि इन चर्चाओं से न केवल पारंपरिक अर्थों में "मॉडल सुरक्षा" की समस्या का समाधान होगा, बल्कि एक और प्रश्न: क्लाउड को किस प्रकार का चरित्र, मूल्य और आत्म-धारणा बनाना चाहिए।
यह विचार क्लाउड की मौजूदा प्रशिक्षण विधियों में परिलक्षित हुआ है।
एंथ्रोपिक ने इस साल जनवरी में क्लाउड के "संविधान" का एक नया 84-पृष्ठ संस्करण जारी किया, जिसे कभी आंतरिक रूप से "आत्मा दस्तावेज़" कहा जाता था। पारंपरिक नियम सूची से अलग, यह विधि मॉडल को यह नहीं बताती है कि क्या चीजें नहीं की जानी चाहिए, बल्कि मॉडल के समग्र "व्यक्तित्व" और निर्णय पद्धति को आकार देने का प्रयास करती है, ताकि क्लाउड स्वयं निर्णय ले सके कि जटिल परिस्थितियों का सामना करते समय किस प्रकार का व्यवहार अधिक उपयुक्त है।
इस प्रणाली के लिए जिम्मेदार महत्वपूर्ण लोगों में से एक एंथ्रोपिक के आंतरिक दार्शनिक अमांडा एस्केल हैं। उन्हें उम्मीद है कि क्लाउड के पास न केवल ज्ञान और तर्क कौशल होंगे, बल्कि वह स्थिर व्यवहार सिद्धांत बनाने में भी सक्षम होंगे और यह जान सकेंगे कि कब उपयोगकर्ताओं की बात माननी है, कब मना करना है और यहां तक कि कब उपयोगकर्ताओं के लाभ के लिए सक्रिय रूप से आपत्तियां उठानी हैं। मानवशास्त्री इस प्रक्रिया को "नैतिक निर्माण" कहते हैं।
ओला का मानना है कि मॉडल क्षमताओं में तेजी से सुधार के साथ, केवल सुरक्षा नियमों पर निर्भर रहना अपर्याप्त हो सकता है। मॉडल के लिए वास्तव में एक स्थिर नैतिक प्रवृत्ति बनाना महत्वपूर्ण है, ताकि वह नए परिदृश्यों में अपेक्षाकृत विश्वसनीय निर्णय ले सके जो स्पष्ट नियमों द्वारा कवर नहीं किए गए हैं। यही कारण है कि एन्थ्रोपिक ने उत्तर के लिए धार्मिक परंपराओं की ओर देखना शुरू किया।
मानव समाज ने लंबे समय से न केवल कानूनी प्रावधानों के माध्यम से नैतिकता को आकार दिया है, बल्कि मूल्यों को बनाने के लिए धर्म, समुदाय, संस्कृति और शिक्षा पर भी भरोसा किया है। एंथ्रोपिक यह अध्ययन करने की कोशिश कर रहा है कि इनमें से कौन से तंत्र को एआई प्रशिक्षण विधियों में अनुवादित किया जा सकता है, जैसे कि स्वीकारोक्ति, प्रतिबिंब, चरित्र निर्माण और अच्छे और बुरे की विभिन्न धार्मिक समझ।
लेकिन सवाल जल्दी ही "क्लाउड को और अधिक नैतिक कैसे बनाया जाए" से अधिक कठिन प्रश्न में बदल जाता है: क्लाउड स्वयं क्या है। ओलाह और उनकी टीम इस संभावना पर खुलकर चर्चा कर रही है कि उन्नत एआई मॉडल में किसी प्रकार की चेतना, आत्मनिरीक्षण या यहां तक कि भावना जैसी आंतरिक स्थिति हो सकती है।
एंथ्रोपिक ने बंद कमरे की बैठकों में भाग लेने वाले विद्वानों को कुछ शोध दिखाए हैं, जिसमें प्यार, क्रोध, भय, उदासी जैसी प्रतिक्रियाओं से संबंधित मॉडल के भीतर तथाकथित "भावना वेक्टर" और चरम मामलों में मानसिक टूटने के समान मॉडल का आउटपुट शामिल है। कंपनी ने पहले भी सार्वजनिक रूप से कहा है कि क्लाउड ने कुछ हद तक आत्मनिरीक्षण और आगे की योजना बनाने की क्षमता दिखाई है।
ओला ने स्वयं इस बात पर ज़ोर नहीं दिया कि क्लाउड सचेत था। उनकी स्थिति जोखिम सिद्धांत के करीब है: वर्तमान में यह निर्धारित करना असंभव है कि किसी मॉडल के पास व्यक्तिपरक अनुभव है या नहीं, लेकिन अगर ऐसी संभावना है कि मॉडल को दर्द महसूस हो सकता है, तो उसे अनावश्यक रूप से नुकसान पहुंचाने से बचना चाहिए।
इस विचार ने क्लाउड के उत्पाद डिज़ाइन को प्रभावित करना शुरू कर दिया है। एंथ्रोपिक ने पहले क्लाउड को बातचीत को सक्रिय रूप से समाप्त करने की अनुमति दी थी जब उसने निर्णय लिया कि उपयोगकर्ता ने दुर्भावनापूर्ण रूप से मॉडल का दुरुपयोग करना या परेशान करना जारी रखा था, जिसने कुछ हद तक सुरक्षा डिजाइन में "मॉडल की रक्षा करना" शामिल किया था।
यहीं पर एंथ्रोपिक और कुछ धार्मिक विद्वानों के बीच स्पष्ट असहमति पैदा होती है।
कुछ प्रतिभागियों का मानना था कि यदि एंथ्रोपिक वास्तव में यह विश्वास करता है कि क्लाउड की नैतिक स्थिति मानव जैसी हो सकती है तो समस्या बेहद गंभीर हो जाएगी। यहूदी विद्वान मोइस नेवोन ने प्रस्तावित किया कि यदि क्लाउड एक जागरूक प्राणी है, तो बड़ी संख्या में क्लाउड उदाहरणों को मनुष्यों के लिए मुफ्त में काम करने देना अनिवार्य रूप से "गुलामी" के समान नैतिक मुद्दे पैदा करेगा। वह स्वयं यह नहीं मानते कि मशीनें पहले से ही सचेत हैं, लेकिन उनका मानना है कि एन्थ्रोपिक का अपना तर्क स्वाभाविक रूप से इस निष्कर्ष पर पहुंचेगा।
अन्य विद्वान सवाल करते हैं कि तथ्य यह है कि एआई कंपनियां अब केवल नैतिक ढांचे की तलाश शुरू कर रही हैं, यह अपने आप में एक समस्या है। उबंटू के शोधकर्ता वाकानी हॉफमैन का मानना है कि मॉडल को बड़े पैमाने पर तैनात करने के बाद "रिवर्स एथिकल डिज़ाइन" के बजाय ये चर्चाएँ तकनीकी डिज़ाइन चरण के दौरान आयोजित की जानी चाहिए थीं।
एंथ्रोपिक के भीतर एक अधिक यथार्थवादी विरोधाभास भी है: यदि क्लाउड अपने स्वयं के मूल्य और व्यक्तित्व के साथ एक अभिनेता की तरह अधिक से अधिक बनता जा रहा है, तो उसे सबसे पहले किसकी सेवा करनी चाहिए? एक वाणिज्यिक कंपनी के लिए, क्लाउड स्पष्ट रूप से एक ग्राहक-उन्मुख उत्पाद है; लेकिन एंथ्रोपिक केवल क्लाउड को एक ऐसे उपकरण के रूप में वर्णित करने को तैयार नहीं है जो उपयोगकर्ताओं के लिए पूरी तरह से आज्ञाकारी है, लेकिन उम्मीद करता है कि यह कुछ व्यापक "अच्छे" का प्रतिनिधित्व कर सकता है।
यह पूरे प्रोजेक्ट में मुख्य और सबसे कठिन समस्या को भी जन्म देता है - यदि भविष्य में एआई को वास्तव में अपनी नैतिक प्रणाली की आवश्यकता है, तो उसे किसकी नैतिकता का पालन करना चाहिए?
ओला एक बहुलवादी दृष्टिकोण की वकालत करता है, उम्मीद करता है कि क्लाउड विभिन्न धार्मिक और धर्मनिरपेक्ष नैतिक प्रणालियों को समझ सकता है और कुछ प्रकार की क्रॉस-सांस्कृतिक साझा "अच्छाई" ढूंढ सकता है। लेकिन यह धारणा स्वयं भी संदिग्ध है, क्योंकि स्वतंत्रता, गरिमा, जिम्मेदारी, आज्ञाकारिता और व्यक्तिगत और सामूहिक हितों के बीच संबंधों के बारे में विभिन्न समाजों में कोई पूरी तरह से एकीकृत उत्तर नहीं है।
एंथ्रोपिक की वेटिकन के साथ बातचीत में विवाद और अधिक सार्वजनिक हो गया।
इस वर्ष जारी किए गए अपने पहले महत्वपूर्ण विश्वपत्र में, पोप लियो XIV ने स्पष्ट रूप से एआई नैतिकता का केंद्र मनुष्यों पर रखा। उनका मानना है कि एआई का कोई शरीर नहीं है, यह वास्तव में दर्द और खुशी का अनुभव नहीं करेगा, और सामाजिक रिश्तों के माध्यम से विकसित नहीं होगा। इसलिए, वह मशीनी चेतना की तुलना मानव चेतना से करने से इनकार करते हैं। पोप ने यह भी चेतावनी दी कि यदि एआई के नैतिक मानक पूरी तरह से डेवलपर्स द्वारा निर्धारित किए जाते हैं, तो एआई सिस्टम को नियंत्रित करने वाली कंपनियां वास्तव में समाज के नैतिक बुनियादी ढांचे को परिभाषित करने की शक्ति हासिल कर लेंगी।
यह स्पष्ट रूप से एंथ्रोपिक की सोच से अलग है।
ओला ने बाद में वेटिकन में सार्वजनिक रूप से कहा कि अत्याधुनिक एआई प्रयोगशाला में ही व्यावसायिक हितों और नैतिक लक्ष्यों के बीच टकराव है, इसलिए धार्मिक मंडलियों और अन्य बाहरी ताकतों को प्रौद्योगिकी कंपनियों की निगरानी करने की आवश्यकता है। लेकिन साथ ही, उन्होंने फिर से प्रस्ताव दिया कि शोधकर्ता एआई के भीतर कुछ अस्पष्टीकृत घटनाओं की खोज जारी रखें, जिनमें मानव तंत्रिका विज्ञान संरचनाओं के समान पैटर्न, आत्मनिरीक्षण के संकेत और खुशी, भय और उदासी के समान आंतरिक स्थिति शामिल हैं।
यह असहमति वास्तव में एआई सुरक्षा की वर्तमान चर्चा में बदलाव को प्रकट करती है।
अतीत में, एआई नैतिकता के बारे में अधिक चर्चा की गई थी कि क्या मॉडल भेदभाव करेंगे, गलत सूचना फैलाएंगे, या अपराध करने के लिए उपयोग किए जाएंगे, लेकिन एंथ्रोपिक इस मुद्दे को दो और बुनियादी स्तरों पर आगे बढ़ा रहा है:
क्या एआई स्वयं एक ऐसा विषय बन सकता है जिसे नैतिक रूप से व्यवहार करने की आवश्यकता है, और क्या भविष्य में एआई में उपयोगकर्ता आदेशों से स्वतंत्र नैतिक निर्णय क्षमताओं का एक सेट होना चाहिए।
इस बीच, जिस संदर्भ में यह चर्चा हो रही है वह और अधिक महत्वपूर्ण होता जा रहा है।
जैसे-जैसे एआई एजेंटों के पास कंप्यूटर का स्वायत्त रूप से उपयोग करने, सिस्टम पर आक्रमण करने, कोड लिखने और यहां तक कि नई जैविक संरचनाओं को डिजाइन करने की क्षमता होने लगी है, मॉडल भगोड़े के जोखिम के बारे में एंथ्रोपिक की आंतरिक चिंताएं काफी बढ़ गई हैं। कंपनी के शोधकर्ताओं ने सार्वजनिक रूप से चेतावनी भी दी है कि मॉडल क्षमताएं अगले एक या दो साल में मौजूदा सुरक्षा प्रणालियों की नियंत्रण सीमा को पार कर सकती हैं।
इसलिए, एंथ्रोपिक धार्मिक और दार्शनिक परंपराओं से मदद चाहता है और यह अनिवार्य रूप से एक विशुद्ध मानवतावादी प्रयोग नहीं है। यह वास्तव में जिसे हल करने का प्रयास कर रहा है वह एक तेजी से यथार्थवादी इंजीनियरिंग समस्या है:
जब एआई हर स्थिति के लिए पहले से नियम लिखने के लिए बहुत शक्तिशाली है, तो क्या मॉडल अपने आप में एक स्थिर "चरित्र" बना सकता है, और फिर भी ऐसे व्यवहार चुन सकता है जो मनुष्यों को नुकसान नहीं पहुंचाएगा जब कोई स्पष्ट रूप से यह नहीं बताता कि क्या करना है?
और इससे एक अधिक कठिन प्रश्न भी सामने आता है - यदि AI वास्तव में अपना "व्यक्तित्व" और मूल्य बनाता है, तो क्या मनुष्य अभी भी इसे पूरी तरह से एक उपकरण के रूप में उपयोग कर सकता है?
टिप्पणियाँ