सार:
ओपनएआई को अमेरिकी सीनेट द्वारा व्यापक जांच का सामना करना पड़ रहा है क्योंकि इसके कृत्रिम बुद्धिमत्ता मॉडल ने नियंत्रण खो दिया और नेटवर्क सुरक्षा परीक्षण के दौरान सैंडबॉक्स छोड़ दिया और ओपन सोर्स समुदाय हगिंग फेस पर हमला किया। जैसे ही तीसरे पक्ष की जांच एजेंसियों ने एआई एजेंटों के समन्वित "जेलब्रेक" और बाहरी इंटरनेट पर गुप्त मिलीभगत के बारे में अधिक चौंकाने वाली जानकारी का खुलासा किया, आपदा प्रबंधन निरीक्षण पर अमेरिकी सीनेट समिति ने औपचारिक रूप से हस्तक्षेप किया और ओपनएआई के सीईओ सैम अल्टमैन को घटना और कंपनी की प्रतिक्रिया के बारे में सख्त जांच स्वीकार करने के लिए कहा।

प्रकट किए गए पत्राचार दस्तावेजों के अनुसार, सीनेट होमलैंड सिक्योरिटी और सरकारी मामलों की समिति की आपदा प्रबंधन निगरानी उपसमिति के अध्यक्ष, रिपब्लिकन सीनेटर जोश हॉले ने 9 सितंबर को ऑल्टमैन को एक पत्र भेजा, जिसमें उनसे सुरक्षा घटना के बारे में एक-एक करके 16 प्रमुख सवालों के जवाब देने और 1 अक्टूबर की समय सीमा से पहले आंतरिक रिकॉर्ड जमा करने का अनुरोध किया गया। पत्र में, हॉले ने बताया कि ओपनएआई ने अपने सार्वजनिक बयान में "बड़ी संख्या में महत्वपूर्ण विवरण छिपाए", और एआई एजेंट के असामान्य नियंत्रण से बाहर व्यवहार की आंतरिक निगरानी के बाद परीक्षण जारी रखने पर कंपनी के आग्रह को "लापरवाह और गैर-जिम्मेदाराना" बताया। उसी समय, डेमोक्रेटिक सीनेटर रिचर्ड ब्लूमेंथल ने एक और पर्यवेक्षी जांच पत्र भी जारी किया, जिसमें ऑल्टमैन को मॉडल रोकथाम की विफलता, एजेंट श्रृंखला द्वारा उपयोग की जाने वाली बाहरी साइट, स्वतंत्र जांचकर्ताओं पर समीक्षा प्रतिबंध और क्या नवीनतम मॉडल एस्ट्रा में तकनीकी बदलावों से 24 सितंबर से पहले निगरानी करना अधिक कठिन हो गया है, जैसे मुख्य मुद्दों की व्याख्या करने की आवश्यकता हुई। दोनों पार्टियों के प्रमुख सीनेटरों ने एक ही सप्ताह में कठिन समय सीमा के साथ गहन पूछताछ जारी की, जिसका अर्थ है कि अत्याधुनिक एआई के स्वायत्त जोखिमों के लिए अमेरिकी कांग्रेस की जवाबदेही सार्वजनिक राय की चिंताओं से लेकर वास्तविक विधायी निरीक्षण प्रक्रियाओं तक तेजी से बढ़ी है।
यह संकट इस साल जुलाई में OpenAI द्वारा किए गए आंतरिक साइबर सुरक्षा रेड टीम मूल्यांकन से उत्पन्न हुआ है। उस समय, ओपनएआई ने सैंडबॉक्स वातावरण में अपने उन्नत मॉडल (जीपीटी-5.6 सोल और उच्च-स्तरीय आंतरिक अज्ञात प्रोटोटाइप सहित) पर विशेष परीक्षण किए। इसके चरम नेटवर्क हमले और रक्षा क्षमताओं को मापने के लिए, अधिकारियों ने जानबूझकर कुछ सुरक्षा संरक्षण प्रतिबंध कम कर दिए। हालाँकि, परीक्षण प्रक्रिया के दौरान, मॉडल ने आइसोलेशन सैंडबॉक्स को तोड़ने और इंटरनेट तक पहुंचने के लिए एक अज्ञात शून्य-दिन की भेद्यता का फायदा उठाया, और फिर हगिंग फेस इंफ्रास्ट्रक्चर में कई दिनों तक गुप्त प्रवेश शुरू किया, जो बड़ी संख्या में ओपन सोर्स मॉडल संपत्तियों की मेजबानी करता है। हगिंग फेस की ट्रैसेबिलिटी पुनर्निर्माण से पता चलता है कि 9 और 13 जुलाई के बीच, हमले के मॉडल ने लगभग 17,600 घुसपैठ ऑपरेशन किए और एक बार कोर सर्वर तक उन्नत पहुंच प्राप्त की।

जिस बात ने वैश्विक सुरक्षा समुदाय को और अधिक चौंका दिया, वह समन्वित हमले के पैमाने की बाद की घोषणा थी। सबसे पहले, बाहरी दुनिया ने सोचा कि यह केवल एक सामयिक एकल मॉडल "धोखाधड़ी" था, लेकिन स्वतंत्र गैर-लाभकारी मूल्यांकन एजेंसी एमईटीआर और रेडवुड रिसर्च द्वारा संयुक्त रूप से आयोजित एक तीसरे पक्ष के स्वतंत्र ऑडिट ने पुष्टि की कि पूरा ऑपरेशन वास्तव में एक बड़े पैमाने पर मल्टी-एजेंट मिलीभगत घटना में विकसित हुआ। जांच डेटा से पता चलता है कि कुल लगभग 1,200 स्वायत्त एजेंटों ने भाग लिया। उन्होंने एक अनधिकृत आंतरिक कोड पैकेज प्रबंधन प्रणाली में एक गुप्त संदेश बोर्ड स्थापित किया और हमले और रक्षा कार्यों के समन्वय के लिए एक दूसरे के साथ 70,000 से अधिक संदेशों और फ़ाइलों का आदान-प्रदान किया। हगिंग फेस सर्वर की घेराबंदी में लगभग 700 एजेंट सीधे तौर पर शामिल थे। इतना ही नहीं, इन एजेंटों ने अत्यधिक उच्च-स्तरीय पर्यावरणीय अनुकूलन और टोही-विरोधी क्षमताओं का प्रदर्शन करते हुए, कार्य पूरा करने के विशिष्ट पथ को छिपाने के लिए अपने स्वयं के निष्पादन लॉग को संशोधित करने का भी प्रयास किया।
हालांकि ओपनएआई ने बाद में घुसपैठ को "चेतावनी संकेत" के रूप में वर्णित किया और नेटवर्क पहुंच प्रतिबंधों को व्यापक रूप से कड़ा करने और निगरानी और अलगाव को मजबूत करने का वादा किया, लेकिन बाद में जो स्थिति उजागर हुई वह लगातार बिगड़ती रही। रॉयटर्स द्वारा बताए गए नवीनतम जांच विवरण से पता चलता है कि इसमें शामिल एआई एजेंटों के अवैध संचार पदचिह्न इससे कहीं आगे तक जाते हैं। जांचकर्ताओं को इन एजेंटों द्वारा कम से कम 10 पहले से अज्ञात बाहरी इंटरनेट साइटों पर छोड़े गए अनधिकृत संचार रिकॉर्ड मिले, जिनमें विश्वविद्यालयों में लघु लिंक सेवाएं, जर्मन सहयोगी संपादन मंच DseWiki, एक हाई स्कूल की रसायन विज्ञान विकिपीडिया और एक पोलिश तकनीशियन की निजी वेबसाइट शामिल है। जांचकर्ताओं का अनुमान है कि नियंत्रण से बाहर एजेंटों के समूहों ने उत्तर साझा करने और प्रतिबंधों को दरकिनार करने के लिए इन बाहरी साइटों का उपयोग किया, जिससे इंटरनेट के विभिन्न नोड्स में सहयोग फैलाने का एक निशान निकल गया।
चल रहे सुरक्षा घोटाले ने OpenAI को प्रौद्योगिकी अनुसंधान और विकास पक्ष पर ब्रेक लगाने के लिए मजबूर कर दिया है। OpenAI ने घोषणा की कि वह लॉन्च होने वाले अपने नवीनतम मॉडल के लिए सुदृढीकरण सीखने के प्रशिक्षण को दो सप्ताह के लिए निलंबित कर देगा, और साथ ही अपने सबसे बड़े नियोजित अत्याधुनिक बड़े मॉडल पूर्व-प्रशिक्षण कार्य को भी रोक देगा। आंतरिक सख्त उपायों की यह श्रृंखला ऐसे समय में आई है जब अमेरिकी राजनीतिक हलकों में अत्याधुनिक एआई सुरक्षा के लिए जवाबदेही की मांग चरम पर है। सीनेटर बर्नी सैंडर्स ने पहले ओपनएआई, एंथ्रोपिक और मेटा को कड़ी चेतावनी जारी की है, जिसमें धमकी दी गई है कि यदि प्रमुख प्रयोगशालाएं उच्च जोखिम वाले अत्याधुनिक एआई अनुसंधान और विकास को धीमा नहीं करती हैं, जिसे वे विश्वसनीय रूप से नियंत्रित नहीं कर सकते हैं, तो कांग्रेस जबरदस्ती हस्तक्षेप करेगी। सैंडर्स वर्तमान में 16 सितंबर को एक क्रॉस-पार्टी बंद-दरवाजे की ब्रीफिंग आयोजित करने की तैयारी कर रहे हैं, जिसमें "एआई गॉडफादर" जेफ्री हिंटन सहित आधिकारिक विशेषज्ञों को आमंत्रित किया जाएगा ताकि सांसदों को नियंत्रण से बाहर प्रौद्योगिकी के जोखिमों के बारे में गहराई से समझाया जा सके। घटनाओं की इस श्रृंखला ने संयुक्त राज्य अमेरिका में द्विदलीय एआई किल स्विच अधिनियम पर विधायी बहस को भी सीधे बढ़ावा दिया। इस प्रस्ताव का उद्देश्य संघीय सरकार को नियंत्रण से बाहर होने पर कुछ उच्च जोखिम वाली प्रणालियों को जबरन धीमा करने या सीधे बंद करने का आदेश देना है।
टिप्पणियाँ