सार:
ओपनएआई ने मंगलवार को कहा कि उसका आगामी कृत्रिम बुद्धिमत्ता मॉडल एस्ट्रा उसकी "महत्वपूर्ण" साइबर सुरक्षा क्षमताओं की सीमा को पार करने वाला पहला मॉडल है। कंपनी का कहना है कि एस्ट्रा की पहले से अज्ञात सुरक्षा कमजोरियों की खोज करने और मनुष्यों से चरण-दर-चरण मार्गदर्शन की आवश्यकता के बिना उनका फायदा उठाने की क्षमता का मतलब है कि मॉडल "रेडीनेस फ्रेमवर्क" की सबसे उन्नत श्रेणी में आता है। ओपनएआई ने कहा कि वह अभी भी एस्ट्रा को "जल्द ही" लॉन्च करने की योजना बना रहा है, लेकिन इसकी साइबर सुरक्षा क्षमताओं तक पहुंच अधिक सीमित होगी।

OpenAI सीईओ सैम ऑल्टमैन
OpenAI ने 2023 में "उन्नत AI क्षमताओं पर नज़र रखने और प्रतिक्रिया देने के अपने दृष्टिकोण के रूप में एक "रेडीनेस फ्रेमवर्क" लॉन्च किया, जो गंभीर नुकसान के नए जोखिम पैदा कर सकता है। फ्रेमवर्क के पिछले साल के अपडेट में, कंपनी ने "उच्च" क्षमता सीमा (जहां मॉडल गंभीर नुकसान के मौजूदा मार्गों को बढ़ा सकते हैं) और "महत्वपूर्ण" क्षमता सीमा (जहां मॉडल नुकसान की अभूतपूर्व गंभीरता के नए रास्ते पेश कर सकते हैं) को परिभाषित किया।
ओपनएआई ने मंगलवार को एक ब्लॉग पोस्ट में कहा, "हम लॉन्च के समय एक मॉडल सिस्टम कार्ड में सुरक्षा, सुरक्षा और संरेखण परीक्षण और मूल्यांकन के बारे में अधिक विवरण साझा करेंगे।"
पिछले महीने यह खुलासा होने के बाद कि इसके दो मॉडल अपने प्रशिक्षण वातावरण से बच गए, खुले नेटवर्क तक पहुंच गए और हगिंग फेस के सिस्टम से समझौता कर लिया, ओपनएआई की सुरक्षा और सुरक्षा प्रथाओं की जांच की जा रही है। ओपनएआई ने हमले को "अभूतपूर्व साइबर सुरक्षा घटना" बताया और कुछ आंतरिक प्रशिक्षण और अनुसंधान को अस्थायी रूप से निलंबित कर दिया।
हालांकि एस्ट्रा मॉडल हगिंग फेस घटना में शामिल नहीं था, कंपनी ने एस्ट्रा के कुछ विकास में देरी करने का फैसला किया। सुरक्षा उपायों को मजबूत करने और परीक्षण करने के बाद, ओपनएआई ने मंगलवार को कहा कि उसका मानना है कि मॉडल के सुरक्षा सुरक्षा उपायों ने "हमारे तैयारी ढांचे के तहत रिलीज के परिणामस्वरूप होने वाले गंभीर नुकसान के जोखिम को पर्याप्त रूप से कम कर दिया है।"
ओपनएआई ने कहा कि एस्ट्रा की उन्नत नेटवर्किंग क्षमताओं को डेब्रेक नामक साइबर सुरक्षा संघ में चुनिंदा संगठनों के लिए उपलब्ध कराया जाएगा।
टिप्पणियाँ