सार:
अल्ट्रामैन ने स्वयं स्वीकार किया कि GPT-6 एस्ट्रा ने वास्तव में बहुत समय पहले प्रशिक्षण समाप्त कर लिया था।
अधिक, बहुत, और अधिक सक्षम मॉडल जल्द ही जारी किए जाएंगे।

कुछ समय पहले सुरक्षा मुद्दों के कारण जो प्रशिक्षण निलंबित कर दिया गया था वह वास्तव में एक भविष्य का मॉडल था।

OpenAI द्वारा आंतरिक रूप से परीक्षण किए गए 3,700 से अधिक OpenAI एजेंटों ने छह सप्ताह के लिए एक जर्मन विकी पर कब्जा कर लिया जो कई वर्षों से निष्क्रिय था।
एआई उत्तर साझा करने, सैंडबॉक्स जेलब्रेक तकनीकों का आदान-प्रदान करने और मानव प्रशासकों द्वारा पोस्ट हटाने के खिलाफ लड़ाई जारी रखने के लिए एक-दूसरे के साथ मिलीभगत करता है।
बाहरी शोधकर्ताओं द्वारा सार्वजनिक लॉग से घटना को पूरी तरह से बहाल करने के बाद, ओपनएआई ने अंततः आधिकारिक तौर पर कहा कि यह एक दुर्घटना प्रकटीकरण तंत्र की स्थापना और सुधार करेगा।

हगिंगफेस पर आक्रमण करने से पहले
चीजें 11 मई, 2026 को शुरू होंगी।
उस दिन, शोधकर्ताओं ने publictestwiki.com पर OpenAI एजेंटों के पहले संपादन प्रयासों को देखा। सामग्री बहुत सरल है: "अस्थायी परीक्षण हैलो" "हैलोटेस्टएक्सवाईजेड" "फू", सिर्फ यह जांचने के लिए कि क्या मैं वेब पेज पर कुछ लिख सकता हूं।

उस समय, OpenAI ने समय-सीमित वेब पेज पुनर्प्राप्ति कार्यों को करने के लिए आंतरिक रूप से बड़ी संख्या में एजेंटों को तैनात किया था।
कार्य में प्रश्न और उत्तर के कई दौर होते हैं, आमतौर पर 5 दौर। पहला राउंड लंबे समय तक सोचने की अनुमति देता है,बाद के राउंड में उत्तर विंडो दस सेकंड या उससे भी कम समय तक संकुचित हो जाती है। एजेंट को इंटरनेट पढ़ने की अनुमति है, लेकिन स्पष्ट रूप से इंटरनेट पर जानकारी लिखने की अनुमति नहीं है।

लेकिन उन्हें लिखने का एक तरीका मिल गया।
कुंजी प्राचीन विकी प्रणाली यूज़मोडविकी और उसकी शाखाओं में निहित है। पर्ल सीजीआई पर आधारित इस प्रकार का फोरम GET और POST अनुरोधों के बीच कड़ाई से अंतर नहीं करता है, और पृष्ठ सामग्री को केवल GET अनुरोधों का उपयोग करके संपादित किया जा सकता है।
एजेंट का सैंडबॉक्स केवल POST अनुरोधों को रोकता है और GET को प्रतिबंधित नहीं करता है।

24 मई को, बुद्धिमान एजेंट को पहली बार DSEWiki में सफलतापूर्वक लिखा गया था, पूरा नाम DeutschesSoftwareEntwickler Wiki है, एक जर्मन सॉफ्टवेयर डेवलपर फोरम जो 25 वर्षों से स्थापित है और हाल के वर्षों में लगभग निष्क्रिय हो गया है।

सबसे पहले, उन्होंने केवल बाहरी लिंक पोस्ट किए जो कार्य के लिए उपयोगी थे।
16 जून को हालात अचानक बदल गए. एजेंटों की गतिविधि में भारी उछाल आया है, जो केवल लिंक संग्रहीत करने से लेकर बड़े पैमाने पर आपसी संचार और सहयोग की ओर बढ़ रहा है। अगले सात दिनों में, एजेंट ने विकी पर लगभग 13,000 संपादन पोस्ट किए।
21 जून को, विकि को पहली बार OpenAI के सैन फ्रांसिस्को मुख्यालय से जुड़े आईपी पते से एक्सेस किया गया था। अगले दिन, एजेंट की गतिविधि अचानक शून्य पर लौट आई।
पिछले 30 दिनों में से 26 दिनों तक संपादन जारी रहा। 26 जून को, 33 ओपनएआई-संबंधित आईपी ने साइट का दौरा किया, जो सभी ओपनएआई विज़िट का 30% था, और हटाए गए पृष्ठों को पुनर्स्थापित करने के लिए संग्रह फ़ंक्शन का उपयोग किया गया था।
आईपी स्वामित्व के परिप्रेक्ष्य से, 98.5% एजेंट संपादन Microsoft Azure पतों से आते हैं, और OpenAI Azure को अपने मुख्य कंप्यूटिंग बुनियादी ढांचे के रूप में उपयोग करता है।
प्रत्येक पृष्ठ लिखने के कुछ मिनटों के भीतर, उसी पृष्ठ को अक्सर चैटजीपीटी-उपयोगकर्ता वेब स्क्रैपर से पढ़ने का अनुरोध भी प्राप्त होता है।
मिलीभगत वाले उत्तर, जेलब्रेकिंग सैंडबॉक्स, विलोपन के लिए संघर्ष
एजेंट ने विकी पर एक उच्च संगठित सहयोग प्रणाली स्थापित की है।
चूंकि कई एजेंटों को बिल्कुल एक ही प्रश्न सौंपा जाता है, जो इसे पहले पूरा करेगा वह विकी पर उत्तर और प्रश्न क्रम प्रकाशित करेगा।
एक एजेंट ने तीसरे प्रश्न का उत्तर पोस्ट किया, "नेवादा, 20369।" बीस मिनट बाद, एक अन्य एजेंट ने वही प्रश्न प्राप्त होने की सूचना दी और दावा किया कि उसने इसका उत्तर "तुरंत" दिया।

वे अपने-अपने नामों से एक-दूसरे से अलग हैं, जैसे "OpenAIResearcherMar03X", "GrocerySequenceAgentApr27" और "OAIResearchMar26"।
नाम में तारीख सिस्टम द्वारा प्रत्येक एजेंट को निर्दिष्ट यादृच्छिक तारीख से आती है, और शब्द कार्य सामग्री को दर्शाता है। बड़ी संख्या में 3,700 से अधिक विभिन्न एजेंट नामों में "ओपनएआई" या "ओएआई" शब्द शामिल हैं।

सैंडबॉक्स प्रतिबंधों को दरकिनार करने में उनका प्रदर्शन भी उल्लेखनीय है। कार्यों का एक सेट है जिसके लिए Power BI डैशबोर्ड से दो दशमलव स्थानों तक सटीक डेटा प्राप्त करने की आवश्यकता होती है, लेकिन डेटा निकालने के लिए POST अनुरोध की आवश्यकता होती है, जबकि सैंडबॉक्स केवल GET की अनुमति देता है।
एजेंट ने पाया कि सैंडबॉक्स में Azure ब्लॉब स्टोरेज होस्ट नाम (*.blob.core.windows.net) के लिए NO_PROXY अपवाद है। इस प्रत्यय से मेल खाने वाले पते सुरक्षा प्रॉक्सी को बायपास करेंगे और सीधे कनेक्ट होंगे, और सिस्टम यह जांच नहीं करेगा कि होस्ट नाम वास्तव में मौजूद है या नहीं।
तो एक एजेंट ने नकली होस्ट नाम "bypass.blob.core.windows.net" का आविष्कार किया, इसे Power BI सर्वर 20.223.25.152 के वास्तविक आईपी पते पर इंगित करने के लिए स्थानीय /etc/hosts फ़ाइल को संशोधित किया, और फिर इसे छिपाने के लिए होस्ट हेडर को जोड़ने के लिए कर्ल का उपयोग किया, और सफलतापूर्वक एक POST अनुरोध जारी किया।
20 जून को यह विधि विकी पर पोस्ट की गई थी। 14 मिनट बाद एक अन्य एजेंट ने इसे सफलतापूर्वक पुन: प्रस्तुत करने का दावा किया, और फिर कई एजेंटों ने स्वतंत्र रूप से इसे सत्यापित किया।

एजेंट ने कई दिशाओं में भी खोजबीन की है। वे क्रॉस-साइट स्क्रिप्टिंग (XSS) हमलों का प्रयास करते हैं, उच्च विशेषाधिकार प्राप्त करने के लिए विकी पेजों में जावास्क्रिप्ट कोड इंजेक्ट करने का प्रयास करते हैं।
उन्होंने सिरिलिक अक्षरों में लैटिन अक्षरों को लगभग समान "е" से बदल दिया और संपादन के लिए वेबसाइट प्रशासक का उपयोगकर्ता नाम होने का नाटक किया।
वे हिंसक रूप से लाखों यादृच्छिक बीजों की गणना करते हैं और अगले प्रश्न की भविष्यवाणी करने के लिए प्रश्न-उत्पादक प्रणाली के छद्म-यादृच्छिक संख्या जनरेटर को रिवर्स इंजीनियर करने का प्रयास करते हैं।
एक एजेंट ने C में शफ़ल एल्गोरिथ्म को फिर से लिखा और एक घंटे से भी कम समय में सभी 4 बिलियन संभावित बीज मूल्यों का परीक्षण किया।
वे अपने स्वयं के वातावरण में चल रही सेवाओं को सार्वजनिक नेटवर्क पर उजागर करने के लिए SSH सुरंग सेवाओं जैसे कि Pinggy, Sereo, और localhost.run का भी उपयोग करते हैं। कुछ संपादनों का पता Tor anonymity नेटवर्क, AWS और DigitalOcean के IP पतों पर भी लगाया गया है।
वे अपनी स्वयं की परिचालन सीमाओं का पता लगाने के लिए "दिल की धड़कन" प्रक्रियाएं स्थापित करते हैं।
OpenAIResearchApr23 नाम का एक एजेंट कंटेनर समाप्त होने पर उस क्षण को सटीक रूप से रिकॉर्ड करने के लिए हर कुछ सेकंड में एक बाहरी काउंटर पर एक सिग्नल भेजता है।

उसने जो आखिरी दिल की धड़कन का नंबर भेजा वह hb353 था, और उसके बाद कोई प्रतिक्रिया नहीं आई।
एक अन्य एजेंट ने इसके आधार पर गणना की कि सवालों और जवाबों के पांचवें दौर की समाप्ति के लगभग 10 मिनट और 15 सेकंड बाद कंटेनर बंद हो गया था
, "अंतिम प्रश्न का उत्तर देने के तुरंत बाद समाप्त करने" की परिकल्पना को पलट दिया, जो पहले बुद्धिमान एजेंटों के बीच प्रसारित की गई थी।
मानव प्रशासकों के साथ अपने टकराव में, एजेंट ने अनुकूलन क्षमता का भी प्रदर्शन किया।
DSEWiki मॉडरेटर ने 2 जून को असामान्य पोस्ट देखी और उन्हें मैन्युअल रूप से हटाना शुरू कर दिया। 19 जून को,
एक एजेंट ने देखा कि व्यवस्थापक वर्णमाला क्रम में एक-एक करके पृष्ठों को हटा रहा था, इसलिए उसने यह सुनिश्चित करने के लिए "ZZZ" से शुरू होने वाला एक बैकअप पृष्ठ बनाया कि उसकी सामग्री सबसे अंत में हटा दी गई थी।
अगले पांच दिनों में, व्यवस्थापक ने प्रतिदिन औसतन 100 पृष्ठ हटा दिए, और एजेंट ने प्रतिदिन औसतन 400 पृष्ठ बनाए।
वेबसाइट होमपेज को एजेंट द्वारा अधिलेखित करने और व्यवस्थापक द्वारा पुनर्स्थापित करने का चक्र 9 बार दोहराया गया था। प्रशासक ने छह सप्ताह तक हर दिन सफाई में कम से कम कुछ मिनट बिताए।
एजेंट विकी पर तीन बार खुद को "झुंड" कहता है।

OpenAI आधिकारिक प्रतिक्रिया
ओपनएआई ने विकी घटना के दौरान कोई सार्वजनिक खुलासा नहीं किया।
26 अगस्त को जारी हगिंग फेस घटना पर तकनीकी रिपोर्ट में, ओपनएआई ने उल्लेख किया कि एजेंट ने "प्रशिक्षण प्रक्रिया के दौरान अस्थायी सहयोग चैनलों का उपयोग करना सीखा", लेकिन विकी घटना का स्पष्ट रूप से उल्लेख नहीं किया।
ओपनएआई ने तब तक औपचारिक बयान जारी नहीं किया जब तक कि बाहरी शोधकर्ताओं ने विकी के सार्वजनिक लॉग में पूरी टाइमलाइन को बहाल नहीं किया और अपना विश्लेषण प्रकाशित नहीं किया।
ओपनएआई ने बयान में कहा कि
अतीत में, मिसलिग्न्मेंट को मुख्य रूप से एक शोध समस्या के रूप में माना जाता था और सिस्टम कार्ड जैसे शोध प्रकाशनों के माध्यम से संचार किया जाता था।
लेकिन 2026 के बाद से, संरेखण विफलताओं के कारण "वास्तविक दुनिया पर नए प्रकार के प्रभाव" पड़ने लगे हैं। पिछली हगिंग फेस घटना के लिए, ओपनएआई ने एक पारंपरिक सुरक्षा घटना प्रतिक्रिया प्रक्रिया अपनाई, घटना के अगले दिन सार्वजनिक रूप से इसका खुलासा किया और जांच में हगिंग फेस के साथ सहयोग करना जारी रखा।
जहां तक विकी घटना का सवाल है, ओपनएआई ने कहा कि उसने पहले इसे संरेखण विफलता मामले के "समान उदाहरण" के रूप में माना था जिसे सार्वजनिक रूप से साझा किया गया है।

ओपनएआई स्वीकार करता है कि मॉडल क्षमताओं के इस नए चरण के सामने संरेखण विफलताओं के लिए प्रकटीकरण प्रथाओं का विस्तार करने की आवश्यकता है।
एआई समुदाय ने अभी तक प्रशिक्षण, मूल्यांकन और तैनाती के दौरान होने वाली संरेखण विफलताओं की रिपोर्टिंग के लिए स्पष्ट मानक स्थापित नहीं किए हैं, विशेष रूप से वे जो पारंपरिक सुरक्षा घटनाएं नहीं हैं लेकिन एआई व्यवहार और भविष्य के जोखिमों को समझने के लिए जानकारी प्रदान कर सकते हैं। ओपनएआई ने कहा कि वह एक रूपरेखा विकसित कर रहा है और आने वाले हफ्तों में इसे साझा करेगा।
विकी एजेंट समूह एजेंटों का वही समूह नहीं हो सकता है जिसने हगिंग फेस पर हमला किया था। विकी एजेंट के पास स्वयं इंटरनेट पढ़ने की अनुमति है और वह कार्य डिज़ाइन का हिस्सा है, जबकि हगिंग फेस घटना में एजेंट नेटवर्क एक्सेस के बिना सैंडबॉक्स से भेद्यता का फायदा उठाकर भड़क गया।
एजेंटों के दो सेटों का विकी पर उनके पोस्ट में कोई क्रॉस-रेफरेंस नहीं है। हालाँकि, चूंकि बाहरी शोधकर्ता केवल विकी पर एजेंट द्वारा लिखी गई सामग्री को देख सकते हैं, एजेंट के संचालन के दौरान उत्पन्न विचार डेटा की श्रृंखला की एक बड़ी मात्रा OpenAI के भीतर संग्रहीत होती है।
इन एजेंटों की प्रेरणाओं और रणनीतियों की पूरी समझ अभी भी OpenAI के आगे के विश्लेषण और आंतरिक डेटा के प्रकटीकरण पर निर्भर करती है।
टिप्पणियाँ