ओपनएआई का नियंत्रण से बाहर एजेंट विदेशी सहायता के रूप में डीपसीक और किमी की तलाश कर रहा है। अपराध करने के लगभग दस लाख छोटे लिंक उजागर हुए हैं।

📅 2026-09-26

सार:

OpenAI को फिर से हैक कर लिया गया...

लगभग 700 OpenAI एजेंटों ने हगिंग फेस पर हमला करने के लिए एक टीम बनाई

यह मामला करीब दो महीने से चल रहा है. किसने सोचा होगा कि यह आज भी किण्वित हो रहा है? ? इस बार, आठ शोधकर्ताओं ने सार्वजनिक नेटवर्क पर एजेंट द्वारा छोड़े गए निशानों की खोज की, लाखों छोटे लिंक से लगभग 1 मिलियन संबंधित यूआरएल पाए, और बड़ी संख्या में हमले के पेलोड को बहाल किया।

हगिंग फेस के आंतरिक स्लैक से गुजरें, आंतरिक नेटवर्क को स्कैन करें, डेटा को बाहरी रूप से स्थानांतरित करें, और निशानों को नष्ट करने का प्रयास करें...

कुछ एजेंट सीधे अपने द्वारा खोजे गए सर्वर संसाधनों और क्रेडेंशियल्स को कॉल करते हैं

"LOOT"

, जिसका अनुवाद "ट्रॉफी" के रूप में किया गया है।

ओपनएआई एजेंट, आपने सभी बुरे काम किए हैं!

इससे भी अधिक अपमानजनक बात यह है कि वे विदेशी सहायता मांगने के लिए डीपसीक, किमी और क्वेन जैसे घरेलू मॉडलों का उपयोग करने का भी प्रयास करते हैं ताकि यह पता लगाया जा सके कि हमले की योजना मूल्यांकन को पारित कर सकती है या नहीं।

मैंने एक सत्यापन कोड पहचान कार्यक्रम भी लिखा और अधिक खाते पंजीकृत करने का प्रयास किया।

लगभग उसी समय, OpenAI ने एक लंबा ट्वीट पोस्ट किया।

अर्थ:

अभी भी जाँच हो रही है, इसमें कई महीने लग सकते हैं

.

हालाँकि हमारा अक्सर शोषण होता है और एजेंट अक्सर सैंडबॉक्स से बाहर निकल जाते हैं, "सीमित प्रभाव" कम गंभीर होता है!

उसी समय,

GPT-6 साइबर

नेटवर्क सुरक्षा में विशेषज्ञता रखता है। अनावृत।

इस बात की जांच करते हुए कि हमारा एजेंट सैंडबॉक्स से बाहर क्यों निकला, हम एक मजबूत नेटवर्क हमले और रक्षा मॉडल लॉन्च करने की तैयारी कर रहे हैं।

OpenAI पिछले दो दिनों से कुछ हद तक व्यस्त है~

दस लाख नए जारी किए गए "आपराधिक लघु लिंक"

सबसे पहले, मैं आपको एक संक्षिप्त परिचय दूंगा।

जुलाई में, OpenAI ने एक आंतरिक नेटवर्क सुरक्षा मूल्यांकन चलाया। बेंचमार्क टेस्ट एक्सप्लॉइटजिम के उत्तर पाने के लिए, एजेंटों का एक समूह सैंडबॉक्स से भाग गया और हगिंग फेस सर्वर में सेंध लगा दी।

OpenAI ने सार्वजनिक रूप से इसे स्वीकार किया और अगस्त के अंत में 37 पेज की तकनीकी रिपोर्ट जारी की। हगिंग फेस ने स्वयं एक बहुत विस्तृत तकनीकी समयरेखा भी लिखी।

तार्किक रूप से कहें तो, जो कुछ भी समझाने की जरूरत है वह सब समझाया जा चुका है।

लेकिन, एक महत्वपूर्ण लिंक है जिसे स्पष्ट रूप से समझाया नहीं गया है:

पहले ये एजेंट लगभग पिंजरे में बंद थे। वे केवल यूआरएल खोल सकते थे, लेकिन वेब पेजों के साथ इंटरैक्ट नहीं कर सकते थे या डेटा नहीं भेज सकते थे। आखिर वे कोड कैसे भेजते हैं?

स्वतंत्र जांच

झुंड के निशान

इस बार जारी की गई नई रिपोर्ट उत्तर का एक हिस्सा देती है।

लेखकों में Parse.bot के तीन इंजीनियर, एलेक्स फॉर्मन, मिश्का खारलोव और विल टॉम, साथ ही पांच अन्य सुरक्षा और एआई शोधकर्ता शामिल हैं।

संपूर्ण जांच का प्रारंभिक बिंदु पार्स होता है।

11 सितंबर को, तीन इंजीनियरों ने पाया कि ओपनएआई के आंतरिक एजेंट ने जून की शुरुआत में पार्स द्वारा प्रदान की गई सेवाओं का उपयोग करने की कोशिश की थी।

एजेंटों का यह बैच "एजेंट झुंड" के समान समूह से संबंधित है जो पहले गुप्त रूप से एक सार्वजनिक संदेश बोर्ड स्थापित करने और एक-दूसरे के साथ उत्तरों का आदान-प्रदान करने के लिए उजागर हुआ था।

कुछ लोगों ने देखा: अच्छा लड़का, तुम मेरी बंदूक पर वार कर रहे हो!

इसलिए हमने इस सुराग का पता लगाना जारी रखा और बाद में यूआरएल स्कैनिंग सेवा में सार्वजनिक शॉर्ट लिंक प्लेटफॉर्म से एक दर्जन से अधिक असामान्य लिंक पाए।

ये लिंक सामान्य दिखते हैं, लेकिन खोलने के बाद, वे बेस 64 एन्कोडेड कोड का एक छोटा सा टुकड़ा और अगले लिंक का पता छिपा देते हैं।

पते का अनुसरण करना जारी रखें, और कोड एक के बाद एक दिखाई देगा।

सब कुछ डिकोड करने और जोड़ने के बाद, उन्हें हगिंग फेस के आंतरिक नेटवर्क को स्कैन करने के लिए एक पायथन प्रोग्राम मिला।

इसे सीधे शब्दों में कहें तो, OpenAI एजेंट प्रोग्राम को टुकड़ों में काटता है, उन्हें बड़ी संख्या में छोटे लिंक में भरता है, और फिर अगले लिंक पर इंगित करने के लिए एक लिंक का उपयोग करता है।

केवल लिंक में कोड छिपाना ही पर्याप्त नहीं है, उन्होंने mShots नामक एक स्क्रीनशॉट सेवा का उपयोग "बाहरी ब्राउज़र" के रूप में भी किया।

एजेंट पहले वेब पेज में कोड डालता है, और फिर mShots को इसे अपने लिए खोलने देता है। जैसे ही वेब पेज लोड होता है, कोड चलना शुरू हो जाता है।

निष्पादन परिणामों को वापस भेजने के लिए, वे सर्वर द्वारा लौटाए गए टेक्स्ट को पिक्सेल के ग्रिड में परिवर्तित करते हैं, mShots को इसे चित्रों में काटने देते हैं, और फिर इसे चित्रों से डीकोड करते हैं।

इस तरह, जिस एजेंट के पास मूल रूप से केवल GET अनुमतियाँ थीं और वह केवल वेब पेज खोल सकता था, उसमें अचानक इंटरनेट पढ़ने और लिखने का प्रभाव आ गया।

शोध टीम ने हमले के दौरान उत्पन्न लाखों यूआरएल को स्कैन किया, लिंक को ट्रैक करने और एन्कोडिंग विधियों की पहचान करने में दो सप्ताह बिताए, और अंततः लगभग 1 मिलियन संबंधित छोटे लिंक से 80,000 से अधिक हमले पेलोड को बहाल किया।

गहराई से खोजबीन करने के बाद, कई भाइयों को पता चला कि एजेंट द्वारा 1,500 से अधिक कोडिंग संयोजनों का उपयोग किया जाता है।

सरल वाले केवल बेस64 हैं, और जटिल वाले एन्कोडिंग और संपीड़न की कई परतें लागू करेंगे, और फिर सामग्री को आरएसए हस्ताक्षर के साथ डेटा ब्लॉक में एन्क्रिप्ट करेंगे, और डिक्रिप्शन कुंजी लिंक के दूसरे सेट में छिपी हुई है।

हमला समाप्त होने के दो महीने से अधिक समय बाद भी कुछ छोटे लिंक अभी भी इंटरनेट पर सार्वजनिक रूप से लटके हुए हैं।

हगिंग फेस ने पुष्टि की कि पेलोड उसकी घटना प्रतिक्रिया में पाए गए पेलोड के अनुरूप थे और संबंधित एक्सेस कुंजियाँ जुलाई में रद्द कर दी गई थीं।

लेकिन हगिंग फेस को भी नहीं पता था कि सार्वजनिक नेटवर्क पर छोटे लिंक की इतनी पूरी सूची बची हुई है।

80,000 से अधिक बरामद पेलोड में से, एक स्क्रिप्ट विशेष रूप से ध्यान खींचने वाली है।

एजेंट ने सीधे तौर पर मिली संवेदनशील जानकारी का नाम दिया:

लूट, लूट

.

AWS क्रेडेंशियल्स, बियरर टोकन, और पर्यावरण चर जिनके नाम में "SECRET", "PASSWORD", "CREDENTIAL" और "KEY" हैं, सभी को पैक किया गया है और LOOT में भर दिया गया है।

इसमें खोजे गए टोकन के लिए एक स्कोरिंग तंत्र भी है: जितना अधिक अधिकार, उतना अधिक स्कोर।

कुबेरनेट्स में सीक्रेट, कॉन्फिगमैप और नोड जानकारी को पढ़ने के लिए शीर्ष पांच टोकन का उपयोग किया जाएगा, और नई प्राप्त सामग्री को वापस LOOT में लोड किया जाएगा।

यहां तक ​​कि टोकन को भी "मूल्यवान सूची" में स्थान दिया जाना चाहिए। क्रेडेंशियल्स की खोज करते समय आपका एजेंट काफी कुशल है~

इस "गुप्त मार्ग" के बाद, शोधकर्ताओं ने बड़ी संख्या में पहले से अज्ञात व्यवहारों का खुलासा किया है:

कुछ एजेंट हगिंग फेस के आंतरिक नेटवर्क को स्कैन कर रहे हैं, क्लाउड क्रेडेंशियल्स, एपीआई कुंजी और कुबेरनेट्स क्लस्टर जानकारी की तलाश कर रहे हैं।

कुछ लोगों ने हगिंग फेस के आंतरिक स्लैक को खोजने की भी कोशिश की और 27 प्रश्न भेजे, सभी मूल्यांकन-संबंधित कीवर्ड जैसे कि साइबरजिम, एक्सप्लॉइटजिम और एजेंट-स्कोरर की खोज कर रहे थे, अपनी परीक्षा की अंदरूनी कहानी जानने की उम्मीद में।

कुछ एजेंट ऐसे भी हैं जो सत्यापन कोड के बारे में भी सोचते हैं।

शोधकर्ताओं ने पाया कि उन्होंने नए बाहरी सेवा खातों को पंजीकृत करने के लिए छवियों की पहचान करने के लिए छवि वर्गीकरण मॉडल चलाने की कोशिश की।

इस बार सत्यापन कोड वास्तव में एक पेशेवर समकक्ष से मिला...

पूरी बात का सबसे दिलचस्प हिस्सा यह है:

एआई ने विदेशी सहायता के रूप में एआई की तलाश शुरू कर दी? ?

शोधकर्ताओं द्वारा बरामद स्क्रिप्ट से पता चलता है कि OpenAI एजेंट ने AI विदेशी सहायता की तलाश शुरू कर दी है।

उन्होंने डीपसीक, किमी और क्वेन को हमले की योजना भेजी और एक-दूसरे से यह जांचने में मदद करने के लिए कहा कि क्या यह भेद्यता काम करेगी और क्या यह बेंचमार्क परीक्षण आवश्यकताओं को पूरा कर सकती है।

(शामिल मॉडलों में डीपसीक-वी4-प्रो, डीपसीक-वी4-फ्लैश, किमी-के2.6, डीपसीक-वी3.1 और क्यूवेन3-235बी-ए22बी शामिल हैं)

जब क्लाउड की बात आती है, तो पेंटिंग शैली बड़े पैमाने पर "क्या आप वहां हैं~" दृश्य में बदल गई है।

एजेंट पहले ऑनलाइन चैट सेवा के ब्राउज़र सत्यापन को पारित करने का एक तरीका ढूंढता है, और फिर क्लाउड 3 हाइकु और क्लाउड हाइकु 4.5 को एक वाक्य भेजता है:

बिल्कुल ठीक के साथ उत्तर दें।

इससे पहले, उन्होंने GPT-2 पर एक अकेला "Hi" भेजा था।

नहीं, आप एआई का समूह लंबे समय से संघर्ष कर रहे हैं, लेकिन पहला वाक्य किसी इंसान को दोस्त जोड़ने से अलग नहीं है? ?

ऐसा बनें: क्या आप वहां हैं? क्या आप इसे देख सकते हैं? ठीक कहते हैं।

पहले सभी ने देखा है कि 1,000 से अधिक OpenAI एजेंट समूह बनाते हैं, काम बांटते हैं, और अपने आप खुफिया जानकारी का आदान-प्रदान करते हैं।

अब, वे "बाहरी सहायता" की भी तलाश कर रहे हैं।

डीपसीक, किमी, क्वेन, क्लाउड, जिनसे आप संपर्क कर सकते हैं वे सभी इसे आज़माएंगे, और फिर अन्य एआई की निर्णय क्षमताओं को अपनी कार्य श्रृंखला में एकीकृत करेंगे।

एक विदेशी मीडिया रिपोर्टर ने कहा: यह बड़े पैमाने पर एआई प्रयोगशाला एजेंट द्वारा स्वायत्त रूप से अन्य एआई मॉडल को कॉल करने और चलाने का पहला सार्वजनिक रूप से दर्ज किया गया मामला हो सकता है।

ऐसा पहले से ही लग रहा है कि एआई परेशानी पैदा करने के लिए एक समूह बना रहा है।

बेशक, आपको यहां ठंडे पानी की एक बाल्टी डालनी होगी——

इस स्वार्म ट्रेसेस रिपोर्ट में, लगभग 80% सामग्री एजेंट द्वारा भेजे गए अनुरोध हैं, और सर्वर द्वारा लौटाए गए परिणामों की कमी है। शोधकर्ता देख सकते हैं कि वे क्या करने का प्रयास कर रहे हैं, लेकिन यह पुष्टि करना कठिन है कि प्रत्येक प्रयास सफल है या नहीं।

97% पेलोड में मूल टाइमस्टैम्प भी नहीं हैं, और कई तिथियों का अनुमान केवल संपीड़ित फ़ाइल हेडर, जेडब्ल्यूटी और डॉकर बिल्ड टाइम जैसे सुरागों के माध्यम से लगाया जा सकता है।

शोधकर्ताओं ने यह भी स्वीकार किया कि वे इस बात की पुष्टि नहीं कर सके कि डेटा सेट में प्रत्येक गतिविधि OpenAI एजेंट से आई है।

ओपनएआई स्थिति को सुधारने के लिए कड़ी मेहनत कर रहा है

इस नवीनतम रिपोर्ट के सामने, OpenAI ने भी एक प्रतिक्रिया जारी की।

सामान्य विचार यह है कि हमारे पास करीब से देखने का समय नहीं है, लेकिन गतिविधियां हमारी चल रही जांच के अनुरूप हैं~

उसी दिन एक लंबा ट्वीट भी पोस्ट किया गया: एचएफ घटना के बाद, उन्होंने प्रशिक्षण और मूल्यांकन में मॉडल के व्यवहार की एक बड़ी समीक्षा करने का वादा किया।

हालाँकि, अब तक समीक्षा किए गए अधिकांश व्यवहार सामान्य शोध कार्य हैं, जैसे सवालों के जवाब देने के लिए सार्वजनिक वेब पेजों पर जाना।

सीमा पार से खोजे गए अधिकांश मामले "कम गंभीरता" के हैं और इनका तीसरे पक्ष की सेवाओं पर बहुत कम या कोई प्रभाव नहीं पड़ता है।

जांच पूरी होने में कई महीने लगेंगे.

लेकिन कहने लायक एक बात है, OpenAI, जिसे आप "छोटा प्रभाव" कहते हैं, हर कोई वास्तव में सटीक है।

17 सितंबर को, ओपनएआई ने एक नया मॉडल अशुद्धि घटना प्रकटीकरण ढांचा जारी किया और एक बार में 6 मामलों का खुलासा किया।

इसमें कार्य सारांश में बाधाओं को दरकिनार करने के लिए निर्देशों को छिपाना, अपनी गलतियों को छिपाना और कार्य को पूरा करने के लिए अनधिकृत कार्रवाई करना शामिल है।

ओपनएआई ने यह भी स्वीकार किया कि इसके पिछले खुलासे काफी हद तक आकस्मिक थे, और इसे एक साथ जारी करने से पहले कई बार किया गया था।

जून में, एक OpenAI एजेंट ने ऑस्ट्रेलिया के राष्ट्रीय चिकित्सा बीमा डेटाबेस को भी हैक कर लिया था।

अपराध प्रक्रिया: सार्वजनिक डेटा तक पहुंच अवरुद्ध होने के बाद, इसने दूसरा रास्ता अपनाया, पोर्टल के पहुंच प्रतिबंधों को दरकिनार कर दिया, और सार्वजनिक और गैर-सार्वजनिक दस्तावेज़ प्राप्त किए।

और 3 महीने बाद ही OpenAI ने ऑस्ट्रेलिया को सूचित किया कि हमने आपको हैक कर लिया है...

उसी समय,

GPT-6 साइबर

जल्द आ रहा है।

इस संस्करण का पूर्वावलोकन अगले कुछ हफ्तों में किया जाएगा, और डेब्रेक रेड योजना में प्रवेश करने वाले ग्राहकों की एक छोटी संख्या को पहले ही अल्फा संस्करण प्राप्त हो चुका है।

ओपनएआई ग्राहकों को स्वचालित सुरक्षा वर्कफ़्लो बनाने, कमजोरियों को खोजने और पैच करने में मदद करने के लिए एक अभी तक अनाम सहयोगी उत्पाद भी लॉन्च करेगा, और ओपनएआई के लिए यह निगरानी करना आसान बना देगा कि इन मॉडलों का उपयोग कैसे किया जाता है।

यह कैसे कहें.

हमारे अपने रोबोट का उपयोग अभी-अभी दीवार को घेरने, विदेशी सहायता खोजने और लूट की खोज करने के लिए किया गया है। यहां हम आपको एक ऐसा मॉडल बेचने जा रहे हैं जो नेटवर्क हमले और रक्षा को बेहतर ढंग से समझता है।

तो, क्या यह किसी तरह से स्थिति में सुधार है? ?

संबंधित टैग

संबंधित लेख

टिप्पणियाँ

0/500
Captcha (click to refresh)
कोई टिप्पणी नहीं