सार:
एंथ्रोपिक, एक अमेरिकी कृत्रिम बुद्धिमत्ता कंपनी, ने हाल ही में एक खतरे की खुफिया रिपोर्ट जारी की, जिसमें अलीबाबा, मूनशॉट एआई, डीपसीक, श्याओमी और कई अन्य चीनी एआई प्रयोगशालाओं सहित संस्थानों पर क्लाउड को बड़े पैमाने पर कॉल के माध्यम से अपनी मॉडल क्षमताओं को निकालने और उत्पन्न परिणामों का उपयोग अपने स्वयं के कृत्रिम बुद्धि मॉडल को प्रशिक्षित करने और सुधारने के लिए करने का आरोप लगाया गया। एंथ्रोपिक इस व्यवहार को अनधिकृत "आसवन हमला" कहते हैं।

तथाकथित मॉडल आसवन का तात्पर्य बड़ी संख्या में उत्तर उत्पन्न करने के लिए मजबूत क्षमताओं और बड़े पैमाने वाले मॉडल का उपयोग करना है, और फिर कम लागत, छोटे पैमाने या कमजोर क्षमताओं वाले मॉडल को प्रशिक्षित करने के लिए प्रशिक्षण डेटा के रूप में इन आउटपुट का उपयोग करना है। एआई कंपनियों के लिए, यह एक तकनीकी मार्ग है जो प्रशिक्षण लागत को कम कर सकता है और मॉडल क्षमताओं में तेजी से सुधार कर सकता है। हालाँकि, एंथ्रोपिक का मानना है कि इस बार खोजे गए कुछ व्यवहार सामान्य मॉडल आसवन के दायरे से परे चले गए हैं और उनके व्यवसाय मॉडल क्षमताओं के संगठित और बड़े पैमाने पर निष्कर्षण से संबंधित हैं।
एंथ्रोपिक ने कहा कि मई और जुलाई 2026 के बीच, अलीबाबा से संबंधित संचालन ने क्लाउड के साथ 151 मिलियन से अधिक इंटरैक्शन उत्पन्न किए, जिससे यह कंपनी द्वारा अब तक खोजा गया सबसे बड़ा अवैध आसवन ऑपरेशन बन गया। प्रासंगिक परिचालनों में 3,500 से अधिक खातों का उपयोग किया गया था जिन्हें एंथ्रोपिक ने धोखाधड़ी के रूप में पहचाना था, और प्रति दिन इंटरैक्शन की उच्चतम संख्या लगभग 3 मिलियन थी।
एंथ्रोपिक का मानना है कि इन खातों का उपयोग मुख्य रूप से क्लाउड से लगातार बड़ी संख्या में प्रश्न पूछने और मॉडल के उत्तर और अधिक विस्तृत तर्क प्रक्रियाओं को प्राप्त करने के लिए किया जाता है, और फिर इस जानकारी का उपयोग अलीबाबा के टोंगी कियानवेन श्रृंखला के मॉडल को बेहतर बनाने के लिए किया जाता है।
मॉडल डेवलपर्स के लिए, अनुमान प्रक्रिया विशेष रूप से मूल्यवान है। केवल अंतिम उत्तर प्राप्त करने की तुलना में, विस्तृत अनुमान रिकॉर्ड प्रशिक्षक को दिखा सकते हैं कि मॉडल ने समस्या का विश्लेषण कैसे किया, कार्य को कैसे विघटित किया जाए और अंतिम निष्कर्ष पर कैसे पहुंचा जाए, और इसलिए उन्नत अनुमान मॉडल के प्रशिक्षण के लिए महत्वपूर्ण डेटा बन सकता है।

एंथ्रोपिक ने किमी के विकासकर्ता डार्क साइड ऑफ द मून एआई को भी नामित किया है। रिपोर्ट में कहा गया है कि मई और जुलाई 2026 के बीच, डार्क साइड ऑफ द मून से संबंधित खातों में क्लाउड के साथ 23 मिलियन से अधिक इंटरैक्शन हुए।
अधिक उल्लेखनीय बात यह है कि एंथ्रोपिक ने डार्क साइड ऑफ़ द मून पर न केवल मॉडल आसवन के लिए क्लाउड का उपयोग करने का आरोप लगाया, बल्कि किमी उपयोगकर्ताओं से प्रसंस्करण के लिए क्लाउड को वास्तविक अनुरोध भी अग्रेषित किया।
एंथ्रोपिक ने कहा कि 10-दिन की अवधि में से एक के दौरान, डार्क साइड ऑफ द मून ने 5,380 खातों वाले खाता नेटवर्क के माध्यम से किमी को मूल रूप से सबमिट किए गए लगभग 300,000 उपयोगकर्ता अनुरोधों को क्लाउड में स्थानांतरित कर दिया, जिनमें से अधिकांश अनुरोध क्लाउड ओपस श्रृंखला के मॉडलों को भेजे गए थे। एंथ्रोपिक का मानना है कि ये खाते ज्यादातर सिंगापुर और जापान में स्थित हैं और अनुरोधों के वास्तविक स्रोत को छिपाने के लिए उपयोग किए जाते हैं।
इसका मतलब यह है कि कुछ मामलों में, किमी उपयोगकर्ताओं को लगता है कि वे चंद्रमा के अपने मॉडल के डार्क साइड के साथ बातचीत कर रहे हैं, लेकिन वास्तव में अनुरोध प्रसंस्करण के लिए एंथ्रोपिक के क्लाउड को भेजा जा सकता है। एंथ्रोपिक ने यह भी कहा कि डार्क साइड ऑफ़ द मून ने कुछ इंटरैक्टिव सामग्री को सहेजा और क्लाउड के तर्क रिकॉर्ड को प्रशिक्षण डेटा के रूप में निकाला।
इससे भी अधिक चिंता की बात यह है कि ये अग्रेषित अनुरोध केवल सामान्य चैट सामग्री नहीं हैं। एंथ्रोपिक ने कहा कि कुछ अनुरोधों में संवेदनशील जानकारी शामिल थी, और उपयोगकर्ताओं को यह पता नहीं होगा कि उनका डेटा वास्तव में किसी अन्य एआई कंपनी के मॉडल पर भेजा जा रहा था।

रिपोर्ट में किमी से जुड़े एक मामले का हवाला दिया गया है। एक उपयोगकर्ता ने किमी से किसी व्यक्ति के व्यवहार को निर्धारित करने के लिए चेंगदू, चीन से बड़ी संख्या में निगरानी कैमरे के फुटेज का विश्लेषण करने के लिए कहा। एंथ्रोपिक के अनुसार, वीडियो डेटा को अंततः प्रसंस्करण के लिए क्लाउड में स्थानांतरित कर दिया गया था, और उपयोगकर्ताओं को मूल रूप से विश्वास था कि डेटा का विश्लेषण किमी के भीतर किया गया था।
एंथ्रोपिक ने यह भी पाया कि कुछ उपयोगकर्ताओं द्वारा किमी को सबमिट की गई कुछ सामग्री में कॉर्पोरेट लॉगिन क्रेडेंशियल जैसी संवेदनशील जानकारी शामिल थी। एक मामले में, एक इंजीनियर ने एक चीनी कंपनी को सॉफ्टवेयर विकसित करने में मदद करने के लिए किमी का उपयोग करने के लिए कई कंपनियों के लॉगिन क्रेडेंशियल किमी को जमा किए, और प्रासंगिक जानकारी बाद में क्लाउड को स्थानांतरित कर दी गई।
एंथ्रोपिक ने कहा कि उपयोगकर्ताओं को स्पष्ट रूप से पता नहीं है कि उनके अनुरोध एंथ्रोपिक के मॉडल को अग्रेषित किए जाएंगे, इसलिए मॉडल आसवन मुद्दों को शामिल करने के अलावा, यह दृष्टिकोण गंभीर गोपनीयता और डेटा सुरक्षा जोखिम भी पैदा कर सकता है।
एंथ्रोपिक ने डीपसीक पर भी इसी तरह का दृष्टिकोण अपनाने का आरोप लगाया था। रिपोर्ट में कहा गया है कि डीपसीक ने जुलाई 2026 में 14 दिनों की अवधि के दौरान 12 मिलियन से अधिक क्लाउड-संबंधित आसवन इंटरैक्शन का संचालन किया था।
एंथ्रोपिक का मानना है कि डीपसीक ने उपयोगकर्ताओं के वास्तविक अनुरोधों को भी क्लाउड तक भेजा, और इन अनुरोधों की कुछ सामग्री में संवेदनशील जानकारी शामिल थी। क्लाउड के उत्तरों का उपयोग डीपसीक के अपने मॉडलों को प्रशिक्षित करने और सुधारने के लिए किया गया।
अलीबाबा, डार्क साइड ऑफ़ द मून और डीपसीक के अलावा, एंथ्रोपिक ने ज़ीपु और श्याओमी जैसी चीनी एआई कंपनियों का भी नाम लिया। रिपोर्ट के मुताबिक, Xiaomi ने यूजर्स और अपने MiMo मॉडल के बीच हुई बातचीत को रिकॉर्ड किया और मॉडल ट्रेनिंग के लिए डेटा तैयार करने के लिए इन बातचीत को क्लाउड को सौंप दिया।
एंथ्रोपिक ने कहा कि उसकी रिपोर्ट में शामिल समय सीमा के दौरान, कुल सात चीनी एआई प्रयोगशालाओं ने क्लाउड को लक्षित करते हुए मॉडल आसवन गतिविधियों को लागू किया था। सभी संबंधित गतिविधियाँ बिल्कुल समान पद्धति का उपयोग नहीं करती हैं, लेकिन सामान्य विशेषता यह है कि वे क्लाउड के आउटपुट की एक बड़ी मात्रा प्राप्त करने का प्रयास करते हैं, इसकी मॉडल क्षमताओं को सीखते हैं, और इस जानकारी का उपयोग अपने स्वयं के एआई सिस्टम के प्रशिक्षण के लिए करते हैं।
एंथ्रोपिक का मानना है कि ये गतिविधियां तेजी से संगठित और बड़े पैमाने पर हो गई हैं। सामान्य डेवलपर्स के विपरीत, जो कभी-कभी परीक्षण के लिए अन्य एआई मॉडल को बुलाते हैं, ये ऑपरेशन अपनी वास्तविक पहचान छिपाने और औद्योगिक पैमाने पर लगातार मॉडल इंटरैक्शन उत्पन्न करने के लिए बड़ी संख्या में खातों, एजेंटों और मध्यवर्ती प्लेटफार्मों का उपयोग करते हैं।

उनमें से, अलीबाबा से संबंधित गतिविधियों ने विशेष ध्यान आकर्षित किया है। 151 मिलियन से अधिक इंटरैक्शन का मतलब था कि ऑपरेशन एक साधारण प्रायोगिक परीक्षण नहीं था, बल्कि एक बड़े पैमाने पर डेटा अधिग्रहण ऑपरेशन था जो कई महीनों तक चला। एंथ्रोपिक का मानना है कि इन डेटा का उपयोग मुख्य रूप से अलीबाबा के टोंगयी कियानवेन मॉडल को प्रशिक्षित करने और बेहतर बनाने में मदद के लिए किया जाता है।
डार्क साइड ऑफ़ द मून और डीपसीक के लिए, समस्या अधिक जटिल है, क्योंकि एंथ्रोपिक ने उन पर न केवल क्लाउड से प्रशिक्षण डेटा प्राप्त करने का आरोप लगाया है, बल्कि अपने स्वयं के उपयोगकर्ता अनुरोधों को प्रतिस्पर्धी मॉडलों को अग्रेषित करने का भी आरोप लगाया है। इसका मतलब यह है कि उपयोगकर्ताओं द्वारा एक एआई कंपनी को सबमिट की गई सामग्री बिना किसी स्पष्ट सूचना के किसी अन्य एआई कंपनी के सिस्टम में प्रवेश कर सकती है।
एंथ्रोपिक ने कहा कि उसने इन गतिविधियों को रोकने के लिए कदम उठाए हैं, जिसमें प्रासंगिक खातों पर प्रतिबंध लगाना, पहचान सत्यापन को कड़ा करना और विस्तृत तर्क प्रस्तुत करने की क्लाउड की क्षमता को और सीमित करना शामिल है। चूंकि विस्तृत अनुमान रिकॉर्ड मॉडल आसवन के लिए अत्यधिक मूल्यवान हैं, इस सामग्री के आउटपुट को कम करने से बड़ी संख्या में स्वचालित अनुरोधों के माध्यम से क्लाउड की क्षमताओं की नकल करने वाले प्रतिस्पर्धियों की दक्षता कम हो सकती है।
एंथ्रोपिक ने यह भी कहा कि कंपनी उन देशों या क्षेत्रों के उपयोगकर्ताओं के लिए पहचान सत्यापन उपायों को मजबूत करेगी जहां क्लाउड वर्तमान में चीन, रूस और ईरान जैसी आधिकारिक सेवाएं प्रदान नहीं करता है, लेकिन जिन पर प्रतिबंधों को दरकिनार करने और क्लाउड तक पहुंचने की कोशिश करने का संदेह है।




यह रिपोर्ट पहली बार नहीं है जब एंथ्रोपिक ने सार्वजनिक रूप से चीनी एआई कंपनियों पर मॉडल डिस्टिलेशन का आरोप लगाया है। इस साल जून में, एंथ्रोपिक नीति निदेशक सारा हेक ने अमेरिकी कांग्रेसियों को लिखा, जिसमें कहा गया कि अलीबाबा ने 22 अप्रैल से 5 जून के बीच क्लाउड के साथ लगभग 28.8 मिलियन इंटरैक्शन किए थे, और उनका मानना था कि इन इंटरैक्शन का उपयोग अनधिकृत मॉडल आसवन के लिए किया गया था।
इस नवीनतम रिपोर्ट से पता चलता है कि एंथ्रोपिक का मानना है कि भविष्य में संबंधित गतिविधियों के पैमाने का और विस्तार होगा। अकेले अलीबाबा पर मई और जुलाई के बीच 151 मिलियन से अधिक इंटरैक्शन हुए, जो पहले बताए गए आंकड़ों से कहीं अधिक है।
उसी समय, यह घटना चीन और संयुक्त राज्य अमेरिका के बीच बढ़ती भयंकर एआई प्रतिस्पर्धा की पृष्ठभूमि में हुई। हाल के वर्षों में, चीनी एआई कंपनियों ने अपेक्षाकृत कम प्रशिक्षण और अनुमान लागत के साथ अपनी मॉडल क्षमताओं में तेजी से सुधार किया है। डीपसीक, किमी और टोंगयी कियानवेन जैसे उत्पाद वैश्विक एआई उद्योग में महत्वपूर्ण खिलाड़ी बन गए हैं। अमेरिकी एआई कंपनियों के पास क्लाउड और जीपीटी श्रृंखला सहित उन्नत बुनियादी मॉडल हैं।

मॉडल आसवन स्वयं कोई अवैध या अनुचित तकनीक नहीं है। एआई डेवलपर्स प्राधिकरण के साथ अपने स्वयं के मॉडल को प्रशिक्षित करने के लिए शिक्षक मॉडल द्वारा उत्पन्न डेटा का उपयोग कर सकते हैं। हालाँकि, एंथ्रोपिक का मानना है कि इसमें शामिल ऑपरेशन एक गंभीर समस्या है क्योंकि संबंधित कंपनियों पर बड़ी संख्या में नकली खातों, एजेंसी प्लेटफार्मों और छिपे हुए डेटा अग्रेषण तंत्रों के माध्यम से एंथ्रोपिक के प्राधिकरण के बिना व्यवस्थित रूप से क्लाउड की क्षमताओं को प्राप्त करने का आरोप है।
अधिक महत्वपूर्ण बात यह है कि एंथ्रोपिक का मानना है कि कुछ कार्रवाइयों ने उपयोगकर्ता डेटा सुरक्षा मुद्दों को छुआ है। जो उपयोगकर्ता सामान्य रूप से एआई सेवाओं का उपयोग करते हैं, वे आमतौर पर सोचते हैं कि किमी और डीपसीक जैसे प्लेटफार्मों पर वे जो डेटा जमा करेंगे, उसे इन प्लेटफार्मों की गोपनीयता नीतियों के अनुसार संसाधित किया जाएगा। यदि प्लेटफ़ॉर्म वास्तव में इन अनुरोधों को किसी तृतीय-पक्ष मॉडल को अग्रेषित करता है, तो उपयोगकर्ताओं को यह नहीं पता होगा कि उनका डेटा किसी अन्य कंपनी के सिस्टम में प्रवेश कर चुका है।




रिपोर्ट के समय तक, अलीबाबा, डार्क साइड ऑफ़ द मून, डीपसीक, श्याओमी और एंथ्रोपिक ने टिप्पणी के अनुरोधों का तुरंत जवाब नहीं दिया। चीनी विदेश मंत्रालय ने कहा कि उसे एंथ्रोपिक द्वारा जारी रिपोर्ट की जानकारी नहीं है, और दोहराया कि चीनी सरकार का मानना है कि कृत्रिम बुद्धिमत्ता का उपयोग मानव जाति के लाभ के लिए किया जाना चाहिए, और वह तथ्यों को विकृत करने और चीन को बदनाम करने का विरोध करती है।


एंथ्रोपिक द्वारा प्रकट की गई घटना ने एआई उद्योग में लंबे समय से चले आ रहे मॉडल डिस्टिलेशन विवाद को भी फिर से सामने ला दिया है। उन्नत बुनियादी मॉडल वाली कंपनियों के लिए, स्वचालन और बड़े पैमाने पर कॉल के माध्यम से प्रतिस्पर्धियों को मॉडल क्षमताओं को प्राप्त करने से कैसे रोका जाए, यह व्यवसाय और सुरक्षा क्षेत्र में एक महत्वपूर्ण मुद्दा बन गया है। एआई एप्लिकेशन कंपनियों के लिए, उपयोगकर्ता डेटा को कैसे संभालना है और क्या उपयोगकर्ताओं को स्पष्ट रूप से सूचित किया जाना चाहिए कि अनुरोध तीसरे पक्ष के मॉडल को भेजे जा रहे हैं, यह भी भविष्य के नियामक ध्यान का केंद्र बन सकता है।
उद्योग प्रतिस्पर्धा के नजरिए से, एंथ्रोपिक द्वारा जारी आंकड़े विशेष रूप से उल्लेखनीय हैं। 151 मिलियन से अधिक अलीबाबा-संबंधित इंटरैक्शन, 23 मिलियन से अधिक डार्क साइड ऑफ़ द मून-संबंधित इंटरैक्शन और 12 मिलियन से अधिक डीपसीक-संबंधित इंटरैक्शन से पता चलता है कि उन्नत एआई मॉडल के बीच प्रतिस्पर्धा अब केवल पारंपरिक अर्थों में एल्गोरिदम और चिप्स के बारे में नहीं है, बल्कि प्रशिक्षण डेटा, मॉडल क्षमता अधिग्रहण और मॉडल आसवन जैसे क्षेत्रों तक बढ़ रही है।
जैसे-जैसे विभिन्न एआई मॉडलों के बीच क्षमता अंतर कम होता जा रहा है, सार्वजनिक प्रौद्योगिकी के कानूनी उपयोग, सामान्य मॉडल आसवन और अनधिकृत बड़े पैमाने पर क्षमता दोहराव के बीच एक स्पष्ट रेखा कैसे खींची जाए, यह एक कठिन समस्या बन जाएगी जिसका वैश्विक एआई उद्योग को भविष्य में सामना करना होगा।
टिप्पणियाँ