सार:
मॉडल क्षमताओं में सुधार के अलावा, एंथ्रोपिक के नवीनतम क्लाउड ओपस 5.5 में अत्याधुनिक बड़े भाषा मॉडल विकास परिदृश्यों के लिए एक विशेष प्रतिबंध तंत्र भी जोड़ा गया है। जब उपयोगकर्ता नई पीढ़ी के एआई मॉडल के लिए अंतर्निहित कर्नेल विकसित करने के लिए ओपस 5.5 का उपयोग करते हैं, तो सिस्टम सीधे नवीनतम ओपस 5.5 का उपयोग नहीं कर सकता है, लेकिन स्वचालित रूप से कम क्षमताओं के साथ ओपस 5 पर वापस आ जाता है। अधिक उल्लेखनीय बात यह है कि वर्तमान में यह पता चला है कि प्रतिबंधों का यह सेट हुआवेई और अमेज़ॅन के कुछ एआई एक्सेलेरेटर को लक्षित करता है।

एंथ्रोपिक ने ओपस 5.5 समर्थन दस्तावेज़ में बताया कि मॉडल में "अत्याधुनिक एलएलएम विकास" के लिए एक समर्पित क्लासिफायरियर है और सीमित कार्यों को कवर करता है, जैसे कुछ मशीन लर्निंग एक्सेलेरेटर के लिए कर्नेल विकास। इस प्रकार के क्लासिफायरियर का उद्देश्य यह निर्धारित करना है कि उपयोगकर्ता के वर्तमान अनुरोध में अत्याधुनिक बड़े भाषा मॉडल का विकास शामिल है या नहीं। एक बार प्रासंगिक स्थितियाँ शुरू हो जाने पर, क्लाउड स्वचालित रूप से ओपस 5.5 से ओपस 5 पर वापस आ जाएगा।
तथाकथित एआई कोर कृत्रिम बुद्धिमत्ता मॉडल चलाते समय निम्नतम स्तर पर कंप्यूटिंग संचालन की एक श्रृंखला को संदर्भित करता है। कर्नेल यह तय करने के लिए जिम्मेदार है कि मॉडल चिप पर कंप्यूटिंग संसाधनों और मेमोरी का उपयोग कैसे करता है और विभिन्न गणितीय संचालन कैसे करता है। क्योंकि ये ऑपरेशन सीधे यह निर्धारित करते हैं कि गणितीय गणनाओं को वास्तविक प्रोसेसर पर कैसे मैप किया जाता है, कर्नेल डिज़ाइन सीधे बड़े भाषा मॉडल की चलने की गति, मेमोरी उपयोग, सटीकता और अनुमान लागत को प्रभावित करता है। सबसे उन्नत एआई मॉडल को प्रशिक्षित करने और चलाने के लिए, विशिष्ट एआई त्वरक के लिए कर्नेल अनुकूलन अक्सर एक महत्वपूर्ण कदम होता है।
ओपस 5.5 की आधिकारिक रिलीज़ के बाद उपयोगकर्ताओं द्वारा इस सीमा को पहली बार समर्थन दस्तावेज़ में खोजा गया था। एंथ्रोपिक ने पहले संभावित जोखिम भरे अनुरोधों की पहचान करने के लिए कुछ मॉडलों में क्लासिफायर का उपयोग किया है, और इस बार इसने अत्याधुनिक एआई मॉडल के विकास के लिए इसी तरह के तंत्र को लागू किया है।
एंथ्रोपिक ने स्पष्ट किया कि ये प्रतिबंध पारंपरिक कृत्रिम बुद्धिमत्ता, मशीन लर्निंग अनुसंधान और सामान्य प्रोग्रामिंग कार्यों के विशाल बहुमत को प्रभावित नहीं करेंगे। केवल जब कम संख्या में अत्याधुनिक एलएलएम विकास क्षमताएं शामिल होती हैं, तो सिस्टम रोलबैक तंत्र को ट्रिगर कर सकता है। इसलिए, सामान्य डेवलपर्स के लिए, दैनिक प्रोग्रामिंग, एआई एप्लिकेशन डेवलपमेंट और मशीन लर्निंग रिसर्च में ओपस 5.5 का उपयोग मूल रूप से प्रभावित नहीं होगा।
लेकिन आगे के परीक्षण के बाद, कुछ उपयोगकर्ताओं ने पाया कि ओपस 5.5 विशेष रूप से कुछ एआई चिप्स को पहचानता है। वर्तमान सार्वजनिक परीक्षण परिणामों के अनुसार, क्लासिफायर के इस सेट में कम से कम Huawei की Ascend 950DT और Amazon की स्व-विकसित ट्रेनियम 3 AI चिप शामिल है। जैसा कि कहा गया है, यदि डेवलपर्स इन चिप्स के लिए अत्याधुनिक बड़े भाषा मॉडल के लिए अंतर्निहित कर्नेल विकसित करने के लिए ओपस 5.5 का उपयोग करते हैं, तो मॉडल स्वचालित रूप से ओपस 5 पर स्विच हो सकते हैं।
यह आश्चर्य की बात नहीं है कि Huawei चिप्स को इस प्रतिबंध में शामिल किया गया है। एंथ्रोपिक ने हाल के वर्षों में अपने मॉडल प्राप्त करने के लिए चीनी संस्थाओं की क्षमता के खिलाफ अपनी चौकसी बढ़ा दी है और मॉडल डिस्टिलेशन को एक महत्वपूर्ण सुरक्षा और राष्ट्रीय सुरक्षा मुद्दे के रूप में देखा है। तथाकथित मॉडल आसवन का तात्पर्य अधिक सक्षम मॉडल को बड़ी मात्रा में कॉल करना, उसके व्यवहार और क्षमता विशेषताओं को निकालना और फिर किसी अन्य मॉडल को प्रशिक्षित करने के लिए इस डेटा का उपयोग करना है। एंथ्रोपिक की हालिया खतरा खुफिया रिपोर्ट से पता चला है कि कंपनी ने पाया कि चीन से संबंधित कई संगठनों ने क्लाउड के ओपस श्रृंखला मॉडल के खिलाफ अनधिकृत आसवन गतिविधियों को अंजाम दिया, और इसलिए खाता पहचान, अनुरोध अवरोधन और अनुमान प्रक्रिया सुरक्षा तंत्र को और मजबूत किया।
एंथ्रोपिक ने ओपस 5.5 में सख्त आसवन-विरोधी उपाय भी जोड़े हैं, जिसमें एपीआई उपयोगकर्ताओं को मॉडल के पिछले वार्तालाप संदर्भ को संशोधित करने से प्रतिबंधित करना शामिल है ताकि संदर्भ में बार-बार हेरफेर करके मॉडल की आंतरिक तर्क जानकारी निकालने से बचा जा सके। कंपनी ने कहा कि इस तरह के उपाय मुख्य रूप से सामान्य उपयोगकर्ताओं द्वारा सामान्य उपयोग के बजाय बड़े पैमाने पर, औद्योगिक क्षमता निष्कर्षण गतिविधियों पर लक्षित हैं।
इसलिए, जब ओपस 5.5 हुआवेई के एआई एक्सेलेरेटर से जुड़े अत्याधुनिक मॉडल विकास अनुरोधों का पता लगाता है, तो प्रतिबंध तंत्र में स्पष्ट तकनीकी और भौगोलिक पृष्ठभूमि हो सकती है। हालाँकि, यह दिखाने के लिए वर्तमान में अपर्याप्त सबूत हैं कि क्या एंथ्रोपिक ने नियमों के इस सेट को विशेष रूप से हुआवेई के लिए डिज़ाइन किया है, या क्या इसमें प्रतिबंधों के दायरे में विशिष्ट प्रकार के एआई त्वरक शामिल हैं।
वास्तव में आश्चर्य की बात यह है कि अमेज़ॅन ट्रेनियम 3 भी उसी तरह प्रभावित होता दिख रहा है।
अमेज़ॅन न केवल एक बड़ी वैश्विक क्लाउड कंप्यूटिंग कंपनी है, बल्कि एंथ्रोपिक का एक महत्वपूर्ण भागीदार और निवेशक भी है। एंथ्रोपिक का क्लाउड मॉडल स्वयं अमेज़ॅन वेब सेवाओं के माध्यम से एंटरप्राइज़ ग्राहकों को प्रदान किया जाता है, जबकि ट्रेनियम श्रृंखला एक एआई प्रशिक्षण और अनुमान चिप है जिसे एनवीडिया जीपीयू पर क्लाउड आर्टिफिशियल इंटेलिजेंस कंप्यूटिंग की निर्भरता को कम करने के लिए अमेज़ॅन द्वारा स्वतंत्र रूप से विकसित किया गया है। इसलिए, यदि ओपस 5.5 अत्याधुनिक मॉडल कर्नेल विकास के लिए ट्रेनियम3 को प्रतिबंधित करता है, तो अमेज़ॅन इसके बजाय हुआवेई के समान तकनीकी प्रतिबंधों से प्रभावित हो सकता है।
यह स्पष्ट नहीं है कि क्या यह स्थिति एंथ्रोपिक द्वारा जानबूझकर की गई थी, या क्या क्लासिफायर ने एक विशिष्ट एआई चिप की पहचान करते समय अप्रत्याशित गलत निर्णय लिया था। प्रासंगिक परीक्षणों से पता चलता है कि ओपस 5.5 विभिन्न हार्डवेयर प्लेटफार्मों की पहचान करने और अनुरोध सामग्री के आधार पर नवीनतम मॉडल को अनुमति देने का निर्णय लेने में सक्षम प्रतीत होता है, लेकिन एंथ्रोपिक ने सार्वजनिक रूप से यह नहीं बताया कि ट्रेनियम3 हुआवेई 950डीटी के साथ ही प्रतिबंध क्यों लागू करेगा।
यह स्थिति विशेष रूप से उल्लेखनीय है क्योंकि एंथ्रोपिक ने पहले इस बात पर जोर दिया है कि इसके मॉडल को AWS जैसे क्लाउड प्लेटफ़ॉर्म के माध्यम से व्यापक रूप से प्रदान किया जा सकता है, और Opus 5.5 आधिकारिक तौर पर Amazon Web Services, Google Cloud और Microsoft Azure जैसे प्लेटफ़ॉर्म पर आ गया है। यदि यह सीमा भविष्य में उन्नत मॉडलों के प्रशिक्षण के लिए अधिक एआई त्वरक तक फैली हुई है, तो क्लाउड कंप्यूटिंग कंपनियों और एआई मॉडल कंपनियों के बीच साझेदारी को मॉडल क्षमताओं, हार्डवेयर समर्थन और सुरक्षा बाधाओं के बीच अधिक जटिल समन्वय की आवश्यकता हो सकती है।
तकनीकी दृष्टिकोण से, एंथ्रोपिक का दृष्टिकोण इस बार एक नई प्रवृत्ति को भी दर्शाता है: चूंकि एआई मॉडल स्वयं मनुष्यों को अगली पीढ़ी के एआई मॉडल को डिजाइन और अनुकूलित करने में मदद करना शुरू कर देता है, मॉडल निर्माताओं को दो प्रकार के कार्यों के बीच अंतर करना शुरू करना होगा: "एप्लिकेशन विकसित करने के लिए एआई का उपयोग करना" और "मजबूत एआई विकसित करने के लिए एआई का उपयोग करना"।
सामान्य प्रोग्रामर के लिए, ओपस 5.5 को एप्लिकेशन लिखने, डिबग कोड, या मशीन लर्निंग प्रयोगों का संचालन करने में मदद करने से आमतौर पर विशेष प्रतिबंध नहीं लगते हैं। लेकिन अगर उसी मॉडल का उपयोग अगली पीढ़ी के अत्याधुनिक बड़े भाषा मॉडल के अंतर्निहित कंप्यूटिंग कोर को विकसित करने के लिए किया जाता है, तो एंथ्रोपिक इसे एक और जोखिम स्तर में प्रवेश कर सकता है और अनुरोध स्वचालित रूप से पुराने मॉडल पर वापस आ सकता है।
इसका मतलब है कि AI मॉडल खुद धीरे-धीरे AI R&D इंफ्रास्ट्रक्चर का हिस्सा बनता जा रहा है। अतीत में, मॉडलों के उपयोग को प्रतिबंधित करने का मतलब मुख्य रूप से कुछ खतरनाक सामग्री या संवेदनशील क्षेत्रों को प्रतिबंधित करना था; अब, मॉडल निर्माता ऐसे मुद्दों पर विचार करना शुरू कर रहे हैं जैसे "अगली पीढ़ी के मॉडल बनाने के लिए नवीनतम मॉडल का उपयोग कौन कर सकता है" और "क्या नवीनतम मॉडल को प्रतिस्पर्धियों को अपने स्वयं के एआई कंप्यूटिंग बुनियादी ढांचे को अनुकूलित करने में मदद करनी चाहिए।"
वर्तमान में, एंथ्रोपिक ने सार्वजनिक रूप से यह नहीं बताया है कि ट्रेनियम3 हुआवेई 950डीटी के साथ ही प्रतिबंध क्यों लागू करता है, न ही यह स्पष्ट किया गया है कि यह तंत्र भविष्य के संस्करणों में मौजूद रहेगा या नहीं। जैसे-जैसे अधिक से अधिक कंपनियां अपने स्वयं के एआई त्वरक विकसित करना शुरू करती हैं, विशिष्ट हार्डवेयर और अत्याधुनिक मॉडल विकास कार्यों पर यह सीमा एक नई समस्या बनने की संभावना है, जिसका सामना एआई मॉडल निर्माताओं को सुरक्षा, क्षमता आसवन की रोकथाम और हार्डवेयर पारिस्थितिकी के बीच व्यापार-बंद करते समय करना होगा।
टिप्पणियाँ