सार:
मस्क की कृत्रिम बुद्धिमत्ता कंपनी xAI ने आधिकारिक तौर पर ग्रोक 4.7 जारी किया, जो बड़े मॉडलों की एक नई पीढ़ी है, और इसे वर्तमान में सबसे शक्तिशाली प्रोग्रामिंग और ज्ञान कार्य मॉडल के रूप में स्थापित किया है। कंपनी ने कहा कि नया मॉडल न केवल जटिल कार्यों की प्रसंस्करण क्षमताओं में सुधार करता है, बल्कि पिछली पीढ़ी के उत्पादों के समान परिचालन गति और मूल्य प्रणाली को भी बनाए रखता है और कम लागत पर बाजार में प्रतिस्पर्धा करता है।

xAI द्वारा जारी की गई जानकारी के अनुसार, ग्रोक 4.7 एक नए बड़े पैमाने के बुनियादी मॉडल को अपनाता है और प्रशिक्षण प्रक्रिया के दौरान लंबे समय तक सुदृढीकरण सीखने का अनुकूलन करता है। पिछले संस्करणों की तुलना में, नया मॉडल अधिक जटिल प्रशिक्षण कार्यों के संपर्क में है, जिसमें बड़ी संख्या में कार्यों को पूरा करने के लिए कई घंटों तक डिज़ाइन किया गया है। यह मॉडल को दीर्घकालिक तर्क, स्व-सत्यापन और जटिल कार्य प्रबंधन में महत्वपूर्ण वृद्धि हासिल करने में सक्षम बनाता है।
xAI ने कहा कि ग्रोक 4.7 में सबसे बड़े बदलावों में से एक इसकी मजबूत "स्व-परीक्षण क्षमता" है। प्रश्नों का उत्तर देते समय, कोड लिखते समय और जटिल ज्ञान कार्य करते समय मॉडल अधिक सक्रिय रूप से अपने स्वयं के आउटपुट की जांच कर सकते हैं, जिससे त्रुटि दर कम हो जाती है और अंतिम परिणामों की विश्वसनीयता में सुधार होता है।
साथ ही, नए मॉडल की बेहद लंबे संदर्भों को संभालने की क्षमता में भी सुधार किया गया है। जब बड़े दस्तावेज़ों, कई दौर के कार्यों और लंबी अवधि के प्रोजेक्ट कार्य का सामना करना पड़ता है, तो ग्रोक 4.7 स्पष्ट प्रदर्शन में गिरावट के बिना अधिक स्थिर सूचना प्रबंधन क्षमताओं को बनाए रख सकता है क्योंकि संदर्भ कुछ पारंपरिक मॉडलों की तरह बढ़ता है।
वास्तविक कार्य अनुभव को और बेहतर बनाने के लिए, xAI विशेष रूप से ग्रोक 4.7 को ग्रोक बॉट ऑपरेटिंग ढांचे को मूल रूप से समझने के लिए प्रशिक्षित करता है। इसका मतलब यह है कि यह न केवल एकल-समय प्रश्न और उत्तर परिदृश्यों के लिए उपयुक्त है, बल्कि लंबे समय तक चलने वाले बुद्धिमान एजेंट के रूप में वर्कफ़्लो में भाग लेने के लिए भी अधिक उपयुक्त है। कंपनी का मानना है कि इससे सामान्य ज्ञान के काम, चल रही बातचीत और उद्यम-स्तर के कार्यों में मॉडल के प्रदर्शन में सुधार होगा।
प्रोग्रामिंग क्षमताओं के अलावा, ग्रोक 4.7 मजबूत दस्तावेज़ और प्रस्तुति निर्माण क्षमताओं से भी संपन्न है। अधिकारियों ने कहा कि मॉडल अब पेशेवर रिपोर्ट, व्यावसायिक दस्तावेज़ और प्रस्तुति सामग्री उत्पन्न करने में बेहतर सक्षम है, और कार्यालय स्वचालन के क्षेत्र में अपने आवेदन के दायरे को और विस्तारित करने की उम्मीद करता है।
प्रदर्शन के संदर्भ में, xAI ने आंतरिक परीक्षण परिणामों की एक श्रृंखला की घोषणा की।
कर्सरबेंच 4.0 परीक्षण में, जिसका उपयोग दीर्घकालिक सॉफ्टवेयर इंजीनियरिंग क्षमताओं का मूल्यांकन करने के लिए किया जाता है, ग्रोक 4.7 ने 46.3% का स्कोर हासिल किया, जो कि ग्रोक 4.6 के 40.4% की तुलना में काफी सुधार हुआ था। डीपएसडब्ल्यूई सॉफ्टवेयर इंजीनियरिंग परीक्षण में, नए मॉडल ने उद्योग के अग्रणी उत्पादों के करीब प्रतिस्पर्धी स्तर बनाए रखते हुए 71% का स्कोर हासिल किया।
इलेक्ट्रॉनिक इंजीनियरिंग के क्षेत्र में ईईबेंच परीक्षण में, ग्रोक 4.7 ने 64% का स्कोर हासिल किया, जो पिछली पीढ़ी की तुलना में दस प्रतिशत से अधिक अंक की वृद्धि है। बड़ी मात्रा में पेशेवर ज्ञान और जटिल वर्कफ़्लो वाले कार्यालय कार्यों के लिए, एए ब्रीफ़केस परीक्षण में मॉडल के प्रदर्शन में भी सुधार हुआ।
कानूनी विश्लेषण के संदर्भ में, ग्रोक 4.7 ने हार्वे लीगल एजेंट बेंचमार्क परीक्षण में 19.6% स्कोर किया, जो पिछली पीढ़ी के उत्पाद की तुलना में एक और सुधार है। मेडिकल रीजनिंग के क्षेत्र में, हेल्थबेंच प्रोफेशनल स्कोर भी 48.5% से बढ़कर 56.7% हो गया।
सामान्य ज्ञान कार्य के क्षेत्र में, xAI ने विशेष रूप से GDPval और AA ब्रीफकेस के दो मूल्यांकन परिणामों पर जोर दिया। कंपनी का मानना है कि ये परीक्षण वकीलों, नर्सों और वित्तीय विश्लेषकों जैसे पेशेवरों की वास्तविक कार्य सामग्री के करीब हैं, और ग्रोक 4.7 इन परिदृश्यों में मौजूदा अत्याधुनिक मॉडलों के प्रतिस्पर्धी स्तर तक पहुंच गया है।



कीमत इस रिलीज़ का एक और महत्वपूर्ण विक्रय बिंदु है।

आधिकारिक आंकड़ों के अनुसार, ग्रोक 4.7 का इनपुट मूल्य यूएस$2 प्रति मिलियन टोकन पर रहता है, और आउटपुट मूल्य ग्रोक 4.6 के अनुरूप यूएस$6 प्रति मिलियन टोकन है। कुछ अत्याधुनिक मॉडलों की तुलना में जिनकी कीमत अक्सर कई गुना या दस गुना अधिक होती है, एक्सएआई इस बात पर जोर देता है कि ग्रोक 4.7 कम लागत पर समान स्तर के कार्यों को पूरा कर सकता है।
कंपनी इसे एक ऐसे समाधान के रूप में भी वर्णित करती है जो "समान स्तर के मॉडलों की लगभग आधी कीमत पर प्रतिस्पर्धी प्रदर्शन प्रदान करता है", जिससे लागत लाभ के साथ बाजार हिस्सेदारी का और विस्तार होने की उम्मीद है।
सुरक्षा के संदर्भ में, xAI ने कहा कि ग्रोक 4.7 एक नव निर्मित सुरक्षा सुरक्षा प्रणाली को अपनाता है। आंतरिक परीक्षण परिणामों के अनुसार, नया मॉडल खतरनाक अनुरोधों को अस्वीकार करने, जेलब्रेक हमलों का विरोध करने और उच्च जोखिम वाली सामग्री की पहचान करने के मामले में ग्रोक श्रृंखला के सर्वोत्तम स्तर पर पहुंच गया है।
विशेष रूप से साइबर सुरक्षा और जैव सुरक्षा जैसे संवेदनशील क्षेत्रों में, मॉडल खतरनाक या दुर्भावनापूर्ण उपयोगों से इनकार करते हुए वैध रक्षात्मक कार्यों को संबोधित करने में मदद करने के लिए डिज़ाइन किए गए हैं। आधिकारिक डेटा से पता चलता है कि ग्रोक 4.7 ने कुछ नेटवर्क सुरक्षा जोखिम परीक्षणों और जैव सुरक्षा मूल्यांकन में अग्रणी प्रदर्शन हासिल किया है।
वर्तमान में, ग्रोक 4.7 एपीआई और ग्रोक प्लेटफॉर्म के माध्यम से उपयोगकर्ताओं के लिए खुला है। डेवलपर्स इस मॉडल को प्रोग्रामिंग, ज्ञान प्रश्नोत्तरी, दस्तावेज़ लेखन और बुद्धिमान एजेंट एप्लिकेशन विकास के लिए कॉल कर सकते हैं।
ग्रोक 4.7 के आधिकारिक लॉन्च के साथ, xAI ने उत्पाद पुनरावृत्ति की गति को और तेज कर दिया है। इस साल जुलाई में ग्रोक 4.5 की रिलीज़ से लेकर अगस्त में ग्रोक 4.6 और अब ग्रोक 4.7 के लॉन्च तक, xAI ने तीन महीने से भी कम समय में तीन प्रमुख अपग्रेड पूरे किए हैं। अत्यधिक प्रतिस्पर्धी कृत्रिम बुद्धिमत्ता बाजार के लिए, ग्रोक 4.7 न केवल एक नियमित अपडेट है, बल्कि तेज पुनरावृत्तियों, कम कीमतों और मजबूत कार्य क्षमताओं के माध्यम से उद्योग के नेताओं को चुनौती देने के लिए एक्सएआई के रणनीतिक इरादे को भी दर्शाता है।
टिप्पणियाँ