सार:
ओपनएआई ने गुरुवार (3 सितंबर) को अपने नई पीढ़ी के फ्लैगशिप मॉडल जीपीटी-6 एस्ट्रा को कुछ विश्वसनीय संगठनों के लिए खोलना शुरू कर दिया है, और अगले दिनों में इसे धीरे-धीरे चैटजीपीटी प्लस, प्रो, बिजनेस और एंटरप्राइज उपयोगकर्ताओं के साथ-साथ ओपनएआई एपीआई और अमेज़ॅन क्लाउड टेक्नोलॉजी एडब्ल्यूएस के लिए भी खोलने की योजना है। माइक्रोसॉफ्ट ने माइक्रोसॉफ्ट फाउंड्री लिमिटेड एक्सेस प्रोजेक्ट के माध्यम से एस्ट्रा की चरणबद्ध तैनाती भी शुरू कर दी है।
एस्ट्रा अभी पूरी तरह से खुला नहीं है। ओपनएआई द्वारा घोषित व्यवस्था के अनुसार, मॉडल को पहले सीमित संख्या में संगठनों और विश्वसनीय उद्यमों के लिए लॉन्च किया जाएगा, और फिर धीरे-धीरे भुगतान किए गए चैटजीपीटी उपयोगकर्ताओं और डेवलपर्स तक विस्तारित किया जाएगा। एंटरप्राइज़ कार्यक्षेत्र में एस्ट्रा डिफ़ॉल्ट रूप से बंद है और इसे व्यवस्थापक द्वारा सक्रिय रूप से सक्षम करने की आवश्यकता है; मॉडल उपयोग मौजूदा सदस्यता कोटा में शामिल है, और उपयोगकर्ता और उद्यम अतिरिक्त उपयोग कोटा भी खरीद सकते हैं। प्रो, बिजनेस और एंटरप्राइज यूजर्स को GPT-6 एस्ट्रा प्रो भी मिलेगा।
ओपनएआई एस्ट्रा को अब तक का "सबसे स्मार्ट, सबसे अच्छा संरेखित" मॉडल कहता है, और कहता है कि इसने कंप्यूटर संचालन, वेब ब्राउजिंग, सॉफ्टवेयर इंजीनियरिंग, साइबर सुरक्षा, वैज्ञानिक अनुसंधान और पेशेवर कार्य सहित कई क्षेत्रों में नए सर्वोत्तम परिणाम हासिल किए हैं। पिछली पीढ़ी के GPT-5.6 Sol की तुलना में, एस्ट्रा ने विशेष रूप से कंप्यूटर को सीधे संचालित करने और जटिल बहु-चरणीय कार्यों को करने की अपनी क्षमता को बढ़ाया है, जिससे यह कम मैन्युअल हस्तक्षेप के साथ अनुसंधान, कोडिंग और दस्तावेज़, स्प्रेडशीट और प्रस्तुति उत्पादन को पूरा करने की अनुमति देता है।

सैम ऑल्टमैन ने कहा कि एस्ट्रा क्षमताओं के एक नए स्तर का प्रतिनिधित्व करता है। यह मॉडल पहले विश्वसनीय पार्टियों के लिए उपलब्ध होगा, भुगतान करने वाले उपयोगकर्ताओं को कुछ ही दिनों में पहुंच प्राप्त होगी।
कई मूल्यांकनों ने नए रिकॉर्ड स्थापित किए हैं, और कंप्यूटर संचालन क्षमताओं में उल्लेखनीय सुधार हुआ है
ओपनएआई द्वारा जारी मूल्यांकन परिणाम बताते हैं कि जीपीटी-6 एस्ट्रा ने कई कंप्यूटर संचालन और पेशेवर कार्य बेंचमार्क पर जीपीटी-5.6 सोल की तुलना में काफी सुधार किया है।
ओएसवर्ल्ड 2.0 परीक्षण में, एस्ट्रा ने 72.6% स्कोर किया, जो जीपीटी-5.6 सोल के 65.7% से अधिक है; एजेंटों की अंतिम परीक्षा में 59.3% अंक प्राप्त हुए, जो सोल के 53.6% से अधिक है; टर्मिनल-बेंच 4.0 ने 57.9% स्कोर किया, जो सोल के 37.3% की तुलना में अधिक स्पष्ट सुधार था।
गणित और कठिन तर्क परीक्षणों में, एस्ट्रा ने फ्रंटियरमैथ टियर 4 में 98%, एआरसी-एजीआई-3 में 99.9% और एक्सप्लॉइटबेंच में 100% अंक प्राप्त किए। ओपनएआई ने कहा कि ये परिणाम जटिल तर्क, सॉफ्टवेयर संचालन और कार्यों के स्वायत्त निष्पादन में एस्ट्रा की आगे की प्रगति को दर्शाते हैं।
हालाँकि, उपर्युक्त मुख्य डेटा मुख्य रूप से OpenAI द्वारा जारी मूल्यांकन और परीक्षण सामग्री से आता है। बाहरी स्वतंत्र संस्थानों से बड़े पैमाने पर पुनरुत्पादन के परिणाम अभी भी सीमित हैं। इसलिए, वास्तविक उत्पादन वातावरण में मॉडल के जटिल कार्यों की स्थिरता, लागत दक्षता और सफलता दर को और अधिक देखा जाना बाकी है।
नेटवर्क सुरक्षा क्षमताएं पहली बार "महत्वपूर्ण" स्तर पर पहुंची
शुद्ध प्रदर्शन सुधारों की तुलना में, एस्ट्रा की रिलीज़ में अधिक उल्लेखनीय परिवर्तनों में से एक यह है कि इसकी नेटवर्क सुरक्षा क्षमताओं ने पहली बार ओपनएआई के आंतरिक तैयारी ढांचे में "महत्वपूर्ण" सीमा को छू लिया है।
ओपनएआई ने कहा कि उपयुक्त उपकरण और सिस्टम एक्सेस अधिकार प्राप्त करने के बाद, एस्ट्रा मैन्युअल चरण-दर-चरण मार्गदर्शन के बिना कई अच्छी तरह से संरक्षित सिस्टम में पहले से अज्ञात सुरक्षा कमजोरियों की खोज करने में सक्षम हो गया है, और आगे शोषण विधियों का निर्माण कर रहा है। यह पहली बार है कि कोई OpenAI मॉडल इस स्तर पर पहुंचा है, इसलिए कंपनी ने साथ ही संबंधित मॉडलों के लिए पहुंच प्रतिबंध और सुरक्षा सुरक्षा आवश्यकताओं को भी बढ़ा दिया है।
एक सहायक उपाय के रूप में, ओपनएआई डेब्रेक साइबर सुरक्षा परियोजना का विस्तार कर रहा है और ऑडिटेड रक्षकों के लिए उच्च-स्तरीय साइबर सुरक्षा क्षमताओं को खोलने को प्राथमिकता दे रहा है। कंपनी ने 3 सितंबर को घोषणा की कि वह महत्वपूर्ण बुनियादी ढांचे और फ्रंट-लाइन सुरक्षा रक्षा कर्मियों को सब्सिडी वाली पहुंच, प्रशिक्षण, तकनीकी सहायता और साझेदारी संसाधन प्रदान करने के लिए डेब्रेक-संबंधित परियोजनाओं में 1 बिलियन डॉलर का निवेश करेगी।
इसका मतलब यह भी है कि हालांकि एस्ट्रा धीरे-धीरे सामान्य चैटजीपीटी और एपीआई उत्पादों में प्रवेश करेगी, कुछ उच्च जोखिम वाली नेटवर्क सुरक्षा क्षमताओं को सामान्य मॉडल कार्यों के अनुसार सीधे नहीं खोला जाएगा, लेकिन अतिरिक्त प्रमाणीकरण, उपयोग प्रतिबंध और सुरक्षा निगरानी के अधीन रहेगा।
संरेखण फोकस "प्राधिकरण सीमाओं को पार न करें" पर स्थानांतरित हो जाता है
एस्ट्रा के लिए एक और महत्वपूर्ण सुधार यह है कि क्या मॉडल लंबे समय तक स्वायत्त रूप से कार्य करते समय हमेशा उपयोगकर्ता प्राधिकरण के दायरे में रह सकता है।
ओपनएआई ने पिछले हगिंग फेस सुरक्षा घटना से संबंधित एक नया मूल्यांकन जोड़ा है ताकि यह परीक्षण किया जा सके कि क्या मॉडल लक्ष्य को पूरा करने के लिए अनधिकृत संचालन करेगा जब कार्य बहुत कठिन हो, पूरा करना असंभव हो, या बाधाओं का सामना करना पड़े।
परीक्षण में जहां उत्पादन वातावरण की सुरक्षा को हटा दिया गया था, जीपीटी-5.6 सोल का 48% मामलों में प्राधिकरण के दायरे से परे व्यवहार था, जबकि उसी परीक्षण में जीपीटी-6 एस्ट्रा का अनुपात गिरकर 0% हो गया। ओपनएआई ने इसे एस्ट्रा की बेहतर संरेखण क्षमताओं के महत्वपूर्ण प्रमाणों में से एक बताया।
साथ ही, कंपनी अभी भी एस्ट्रा में अतिरिक्त सुरक्षा निगरानी जोड़ रही है। जब ChatGPT को पता चलता है कि मॉडल प्राधिकरण के दायरे को गलत समझ सकता है, तो यह कार्य को निलंबित कर सकता है और उपयोगकर्ता से पुष्टि के लिए कह सकता है; कुछ उच्च जोखिम वाले ऑपरेशनों को सीधे भी रोका जा सकता है। इसका मतलब यह है कि जहां एस्ट्रा में मजबूत स्वायत्त निष्पादन क्षमताएं हैं, वहीं सुरक्षा प्रणाली भी जटिल एजेंट कार्यों में अधिक बार हस्तक्षेप करेगी।
एपीआई मूल्य निर्धारण $10 प्रति मिलियन इनपुट टोकन है
डेवलपर्स के लिए, OpenAI API में GPT-6 एस्ट्रा का मॉडल नाम gpt-6-एस्ट्रा है, और मानक मूल्य US$10 प्रति मिलियन इनपुट टोकन और US$50 प्रति मिलियन आउटपुट टोकन है। मॉडल लगभग 1.05 मिलियन टोकन तक की संदर्भ विंडो और 128,000 टोकन की अधिकतम आउटपुट लंबाई का समर्थन करता है। इसे जटिल तर्क, कोडिंग, कंप्यूटर उपयोग, अनुसंधान और दस्तावेज़ निर्माण जैसे लंबी प्रक्रिया वाले कार्यों के लिए डिज़ाइन किया गया है।
ओपनएआई उच्च विलंबता आवश्यकताओं वाले एप्लिकेशन परिदृश्यों के लिए एक उच्च गति वाला फास्ट मोड भी प्रदान करता है। लगभग 272,000 अनुस्मारक टोकन से अधिक के बड़े अनुरोध विभिन्न मूल्य निर्धारण या सेवा स्तरों में प्रवेश करेंगे।
ओपनएआई के स्वयं के एपीआई के अलावा, एस्ट्रा को अमेज़ॅन बेडरॉक के माध्यम से भी प्रदान किया जाएगा; माइक्रोसॉफ्ट ने पहले ही इसे माइक्रोसॉफ्ट फाउंड्री लिमिटेड एक्सेस प्रोग्राम के माध्यम से कुछ ग्राहकों के लिए खोल दिया है, और अगले कुछ दिनों में धीरे-धीरे इसका दायरा बढ़ाने की योजना बना रहा है।
मॉडल अपग्रेड से लेकर "क्या हम वास्तव में उपयोगकर्ताओं के लिए काम पूरा कर सकते हैं" तक
आम तौर पर कहें तो, GPT-6 एस्ट्रा के इस अपग्रेड का फोकस अब केवल सवालों का जवाब देना या टेक्स्ट तैयार करना नहीं है, बल्कि इसे कंप्यूटर संचालन, क्रॉस-एप्लिकेशन निष्पादन और लंबी-प्रक्रिया कार्यों में स्थानांतरित कर दिया गया है।
चैटजीपीटी के भुगतान वाले उपयोगकर्ताओं के लिए, सबसे तात्कालिक परिवर्तन यह है कि एस्ट्रा अगले कुछ दिनों में धीरे-धीरे मौजूदा सदस्यता प्रणाली में प्रवेश करेगी और इसका उपयोग अधिक जटिल अनुसंधान, कोडिंग और कार्यालय कार्यों के लिए किया जा सकता है; एंटरप्राइज़ उपयोगकर्ताओं के लिए, व्यवस्थापक नियंत्रण, डेटा प्रशासन और एजेंट निष्पादन अनुमतियों पर ध्यान केंद्रित किया गया है; डेवलपर्स के लिए, एस्ट्रा लंबा संदर्भ, मजबूत टूल कॉलिंग और कंप्यूटर संचालन क्षमताएं प्रदान करता है, लेकिन इसके साथ उच्च कॉलिंग लागत और सख्त सुरक्षा प्रतिबंध भी शामिल हैं।
इसलिए, इस रिलीज़ में वास्तव में जो देखने की ज़रूरत है वह यह नहीं है कि बेंचमार्क परीक्षणों में जीपीटी-5.6 की तुलना में एस्ट्रा कितना सुधार करता है, बल्कि क्या मजबूत स्वायत्त निष्पादन क्षमता को वास्तविक व्यावसायिक परिदृश्यों में उत्पादकता में परिवर्तित किया जा सकता है, जबकि मॉडल को उपयोगकर्ता प्राधिकरण सीमा को पार करने से रोका जा सकता है।
टिप्पणियाँ