सार:
NVIDIA ने हाल ही में IFA 2026 के दौरान आधिकारिक तौर पर पर्सनल AI राउटर (PAIR) बीटा वर्जन लॉन्च किया है। यह एक फ्री ओपन सोर्स सॉफ्टवेयर है। यह पारंपरिक अर्थों में एक नेटवर्क हार्डवेयर राउटर नहीं है, बल्कि स्थानीय एआई अनुमान के लिए एक "वर्चुअल राउटर" है। यह स्वचालित रूप से एक ही LAN में संगत कंप्यूटरों की खोज कर सकता है, कई उपकरणों की निष्क्रिय कंप्यूटिंग शक्ति को व्यवस्थित कर सकता है, और एआई एजेंटों और स्थानीय बड़े मॉडल कार्यों के लिए अधिक पर्याप्त अनुमान संसाधन प्रदान कर सकता है।
एनवीआईडीआईए द्वारा घोषित पांच-बाल एजेंट प्रदर्शन भी इस दृष्टिकोण के प्रभाव को दर्शाता है। हर्मीस डेस्कटॉप और ओलामा का उपयोग करते हुए, तीन उपकरणों वाले एक पीएआईआर क्लस्टर को कार्य पूरा करने में 8 मिनट और 48 सेकंड लगे, जबकि एक एकल आरटीएक्स स्पार्क नोटबुक को 18 मिनट लगे। एनवीआईडीआईए का मानना है कि इससे पता चलता है कि घरेलू नेटवर्क में कई उपकरणों की निष्क्रिय कंप्यूटिंग शक्ति का उपयोग स्थानीय मल्टी-टास्किंग एआई के थ्रूपुट में काफी सुधार कर सकता है।
PAIR के पीछे एक महत्वपूर्ण निर्णय यह है कि घरेलू उपयोगकर्ताओं के पास अक्सर पहले से ही कुछ कंप्यूटिंग क्षमताओं वाले कई कंप्यूटर होते हैं, लेकिन ये डिवाइस अधिकांश समय निष्क्रिय रहते हैं। एनवीडिया द्वारा उद्धृत डेटा बताता है कि संयुक्त राज्य अमेरिका में आधे से अधिक घरों में दो या दो से अधिक कंप्यूटर हैं, इसलिए बड़ी संख्या में जीपीयू और अन्य कंप्यूटिंग संसाधनों का दिन के एक बड़े हिस्से में पूरी तरह से उपयोग नहीं किया जाता है। गेमिंग कंप्यूटर, लैपटॉप और अन्य उच्च-प्रदर्शन वाले उपकरणों वाले परिवारों के लिए, पीएआईआर इन मूल रूप से स्वतंत्र उपकरणों को कंप्यूटिंग संसाधनों के एक पूल में बदलने का प्रयास करता है जो संयुक्त रूप से स्थानीय एआई की सेवा कर सकते हैं।
एनवीआईडीआईए तकनीकी टीम का अनुमान है कि एक चरम मामले में, एक घर में लगभग 165 टीएफएलओपीएस निष्क्रिय कंप्यूटिंग शक्ति हो सकती है। प्रभारी संबंधित व्यक्ति ने इन स्थानीय कंप्यूटिंग शक्ति का वर्णन किया है जिनका पूरी तरह से उपयोग "घर पर निष्क्रिय मुक्त टोकन संसाधनों" के रूप में नहीं किया गया है। हालाँकि, NVIDIA को उम्मीद है कि विशिष्ट उपयोगकर्ता जो वास्तव में PAIR के लिए उपयुक्त हैं, उन्हें इस तरह के अतिरंजित डिवाइस आकार की आवश्यकता नहीं है। एक अधिक यथार्थवादी कॉन्फ़िगरेशन एक मैकबुक या विंडोज नोटबुक, साथ ही एक गेमिंग पीसी हो सकता है।
PAIR के अलावा, NVIDIA ने इस बार स्थानीय AI एजेंटों के तैनाती अनुभव को और सरल बनाने की भी घोषणा की। पर्प्लेक्सिटी पोर्टेबल कंप्यूटर, हर्मीस एजेंट और ओपनक्लॉ सहित तीन एआई एजेंट सॉफ्टवेयर, एनवीआईडीआईए जीपीयू के लिए सरल स्थानीय कॉन्फ़िगरेशन विधियां प्रदान करेंगे। अतीत में, उपयोगकर्ताओं को अक्सर मॉडल का चयन करने, संगत अनुमान सर्वर खोजने, परिमाणीकरण मापदंडों को समायोजित करने और विभिन्न कॉन्फ़िगरेशन को पूरा करने की आवश्यकता होती थी। नया समाधान इस प्रक्रिया को कुछ ही क्लिक में संपीड़ित करने की उम्मीद करता है।
उनमें से, पर्प्लेक्सिटी पोर्टेबल कंप्यूटर पहले कम से कम 24 जीबी वीडियो मेमोरी और लिनक्स सिस्टम पर डीजीएक्स स्पार्क से लैस एनवीआईडीआईए आरटीएक्स जीपीयू पर चलने में सक्षम है, और विंडोज संस्करण भी प्रगति पर है। यह उपयोगकर्ताओं को अपने अधिक वर्कफ़्लो को ऑन-प्रिमाइसेस रखने और अतिरिक्त खोज या मजबूत अनुमान क्षमताओं की आवश्यकता होने पर क्लाउड मॉडल का उपयोग करने का विकल्प चुनने की अनुमति देता है; सिस्टम सामग्री को क्लाउड पर सौंपने से पहले उपयोगकर्ता की सहमति प्राप्त करेगा।
नूस रिसर्च द्वारा विकसित हर्मीस एजेंट, एक सामान्य प्रयोजन एआई एजेंट है। विंडोज़ संस्करण का स्थानीय कॉन्फ़िगरेशन वन-क्लिक मॉडल परिनियोजन का समर्थन करेगा। सॉफ़्टवेयर स्वचालित रूप से NVIDIA GPU की पहचान कर सकता है, हार्डवेयर के अनुसार उपयुक्त मॉडल और कॉन्फ़िगरेशन का चयन कर सकता है, और इसे एकीकृत NVIDIA अनुकूलित llama.cpp के माध्यम से चला सकता है। लिनक्स समर्थन बाद में लॉन्च किया जाएगा। दौड़ने के बाद, हर्मीस टूल को कॉल कर सकता है, कार्यों में संदर्भ बनाए रख सकता है, विभिन्न सत्रों से जानकारी याद रख सकता है और उपयोग के साथ पुन: प्रयोज्य कौशल जमा कर सकता है।
OpenClaw को विंडोज़ के लिए एक सरलीकृत परिनियोजन समाधान भी मिलता है। एनवीडिया ने कहा कि ओपनक्लाव ओपन एआई एजेंट पारिस्थितिकी तंत्र में एक महत्वपूर्ण परियोजना बन गया है, और गिटहब पर परियोजना का पैमाना 380,000 सितारों से अधिक हो गया है। नया विंडोज़ एप्लिकेशन स्थानीय मॉडल कॉन्फ़िगरेशन के लिए सीमा को कम कर देगा, जिससे कम से कम 24GB वीडियो मेमोरी NVIDIA RTX GPU वाले उपयोगकर्ताओं के लिए स्थानीय AI सहायक लॉन्च करना आसान हो जाएगा।
स्थानीय एआई एजेंट की प्रतिक्रिया गति को और बेहतर बनाने के लिए, NVIDIA ने एक साथ llama.cpp और vLLM के लिए अनुमान अनुकूलन की भी घोषणा की। नए कर्नेल अनुकूलन, अधिक उन्नत सट्टा डिकोडिंग और तेज़ प्रीफ़िल प्रोसेसिंग के आधार पर, GeForce RTX 5090 पर llama.cpp का थ्रूपुट 1.9 गुना तक बढ़ाया जा सकता है; आरटीएक्स प्रो 6000 ब्लैकवेल वर्कस्टेशन संस्करण पर वीएलएलएम प्रदर्शन को 1.2 गुना तक और दो डीजीएक्स स्पार्क्स से बने क्लस्टर पर 1.4 गुना तक सुधार किया जा सकता है। ये अनुकूलन संबंधित अनुमान बैकएंड के माध्यम से पहले से ही उपलब्ध हैं और एलएम स्टूडियो और ओलामा में भी उपलब्ध हैं।
एनवीडिया ने इस बार यह भी खुलासा किया कि आरटीएक्स स्पार्क प्लेटफॉर्म से लैस नए विंडोज छोटे एआई कंप्यूटर अक्टूबर में लॉन्च होने की उम्मीद है। जैसे-जैसे ये स्थानीय AI-उन्मुख हार्डवेयर, अनुमान सॉफ़्टवेयर और AI एजेंट उपकरण धीरे-धीरे परिपक्व होते जा रहे हैं, NVIDIA स्पष्ट रूप से पारंपरिक क्लाउड AI का उपयोग करने के एक अलग तरीके को बढ़ावा दे रहा है: उपयोगकर्ताओं को सभी कार्यों को दूरस्थ डेटा केंद्रों में सबमिट करने की आवश्यकता नहीं है, लेकिन वे अपने स्वयं के स्थानीय AI कंप्यूटिंग वातावरण के निर्माण के लिए सीधे घर पर GPU और अन्य उपकरणों का उपयोग कर सकते हैं।
PAIR अभी भी बीटा चरण में है, और प्रोजेक्ट को ओपन सोर्स के रूप में जारी किया गया है। डेवलपर्स स्रोत कोड देख सकते हैं, समस्याएँ सबमिट कर सकते हैं और सुधारों में भाग ले सकते हैं। NVIDIA को उम्मीद है कि PAIR के माध्यम से, स्थानीय AI धीरे-धीरे "मॉडल चलाने वाले एकल उच्च-प्रदर्शन वाले कंप्यूटर" से "AI कार्यभार साझा करने वाले कई घरेलू उपकरणों" की ओर बढ़ जाएगा, और यह स्थानीय AI एजेंटों के और अधिक लोकप्रिय होने के बाद एक नया कंप्यूटिंग मॉडल भी बन सकता है।
टिप्पणियाँ