Google ने जेमिनी 3.8 लाइव जारी किया, एक बड़ा देशी भाषण मॉडल, पहला "बोलते समय सोचना" विस्तारित तर्क मोड

📅 2026-09-16

सार:

Google ने आज आधिकारिक तौर पर देशी एंड-टू-एंड वॉयस इंटरैक्शन के क्षेत्र में अपनी नवीनतम सफलता की घोषणा की, जिसमें कठिन कार्यों के लिए अनुकूलित वास्तविक समय वॉयस बड़े मॉडल जेमिनी 3.8 लाइव और जेमिनी 3.8 लाइव एक्सटेंडेड थिंकिंग की एक नई पीढ़ी लॉन्च की गई।

ये दो मॉडल Google की मूल ऑडियो-टू-ऑडियो प्रौद्योगिकी प्रणाली में एक बड़ी छलांग का प्रतिनिधित्व करते हैं। वे न केवल वास्तविक समय की बातचीत में देरी और स्वाभाविकता को नई ऊंचाइयों पर ले जाते हैं, बल्कि पहली बार कम-विलंबता वॉयस स्ट्रीम में गहरी बहु-चरणीय तर्क क्षमता भी हासिल करते हैं, जिससे जटिल पेशेवर परिदृश्यों में वॉयस एआई के एप्लिकेशन प्रतिमान को पूरी तरह से बदल दिया जाता है।

पिछली मुख्यधारा की वॉयस इंटरेक्शन आर्किटेक्चर में, एआई सिस्टम को आमतौर पर "त्वरित-प्रतिक्रिया उथले संवाद" और "दीर्घकालिक गहरी सोच" के बीच समझौता करने की आवश्यकता होती थी। कठिन समस्याओं का सामना करने के लिए अक्सर उपयोगकर्ताओं को लंबे समय तक मौन प्रतीक्षा का सामना करना पड़ता है। Google द्वारा लॉन्च किया गया जेमिनी 3.8 लाइव अल्ट्रा-फास्ट वार्तालाप और दैनिक स्ट्रीमिंग इंटरैक्शन अनुभव को अनुकूलित करने पर केंद्रित है। यह उपयोगकर्ताओं को अधिक संवेदनशील स्वर उतार-चढ़ाव, प्राकृतिक रुकावटों और संदर्भ समझने की क्षमताओं के साथ बेहद सहज और मानव-स्तरीय वास्तविक समय आवाज संचार प्रदान कर सकता है। इसके आधार पर लॉन्च किए गए जेमिनी 3.8 लाइव एक्सटेंडेड थिंकिंग को अत्यधिक जटिल व्यावसायिक प्रवाह के लिए मौलिक रूप से उन्नत किया गया है। यह मॉडल एआई को पृष्ठभूमि में "जैसा बोलता है वैसा ही सोचने" की क्षमता देता है, जिससे सिस्टम वास्तविक समय में सुसंगत संवाद बनाए रखते हुए पृष्ठभूमि में जटिल मल्टी-स्टेप लॉजिक डिस्सेप्लर, कोड डिबगिंग या तकनीकी निदान को समवर्ती रूप से करने की अनुमति देता है, कठिन समस्याओं का सामना करने पर बातचीत की लय को अचानक बाधित करने की आवश्यकता के बिना।

व्यावहारिक अनुप्रयोग के संदर्भ में, लाइव श्रृंखला मॉडल की नई पीढ़ी वॉयस असिस्टेंट की सेवा सीमाओं का महत्वपूर्ण रूप से विस्तार करेगी। दैनिक प्राकृतिक वार्तालापों के अलावा, जेमिनी 3.8 लाइव और विस्तारित रीजनिंग संस्करणों ने वास्तविक समय चरण समस्या निवारण, जटिल गणितीय व्युत्पत्ति, वास्तविक समय विदेशी भाषा एक साथ ट्यूशन और मल्टी-टास्क स्ट्रीमिंग निर्देश निष्पादन जैसी उच्च बौद्धिक मांगों वाले परिदृश्यों में पिछले संस्करणों की तुलना में काफी बेहतर प्रदर्शन किया है, जो मल्टी-मोडल और स्पीच रीजनिंग उद्योग बेंचमार्क में पहले स्थान पर है।

डेवलपर्स और एंटरप्राइज़ उपयोगकर्ताओं के लिए, Google ने घोषणा की कि प्रासंगिक मॉडल क्षमताएं अब से जेमिनी एपीआई और Google AI स्टूडियो के माध्यम से आधिकारिक तौर पर पहुंच के लिए खुली रहेंगी। बुद्धिमान हार्डवेयर, ग्राहक सेवा, वास्तविक समय प्रोग्रामिंग सहायता और सहयोगी कार्यालय जैसे उत्पाद रूपों में उच्च-क्रम तर्क क्षमताओं के साथ अगली पीढ़ी के पूर्ण-डुप्लेक्स वॉयस एजेंट सेवाओं को जल्दी से बनाने के लिए डेवलपर्स इस बेहद कम-विलंबता वाले मूल ऑडियो एपीआई इंटरफ़ेस को सीधे कॉल कर सकते हैं।

संबंधित टैग

संबंधित लेख

Google ने विंडोज़ प्लेटफ़ॉर्म के लिए आधिकारिक तौर पर जेमिनी नेटिव डेस्कटॉप एप्लिकेशन लॉन्च किया 2026-09-11 Google अगले दो वर्षों में फिनलैंड में चार स्थानों पर AI बुनियादी ढांचे का विस्तार करने के लिए कम से कम 13 बिलियन यूरो का निवेश करेगा 2026-09-09 जेमिनी स्पार्क Google फ़ोटो प्रबंधन क्षमताओं को जोड़ता है, जिससे आप कमांड के माध्यम से फ़ोटो संपादित कर सकते हैं और फ़ोटो एल्बम व्यवस्थित कर सकते हैं 2026-09-04 नवीनतम परीक्षण फर्मवेयर से पता चलता है कि ऐप्पल सराउंड साउंड और पार्टी मोड के साथ चार होमपॉड्स का परीक्षण कर सकता है 2026-09-04 Google जेमिनी वॉयस इंटरेक्शन फ़ंक्शन को गहराई से एकीकृत करता है और जीमेल, डॉक्स और कीप में पूरी तरह से लॉग इन करता है 2026-09-04 उन्होंने पर्वतारोहण गाइड के लिए जेमिनी पर भरोसा किया और फंस गए। शिखर पर चढ़ने में 8 घंटे का अनुमान लगाया गया था लेकिन वास्तव में इसमें 16 घंटे लगे। देर रात खतरे में फंसे तीन पर्वतारोहियों को बचा लिया गया. 2026-09-04

टिप्पणियाँ

0/500
Captcha (click to refresh)
कोई टिप्पणी नहीं