Story
गूगल ने जेमिनी 4 आर्गन एआई मॉडल का अनावरण किया, कारोबार बंद होने के बाद शेयरों में उछाल आया।

Summary
गूगल ने अपने अगली पीढ़ी के प्रमुख एआई मॉडल, जेमिनी 4 आर्गन की घोषणा की और ऐसे बेंचमार्क डेटा प्रकाशित किए जो कई क्षेत्रों में इसके प्रमुख प्रतिद्वंद्वियों से बेहतर प्रदर्शन को दर्शाते हैं। इस खबर के बाद कंपनी के शेयरों में कारोबार बंद होने के बाद लगभग 2% की वृद्धि हुई।
बुधवार को Google ने अपने अगली पीढ़ी के प्रमुख कृत्रिम बुद्धिमत्ता मॉडल, Gemini 4 Argon का अनावरण किया। इस घोषणा के बाद कंपनी Alphabet (GOOGL) के शेयरों में कारोबार बंद होने के बाद लगभग 2% की बढ़ोतरी हुई। हफ्तों से चली आ रही इस प्रतीक्षा के बाद यह घोषणा की गई है, जिससे यह नया मॉडल OpenAI और Anthropic के अग्रणी सिस्टमों का सीधा प्रतिस्पर्धी बन गया है।
नई क्षमताओं की झलक
सोशल मीडिया प्लेटफॉर्म X पर एक पोस्ट में, Google के CEO सुंदर पिचाई ने Argon को एक ऐसे मॉडल के रूप में प्रस्तुत किया जो सॉफ्टवेयर इंजीनियरिंग, साइबर सुरक्षा और अन्य उन्नत वर्कफ़्लो से संबंधित जटिल कार्यों में "असाधारण प्रदर्शन" प्रदर्शित करता है। वर्तमान में यह सीमित रूप से जारी किया जा रहा है, रॉयटर्स की रिपोर्ट के अनुसार, Argon को शुरू में चुनिंदा साइबर सुरक्षा भागीदारों के एक समूह को प्रदान किया जा रहा है।
Google ने अभी तक इस मॉडल की आम जनता के लिए उपलब्धता की कोई समय-सारणी नहीं दी है। यह घोषणा सिस्टम की क्षमताओं की प्रारंभिक झलक प्रदान करती है, पिछले सप्ताह कंपनी के एक कार्यकारी के उस बयान के बाद जिसमें उन्होंने संकेत दिया था कि इसका एक संस्करण "जितनी जल्दी हो सके" जारी किया जाएगा।
प्रतिस्पर्धी बेंचमार्क परिणाम
Google ने बेंचमार्क का एक सेट जारी किया है जिसमें अधिकांश परीक्षणों में Argon को इसके प्रमुख प्रतिस्पर्धियों, OpenAI के GPT-6 Astra और Anthropic के Claude Opus 5.5 से आगे दिखाया गया है। हालांकि परिणाम पूर्ण रूप से निर्णायक नहीं थे, फिर भी Argon ने उल्लेखनीय खूबियां प्रदर्शित कीं।
Google द्वारा प्रकाशित प्रमुख प्रदर्शन मेट्रिक्स में शामिल हैं:
Ad- वैल इंडेक्स: Argon ने 68.9% स्कोर किया, जबकि Claude Opus 5.5 ने 67.0% और GPT-6 Astra ने 63.1% स्कोर किया।
- कोडिंग: मॉडल ने DeepSWE v1.1 और Vibe कोड बेंच परीक्षणों में क्रमशः 77.9% और 91.9% स्कोर करके अग्रणी स्थान प्राप्त किया।
- लॉन्ग-कॉन्टेक्स्ट: आर्गन ने ग्राफवॉक टेस्ट में 128,000 टोकन तक के साथ 99.7% और 10 लाख टोकन तक के टेस्ट में 84.2% की सटीकता हासिल करके उल्लेखनीय बढ़त दिखाई।
- कॉम्प्लेक्स रीजनिंग: इसने एजेंट के लास्ट एग्जाम बेंचमार्क पर 39.5% स्कोर किया, जो GPT-6 एस्ट्रा के 34.2% से कहीं बेहतर है।
प्रतिस्पर्धियों ने कई व्यक्तिगत टेस्टों में आर्गन से बेहतर प्रदर्शन किया, जिसमें GPT-6 एस्ट्रा ने फ्रंटियरएसडब्ल्यूई v2 में और क्लाउड ओपस 5.5 ने टर्मिनल-बेंच 4.0 में शीर्ष स्कोर हासिल किया।
बाजार संदर्भ और दृष्टिकोण
उत्पाद में देरी के बाद तेजी से विकसित हो रहे एआई क्षेत्र में अपनी प्रतिस्पर्धात्मक बढ़त बनाए रखने के प्रयास में गूगल के लिए आर्गन का अनावरण एक महत्वपूर्ण कदम है। बेंचमार्क पर यह मजबूत प्रदर्शन गूगल की उच्चतम स्तर पर प्रतिस्पर्धा करने की क्षमता का संकेत देता है।
हालांकि, ये बेंचमार्क मॉडल के वास्तविक प्रदर्शन को लेकर उठ रहे सवालों के बीच आए हैं। ब्लूमबर्ग की एक हालिया रिपोर्ट में, प्रत्यक्ष जानकारी रखने वाले लोगों के हवाले से बताया गया है कि जेमिनी 4 ने उद्योग मानकों पर तो अच्छा प्रदर्शन किया है, लेकिन आंतरिक, वास्तविक दुनिया के अनुप्रयोगों में इसका प्रदर्शन उतना प्रभावशाली नहीं रहा है। गूगल ने इस दावे का खंडन करते हुए कोडिंग और डेटा-सेंटर ऑप्टिमाइज़ेशन जैसे जटिल कार्यों के लिए आर्गन के आंतरिक उपयोग पर ज़ोर दिया है।