Google ने Gemini 4 Argon 30 सप्टेंबरच्या घोषणेत ज्ञानाधारित कामे आणि कोडिंगमधील चांगले गुण, दहा लाख आउटपुट टोकनची घोषित मर्यादा आणि भविष्यातील API साठी किंमत दिली. सुरुवातीला हा मॉडेल विश्वासार्ह सायबर संरक्षण तज्ज्ञ आणि परीक्षकांच्या लहान गटाला देत आहे. विकासकांसाठी सार्वजनिक मॉडेल ID किंवा सशुल्क API ग्राहक व Google AI Ultra सदस्यांसाठी उपलब्धतेची तारीख जाहीर केलेली नाही. Google ची घोषणा आणि Gemini API मॉडेल कॅटलॉग यांतून मॉडेलच्या घोषणेपासून बहुतेक वाचकांना प्रत्यक्ष प्रवेश मिळेपर्यंतची दरी दिसते.

मुख्य बदल

  • काय बदलले: Google ने नवा प्रगत मॉडेल निवडक सायबर संरक्षण तज्ज्ञांच्या हातात दिला आहे, पण बहुतेक विकासक आणि सदस्यांना अजून प्रवेश नाही. क्षमतांबद्दल आणि किमतींबद्दलचे ठळक दावे सार्वजनिक झाले आहेत; सार्वजनिक API मात्र उपलब्ध नाही.
  • हे महत्त्वाचे का: Vals AI च्या स्वतंत्र मूल्यमापनात व्यापक ज्ञानाधारित कामे आणि वित्तीय एजंट चाचणीत Argon पहिल्या क्रमांकावर आहे. त्यामुळे मॉडेलची तुलना करणाऱ्या टीमसमोर गंभीरपणे विचार करण्यासारखा नवा पर्याय आला आहे. वेगवेगळ्या कामांतील विसंगत निकाल आणि मर्यादित उपलब्धतेमुळे त्यांच्या स्वतःच्या कामाच्या प्रक्रियेतील परिणाम आणि खर्च अजून अनिश्चित आहेत.
  • काय पाहावे: पुढील गट म्हणून Google ने सशुल्क API ग्राहक आणि AI Ultra सदस्यांची नावे दिली, पण तारीख नाही. दस्तऐवजीकरण असलेला मॉडेल ID आणि सेवेच्या मर्यादा मिळाल्यावर विकासकांना त्यांच्या महत्त्वाच्या कामांची चाचणी करता येईल; घोषित दहा लाख आउटपुट टोकन प्रत्यक्ष वापरता येतात का हेही तपासता येईल.

आता Gemini 4 कोण वापरू शकते

पहिले वापरकर्ते म्हणजे Google च्या Fairwind कार्यक्रमातीलविश्वासार्ह सायबर संरक्षण तज्ज्ञ आणि परीक्षक, असे Google सांगते. Fairwind हा निवडक Google Cloud ग्राहक, सरकारी संस्था आणि सुरक्षा भागीदारांसाठी मर्यादित प्रवेशाचा कार्यक्रम आहे. संरक्षणात्मक क्षमता वापरता याव्यात म्हणून विश्वासार्ह संरक्षण तज्ज्ञांना Argon नेहमीच्या सायबर सुरक्षा निर्बंधांशिवाय दिला जात असल्याचे Google म्हणते. हा प्रारंभिक टप्पा विशेष संवेदनशील वापरासाठी नियंत्रित चाचणी आहे.

Google विकासक, उद्योग आणि ग्राहकांपर्यंत प्रवेश वाढवण्याचा विचार करत आहे; सुरुवात सशुल्क API ग्राहक आणि Google AI Ultra सदस्यांपासून होईल. या टप्प्याची तारीख दिलेली नाही. 1 ऑक्टोबरला तपासले असता Google च्या Gemini API मॉडेल निर्देशिकेत Gemini 3 मॉडेल होते, पण Gemini 4 Argon ID नव्हता. API किंमत पानावर देखील Argon ची नोंद नव्हती. त्यामुळे API कॉल करण्यासाठी मार्गदर्शक लिहिताना Google ने नोंद न केलेले मॉडेलचे नाव आणि प्रवेशमार्ग बनवावे लागतील.

तरीही कंपनीने लॉन्च पोस्टमध्ये भविष्यातील टोकन दर दिले. सुरुवातीची किंमत प्रति दशलक्ष इनपुट टोकन 2 डॉलर आणि प्रति दशलक्ष आउटपुट टोकन 10 डॉलरआहे; कॅश केलेल्या इनपुटची किंमत मूळ इनपुट दरापेक्षा 95% कमी आहे. सुरुवातीचा कालावधी संपल्यानंतर दर 4 आणि 20 डॉलरहोतील, असे Google म्हणते. हा कालावधी कधी संपेल हे सांगितलेले नाही. हे जाहीर केलेले दर आहेत, आज उपलब्ध असलेल्या सेल्फ-सर्व्हिस API चे दर नाहीत. दीर्घ एजंट कामाला लागणारे रिझनिंग, साधनांचा वापर आणि आउटपुट माहीत होईपर्यंत प्रति टोकन दरावरून खर्चाचा अंदाज बांधता येत नाही.

उच्च गुण, पण स्पष्ट कमकुवत बाजू

Vals AI चे Argon वरील स्वतंत्र मूल्यमापन Vals Index वर 68.90% ± 0.97 नोंदवते; त्यांच्या तक्त्यातील 41 मॉडेलमध्ये तो पहिला आहे. Finance Agent v2 मध्ये 73 पैकी पहिला, गुण 65.40% ± 0.32. Vibe Code Bench मध्ये 106 पैकी दुसरा, 91.91% ± 1.90; Code Migration मध्ये 71 पैकी दुसरा, 68.17% ± 4.35; आणि CyberBench v1.1 मध्ये 43 पैकी दुसरा, 77.86% ± 5.30. अनेक कामांतली ही चांगली सुरुवात आहे; प्रत्येक कामात Argon सर्वोत्तम आहे, असे यातून सिद्ध होत नाही.

त्याच मूल्यमापनात Terminal-Bench 4.0 मध्ये Argon 42 पैकी पाचवा, गुण 57.58% ± 2.31; MedScribe मध्ये 106 पैकी पंधरावा; आणि संगणक-वापराच्या CUA-bench मध्ये आठपैकी सातवा, गुण 4.83%. प्रत्येक चाचणीचा मोजलेला खर्चही मोठ्या प्रमाणात बदलतो: Vals Index चाचणीसाठी $15.68 आणि CUA-bench साठी $193.78 . हे मूल्यमापनाच्या कामांचे खर्च आहेत; Google ने जाहीर केलेल्या प्रति दशलक्ष टोकन दरांपेक्षा वेगळे. Vals म्हणते की काही एजंट चाचण्यांत ठरावीक हॅरनेस वापरतात, तर इतरांत मॉडेलचा स्वतःचा एजंट वापरतात. प्रकाशित मानक त्रुटींमध्ये प्रॉम्प्ट, रँडम सीड किंवा तैनातीच्या सेटिंगमधील फरक समाविष्ट नाहीत. गुणांतील छोटा फरक या संदर्भातच समजून घ्यावा.

Google DeepMind च्या स्वतःच्या तुलना तक्त्यात सर्वच बाबतीत आघाडी असल्याच्या दाव्याला आणखी प्रतिवाद आहेत. DeepSWE v1.1 मध्ये Argon GPT-6 Astra पेक्षा पुढे आहे, 77.9% to 74.1%; पण FrontierSWE v2 मध्ये Astra पेक्षा मागे, 55.0% to 65.5%आणि Terminal-Bench Science मध्येही मागे, 57.6% to 68.1%. Terminal-Bench 4.0 मध्ये Claude Opus 5.5 Argon पेक्षा पुढे आहे, 66.4% to 57.4%; PostTrainBench मध्येही, 49.3% to 45.3%. तक्त्यातील ऑफलाइन OSWorld-2.0 उपसंचात Astra चे गुण 72.6% आणि Argon चे 69.2%. ही तुलना Google ने निवडलेल्या चाचण्या आणि नमूद केलेल्या मांडणीवर आधारित आहे; दस्तऐवजीकरण असलेल्या सार्वजनिक सेवेत ग्राहकांनी केलेल्या चाचणीची ती जागा घेत नाही.

Argon एका प्रक्रियेत जास्तीत जास्त दहा लाख आउटपुट टोकनतयार करू शकतो, असे Google म्हणते; आधीची मर्यादा 64,000 टोकन होती. Vals एक दशलक्ष टोकनची संदर्भ विंडो नमूद करते, पण Argon चाचणीसाठी आउटपुटची कमाल मर्यादा 262,144 टोकनठेवली. यावरून Google च्या भविष्यातील उत्पादनाची निश्चित मर्यादा ठरत नाही. मात्र Vals च्या सार्वजनिक निकालांत पूर्ण दहा लाख टोकन तयार केल्याचे दिसत नाही; सर्वसाधारण विकासकांसाठीची आउटपुट मर्यादा स्पष्ट करणारी सार्वजनिक API नोंदही Google ने अद्याप दिलेली नाही.

अंतर्गत वापर आणि सुरक्षा दाव्यांना स्वतंत्र पुरावे हवे

C/C++ कोडचे Rust मध्ये स्थलांतर, क्वांटम-कॉम्प्युटिंग सबरूटीन आणि डेटा-सेंटर मेमरीचे अनुकूलन यांत Argon एजंटनी मदत केल्याचे Google सांगते. मेमरीतील बदलांचा एक संच लागू केल्यानंतर 300 TiB पेक्षा जास्त जागा मोकळी झाल्याचेही ते म्हणतात. भागीदार Wiz ला Argon च्या मदतीने आरोग्यसेवा सॉफ्टवेअरमधील गंभीर असुरक्षितता सापडल्याचेही Google सांगते. हे अंतर्गत किंवा भागीदारांच्या कामाबद्दलचे Google चे वृत्तांत आहेत; ते तपासण्यासाठी किंवा पुन्हा करून पाहण्यासाठी लॉन्च सामग्रीत पुरेसा स्वतंत्र तपशील नाही. मोठ्या Rust पुनर्लेखनांची उत्पादनात जाण्यापूर्वी स्वयंचलित आणि मानवी तपासणी होते, असे Google म्हणते.

सुरक्षेसाठी Google हानिकारक विनंत्या नाकारण्याचे प्रशिक्षण, अप्रत्यक्ष प्रॉम्प्ट इंजेक्शनविरोधी बचाव, वापरकर्त्याच्या हेतूबाहेरील वर्तन शोधण्यासाठी मॉडेलच्या विचारप्रक्रियेचे व कृतींचे निरीक्षण, आणि मूल्यमापन वातावरणाचे अधिक विभाजन यांचे वर्णन करते. अप्रत्यक्ष प्रॉम्प्ट इंजेक्शनविरुद्ध Argon हा आपला सर्वाधिक प्रतिरोधक मॉडेल असल्याचा दावा विक्रेत्याचा आहे. Google नुसार सुरुवातीच्या सायबर गटाला नेहमीचे सायबर सुरक्षा निर्बंध नसताना प्रवेश मिळतो; प्रवेशाचा विस्तार होताना त्याची व्याप्ती आणि निरीक्षण विशेष महत्त्वाचे ठरतात.

दैनंदिन उपयोगितेबद्दलचे सुरुवातीचे पुरावे परस्परविरोधी आहेत. Axios ने वृत्त दिले की Bloomberg ने अनामिक सूत्रांचा हवाला देत काही Google कर्मचाऱ्यांना Argon ची अंतर्गत कामगिरी कमकुवत वाटल्याचे म्हटले; Google ने हा वृत्तांत चुकीचा असल्याचे Bloomberg ला सांगितल्याचेही Axios ने नोंदवले. Google ने Axios ला सांगितले की कर्मचाऱ्यांनी कठीण कोडिंग आणि संशोधनासाठी मॉडेल वापरले. यापैकी कोणताही वृत्तांत सार्वजनिक आवृत्ती कशी काम करेल हे ठरवत नाही. पुढे दस्तऐवजीकरण असलेल्या सेटिंगमध्ये प्रवेश, तसेच इतरांना तपासता येतील असे कामांचे निकाल आणि खर्च आवश्यक आहेत.