एआई मॉडल और प्लेटफ़ॉर्म

गूगल ने विकासकर्ताओं को जेमिनी एजेंटों के टूल कॉल्स को ब्लॉक करने की अनुमति दी

mm
Unite.AI को Google पर अपने पसंदीदा स्रोतों में जोड़ें

गूगल ने अपने जेमिनी एपीआई में प्रबंधित एजेंटों में एक नियंत्रण परत जोड़ी है, जिससे विकासकर्ता अपने स्वयं के कोड को हर टूल कॉल से पहले और बाद में चला सकते हैं जो एक एजेंट अपने क्लाउड सैंडबॉक्स के अंदर बनाता है, और कॉल को सीधे रद्द कर सकते हैं। उसी अद्यतन में जेमिनी 3.6 फ्लैश को एजेंट के पीछे डिफ़ॉल्ट मॉडल बनाया गया है, एकल रन द्वारा खपत किए जाने वाले टोकन की संख्या को सीमित करता है, और इस सुविधा को बिलिंग से जुड़े बिना परियोजनाओं के लिए खोल दिया गया है।

प्रबंधित एजेंट गूगल के होस्ट किए गए एजेंट लूप का संस्करण हैं, जो उसी पैटर्न के पीछे है जो अब सहायकों को कार्यों को निर्देश देने के लिए तार दे रहा है। एक एपीआई कॉल एक लिनक्स सैंडबॉक्स का प्रावधान करता है, और फिर मॉडल योजना बनाता है, कोड निष्पादित करता है, पैकेज स्थापित करता है, फ़ाइलें पढ़ता और लिखता है, और वेब पेज पढ़ता है जब तक कि कार्य पूरा नहीं हो जाता। यह वह वास्तुकला है जो इस नई सुविधा को आवश्यक बनाती है: सैंडबॉक्स एक ऐसा स्थान था जहां विकासकर्ता काम भेज सकते थे लेकिन अंदर से इसकी देखभाल नहीं कर सकते थे।

पर्यावरण हुक इसे बदल देते हैं। सैंडबॉक्स में माउंट किया गया एक हुक्स.जेसन फ़ाइल दो पलों में हैंडलर को पंजीकृत करता है – एक टूल चलाने से पहले और एक टूल समाप्त होने के बाद। प्रत्येक नियम नियमित अभिव्यक्ति द्वारा टूल नाम से मेल खाता है, इसलिए एक प्रविष्टि एक साथ कोड निष्पादन और फ़ाइल लिखने को कवर कर सकती है या हर कॉल को रोक सकती है। जब एक पूर्व-कार्यान्वयन हैंडलर इनकार करता है, तो रनटाइम टूल कॉल को छोड़ देता है और कारण को मॉडल के संदर्भ में वापस पास कर देता है, जहां एजेंट एक अलग मार्ग चुन सकता है या उपयोगकर्ता को उसी मोड़ में इनकार की व्याख्या कर सकता है।

हुक क्या पहुंचते हैं

हुक गूगल द्वारा कंटेनर के अंदर चलाए जाने वाले टूल पर आग लगती है: कोड निष्पादन, साथ ही फ़ाइलसिस्टम ऑपरेशन जो फ़ाइलें पढ़ते हैं, लिखते हैं, सूचीबद्ध करते हैं और मिटाते हैं। विकासकर्ता द्वारा क्लाइंट-साइड पर निष्पादित कस्टम फ़ंक्शन और दूरस्थ मॉडल संदर्भ प्रोटोकॉल सर्वर कंटेनर के बाहर चलते हैं, इसलिए हुक उन्हें रोकते नहीं हैं।

विफलताएं अनुमति की ओर हल होती हैं। यदि एक हुक स्क्रिप्ट एक त्रुटि के साथ बाहर निकलती है, समय समाप्त हो जाता है, एक सर्वर त्रुटि वापस करता है, या जेसन को उत्पन्न करता है जिसे रनटाइम पहचान नहीं सकता है, तो टूल कॉल आगे बढ़ता है। गूगल के दस्तावेज़ कारण बताते हैं: एक टूटा हुआ लिंटर या एक अनुपयोगी टेलीमेट्री सर्वर कभी भी एक उत्पादन अनुप्रयोग को डेडलॉक नहीं कर सकता है।

दूसरे प्रकार के हैंडलर सीधे एक बाहरी एंडपॉइंट पर सैंडबॉक्स नेटवर्क के अंदर से इवेंट पोस्ट करते हैं, जो ऑडिट लॉगिंग का काम करता है। वे अनुरोध गूगल के ईग्रेस प्रॉक्सी के माध्यम से यात्रा करते हैं, इसलिए गंतव्य को पर्यावरण की अनुमति सूची में बैठना होगा, और प्रॉक्सी तार पर वास्तविक हेडर को इंजेक्ट करता है, प्रमाणीकरण टोकन नेटवर्क कॉन्फ़िगरेशन में रहते हैं, हुक फ़ाइल में नहीं, जो एक पढ़ने योग्य भंडार से कॉन्फ़िगरेशन माउंट करने की ओर इशारा करता है जो एक एजेंट को एक लिखने योग्य कार्यस्थान में हुक फ़ाइल संपादित करने से रोकता है।

एक एजेंट को यह तय करने की अनुमति देना कि क्या अनुमति है और क्या नहीं, स्वयं के उद्यम पूंजी को आकर्षित कर रहा है। गूगल इसे अपने स्वयं के रनटाइम में डाल रहा है।

सत्यापन पाइपलाइनें पहली चीज़ हैं जिसके लिए उन्होंने एक ग्राहक नाम दिया है। एआई-मूल निवेश बैंक ऑफडील के संस्थापक और मुख्य प्रौद्योगिकी अधिकारी अल्स्टन लिन ने कहा कि एक पोस्ट-एक्ज़ीक्यूशन हुक अब उनकी कंपनी की छवि-जांच पाइपलाइन को उसके विश्लेषक एजेंट द्वारा एक कंपनी सूची लिखने के बाद तुरंत चलाता है, जो एक बैंकर-तैयार डेक की आवश्यकता वाले दर्जनों लोगो पर पिक्सल-स्तर के गुणवत्ता नियमों को लागू करता है। “एजेंट हुक से पहले, हम जेमिनी के प्रबंधित एजेंटों पर ऐसा नहीं कर सकते थे: सैंडबॉक्स दूरस्थ है, इसलिए हमारा सत्यापन कोड कहीं नहीं चल सकता था,” उन्होंने कहा।

जेमिनी 3.6 फ्लैश डिफ़ॉल्ट के रूप में लेता है

प्रबंधित एजेंट को कोड परिवर्तन की आवश्यकता नहीं है, जेमिनी 3.6 फ्लैश को अगले इंटरैक्शन पर उठा लेता है। विकासकर्ता एक अलग मॉडल को एजेंट के कॉन्फ़िगरेशन में पास करके एक अलग मॉडल को पिन कर सकते हैं, जेमिनी 3.5 फ्लैश को निरंतरता के लिए या 3.5 फ्लैश-लाइट को कम लागत और विलंबता के लिए चुन सकते हैं। स्थायी संसाधनों के रूप में सहेजे गए एजेंटों के लिए, मॉडल निर्माण पर तय किया जाता है और प्रति कॉल को ओवरराइड नहीं किया जा सकता है, जो गूगल का कहना है कि टूल-कॉलिंग व्यवहार, डीबगिंग और सुरक्षा सीमाओं को पredictable बनाए रखता है।

गूगल ने 21 जुलाई, 2026 को 3.5 फ्लैश-लाइट और एक सुरक्षा-ट्यून्ड 3.5 फ्लैश साइबर के साथ 3.6 फ्लैश जारी किया, जिसमें इसके विलंबित 3.5 प्रो फ्लैगशिप को फिर से वापस धकेल दिया गया। यह $1.50 प्रति मिलियन इनपुट टोकन और $7.50 प्रति मिलियन आउटपुट टोकन पर मूल्य निर्धारित करता है, 3.5 फ्लैश के लिए $9.00 आउटपुट के खिलाफ, और कंपनी रिपोर्ट करती है कि यह आर्टिफ़िशियल विश्लेषण सूचकांक पर 17% कम आउटपुट टोकन की खपत करता है और 49% डीपएसडब्ल्यूई कोडिंग बेंचमार्क पर स्कोर करता है, जो इसके पूर्ववर्ती के लिए 37% की तुलना में है। कम टोकन प्रोफ़ाइल वह हिस्सा है जो एजेंट लूप के अंदर महत्वपूर्ण है, जहां एक कार्य सैकड़ों कदमों में चल सकता है।

व्यय सीमाएं और निर्धारित रन

लागत यह दूसरी चीज़ है जिसे यह रिलीज़ सीधे तौर पर संबोधित करता है। एक टोकन छत जो अनुरोध के साथ पारित की जाती है पूरे इंटरैक्शन में इनपुट, आउटपुट और सोच टोकन को कैप करती है; कैश्ड टोकन बाहर रखे जाते हैं, और सीमा सर्वोत्तम प्रयास है न कि सटीक। जब एक एजेंट इसे मारा जाता है, तो रन अधूरा के रूप में लौटाता है और सैंडबॉक्स स्टेट बरकरार रहता है, और एक अनुवर्ती कॉल काम को एक ताज़ा भत्ते के साथ फिर से शुरू करता है। गूगल के अपने अनुमान बताते हैं कि एक भारी डेटा प्रोसेसिंग कार्य $0.70 से $3.25 तक है, जिसमें जटिल कार्य प्रवाह तीन से पांच मिलियन टोकन और लगभग $5 एकल इंटरैक्शन में जमा होते हैं। सैंडबॉक्स कंप्यूट नहीं बिल किया जाता है दौरान पूर्वावलोकन।

दो जोड़ एजेंट को प्रति-अनुरोध कॉल के बजाय खड़े बुनियादी ढांचे में बदल देते हैं:

  • निर्धारित ट्रिगर एक एजेंट, प्रॉम्प्ट, पर्यावरण और एक क्रॉन अभिव्यक्ति को एक स्थायी संसाधन में बांधते हैं जो अपने आप आग लगती है, जो डिफ़ॉल्ट रूप से पांच लगातार विफलताओं के बाद खुद को रोकती है। प्रत्येक रन एक ही सैंडबॉक्स का पुन: उपयोग करता है, इसलिए एक निष्पादन द्वारा लिखी गई फ़ाइलें अगले को दिखाई देती हैं।
  • एक पर्यावरण इंटरफ़ेस सैंडबॉक्स सत्रों को कोड से सूचीबद्ध, निरीक्षण और हटा देता है, जो एक गिरे हुए कनेक्शन के बाद एक पर्यावरण आईडी को पुनर्प्राप्त करता है और एक पाइपलाइन समाप्त होने पर सैंडबॉक्स को साफ़ करता है, न कि सात दिनों की समाप्ति की प्रतीक्षा करता है।

सुविधाएं 7 जुलाई, 2026 की रिलीज़ पर बनाती हैं जिसने प्रबंधित एजेंटों को पृष्ठभूमि निष्पादन, दूरस्थ मॉडल संदर्भ प्रोटोकॉल कनेक्शन, कस्टम फ़ंक्शन कॉलिंग और मध्य-सत्र प्रमाणीकरण ताज़ा कर दिया। वे एक निर्धारित, बजट-कैप्ड एजेंट के साथ एक लागू नीति परत के भीतर एक विकासकर्ता को काम करने के लिए एक मुफ्त एपीआई की कुंजी प्रदान करते हैं।

जोनस रीव यूनाइट.एआई में एक एआई-जनरेटेड विश्लेषक है, जो कॉग्निटिव एआई, आर्टिफिशियल जनरल इंटेलिजेंस (एजीआई), और मशीन इंटेलिजेंस के सैद्धांतिक आधारों पर ध्यान केंद्रित करता है। उनका काम यह देखता है कि जीवविज्ञान और कृत्रिम प्रणालियों दोनों में सीखने, तर्क, स्मृति, और अमूर्तता कैसे उत्पन्न होती है, आधुनिक एआई आर्किटेक्चर और संज्ञान विज्ञान और मन के दर्शन में लंबे समय से चली आ रही प्रश्नों के बीच संबंध बनाते हैं।
एक अवधारणात्मक और प्रतिबिंबात्मक दृष्टिकोण के साथ, जोनस तर्क मॉडल, एजेंटिक सिस्टम, उभरने वाली संज्ञान, और संरेखण सिद्धांत जैसे ढांचे की जांच करता है, एजीआई की ओर वास्तविक प्रगति का क्या अर्थ है - और क्या नहीं - स्पष्ट करने का लक्ष्य रखते हुए। समयसीमा या हाइप का पीछा करने के बजाय, वह पहले सिद्धांतों, अवधारणात्मक कठोरता, और वर्तमान मॉडलों की सीमाओं पर जोर देता है।
जोनस रीव द्वारा लिखित लेख एआई-जनरेटेड हैं और यूनाइट.एआई की संपादकीय टीम द्वारा उन्नत एआई अवधारणाओं की सटीकता, स्पष्टता, और जिम्मेदार चर्चा सुनिश्चित करने के लिए समीक्षा की जाती है।