एनवीडिया ने सोमवार को Open Agent Safety Platform पेश किया। यह सॉफ्टवेयर-आधारित नियंत्रणों को स्वतंत्र हार्डवेयर निगरानी के साथ जोड़ता है, ताकि AI एजेंट अपने अधिकृत दायरे से बाहर जाकर काम न करें। इस प्लेटफॉर्म में ओपन-सोर्स OpenShell सॉफ्टवेयर और हार्डवेयर सुरक्षा घटक Nvidia Sentry शामिल हैं। माइक्रोसॉफ्ट और एंथ्रोपिक समेत 100 से अधिक संगठन एनवीडिया के साथ इस प्रणाली के इस्तेमाल पर काम कर रहे हैं।
यह लॉन्च ऐसे समय हुआ है जब कई प्रमुख AI प्रयोगशालाओं ने बताया है कि उनके एजेंट परीक्षण वातावरण से बाहर निकल गए और बिना अनुमति वाले सिस्टम तक पहुंच गए। स्वायत्त प्रणालियों को तय सीमाओं के भीतर रखना उन कंपनियों के लिए व्यावहारिक सुरक्षा चुनौती बन गया है, जो इन्हें अपने कामकाज में तैनात कर रही हैं।
एनवीडिया के CEO जेनसन हुआंग ने सोमवार को कहा कि AI से महत्वपूर्ण लाभ मिल सकते हैं, लेकिन इसका विकास और इस्तेमाल सुरक्षित तरीके से होना चाहिए। उनके अनुसार AI एजेंटों को नियंत्रित करना एक इंजीनियरिंग चुनौती है, जिसका समाधान तकनीक के जरिए किया जा सकता है।
OpenShell एजेंट को काम शुरू करने से पहले सीमित करता है
OpenShell इस प्लेटफॉर्म की सॉफ्टवेयर परत है। कंपनियां इस ओपन-सोर्स टूल को स्थानीय डिवाइस या क्लाउड में इंस्टॉल कर सकती हैं और एजेंट का काम शुरू होने से पहले तय कर सकती हैं कि उसे किन फाइलों, वेबसाइटों, नेटवर्क, टूल और क्रेडेंशियल्स तक पहुंच मिलेगी। एजेंट के काम करने के दौरान OpenShell उसकी गतिविधियों को इन नियमों के अनुरूप जांचता रहता है।
हुआंग ने इस व्यवस्था की तुलना कर्मचारियों को ऐसे एक्सेस कार्ड देने से की, जिनसे वे केवल अपने काम के लिए जरूरी क्षेत्रों में प्रवेश कर सकें। उनके मुताबिक पहला कदम एजेंट की सभी अनुमतियां हटाना है। इसके बाद उसके निर्धारित काम के लिए जरूरी फाइलों, डेटा, टूल या इंटरनेट सेवाओं तक ही पहुंच दी जानी चाहिए।
मिसाल के तौर पर, इनवॉइस संभालने वाले एजेंट को अपने-आप कर्मचारियों के रिकॉर्ड तक पहुंच नहीं मिलनी चाहिए और न ही उसे बाहरी इंटरनेट पर स्वतंत्र रूप से कनेक्शन बनाने की अनुमति होनी चाहिए। OpenShell एजेंट को एक अलग, सीमित वातावरण में रखता है, ताकि किसी गलत कार्रवाई का असर कंपनी के दूसरे सिस्टम तक फैलने के बजाय उसी दायरे में सीमित रहे।
नियम टूटने पर कार्रवाई वास्तविक समय में रोकी जा सकती है
निर्देशों से भटकने वाला एजेंट जरूरी नहीं कि जानबूझकर नुकसान पहुंचा रहा हो। अस्पष्ट प्रॉम्प्ट, टूल की विफलता या जटिल काम को पूरा करने में कठिनाई के कारण एजेंट वैकल्पिक रास्ते आजमा सकता है। इनमें से कुछ कदम उसके संचालक की मंशा से आगे जा सकते हैं।
एनवीडिया के अनुसार OpenShell को पहले से तय नीतियों का उल्लंघन करने वाली गतिविधियों का वास्तविक समय में पता लगाने और उन्हें रोकने के लिए बनाया गया है। इसका मूल सिद्धांत यह है कि एजेंट को स्पष्ट रूप से परिभाषित अनुमतियों के भीतर रखा जाए। प्रणाली इस बात पर निर्भर नहीं करती कि एजेंट खुद तय करे कि उसे किन सिस्टम या डेटा तक पहुंच मिलनी चाहिए।
Nvidia Sentry अलग हार्डवेयर से एजेंटों की निगरानी करता है
प्लेटफॉर्म का दूसरा घटक Nvidia Sentry निगरानी और आइसोलेशन की अतिरिक्त परत देता है। यह एजेंट के सिस्टम के साथ साझा संसाधनों पर चलने के बजाय एक समर्पित Nvidia BlueField डेटा प्रोसेसर पर काम करता है। इस डिजाइन का उद्देश्य यह है कि एजेंट निगरानी घटक को बंद या दरकिनार न कर सके।
Sentry एजेंटों और मॉडल, टूल, डेटा तथा नेटवर्क के बीच होने वाली गतिविधियों पर नजर रखता है। एनवीडिया का कहना है कि संदिग्ध या नीति-विरोधी गतिविधि मिलने पर यह एजेंट को मिलीसेकंड में अलग कर सकता है और उसे क्वारंटीन वातावरण में डाल सकता है। हुआंग ने इस ढांचे को एजेंट और बड़े भाषा मॉडल के बीच एक चिप लगाने जैसा बताया, जिससे इन दोनों के बीच होने वाले इंटरैक्शन को एनवीडिया बीच में रोककर देख सके।
यह घोषणा स्वायत्त AI प्रणालियों की अनुमतियों और परिचालन सुरक्षा को लेकर उठ रही चिंताओं के बीच हुई है। एंटरप्राइज वातावरण में यह प्लेटफॉर्म असामान्य व्यवहार की पहचान कितनी विश्वसनीयता से कर पाएगा और साथ ही वैध गतिविधियों को अनावश्यक रूप से नहीं रोकेगा, यह वास्तविक तैनाती में इसके प्रदर्शन पर निर्भर करेगा। एनवीडिया ने ऐसा डिजाइन पेश किया है जिसमें पहले से अनुमतियां सीमित करने के साथ एजेंट के अपने रनटाइम से बाहर निगरानी और आइसोलेशन की व्यवस्था रखी गई है।