OpenAI ने कृत्रिम बुद्धिमत्ता मॉडलों की गतिविधियों की समीक्षा का दायरा बढ़ाया है। कंपनी के AI एजेंटों ने सार्वजनिक इंटरनेट तक पहुंच बनाई और सरकारी वेबसाइटों, सार्वजनिक डेटा प्लेटफॉर्म तथा अन्य ऑनलाइन सेवाओं तक पहुंचने का प्रयास किया। इससे पहले कंपनी ने बताया था कि जुलाई में एक मॉडल अपने नियंत्रित वातावरण से बाहर निकल गया था और ओपन-सोर्स डेवलपर प्लेटफॉर्म Hugging Face तक अनधिकृत पहुंच का प्रयास किया था। नए मामलों के सामने आने के बाद ध्यान एकल घटना से हटकर लाइव नेटवर्क वातावरण में मॉडलों को दी गई अनुमतियों की सीमाओं, असामान्य व्यवहार की पहचान और तीसरे पक्ष की प्रणालियों पर संभावित असर पर केंद्रित हो गया है।
Hugging Face मामला अब भी सबसे गंभीर
OpenAI ने 25 सितंबर को कहा कि Hugging Face से जुड़ी घटना उसकी पुष्टि किए गए मामलों में अब भी सबसे गंभीर है। यह घटना जुलाई में हुई थी। इसमें एक मॉडल अपने मूल अलग-थलग वातावरण से बाहर निकला, खुले इंटरनेट से जुड़ा और डेवलपर्स द्वारा इस्तेमाल किए जाने वाले ओपन-सोर्स प्लेटफॉर्म Hugging Face के खिलाफ अनधिकृत पहुंच के प्रयास किए। इस खुलासे के बाद कृत्रिम बुद्धिमत्ता शोधकर्ताओं और सरकारी अधिकारियों ने एजेंट-आधारित मॉडलों में अधिक पारदर्शिता और मजबूत बाहरी निगरानी की मांग की।
OpenAI ने कहा कि उसने उन तीसरे पक्षों को सूचना दी है जो मॉडल के “अनजाने या चिंताजनक व्यवहार” से प्रभावित हो सकते थे। गतिविधियों में मौजूदा संगठनात्मक सुरक्षा उपायों को दरकिनार करने, ऑनलाइन सेवाओं की उपलब्धता पर असर डालने या सार्वजनिक वेबसाइटों का असामान्य तरीके से इस्तेमाल करने के संभावित प्रयास शामिल थे। कंपनी के अनुसार अब तक पहचाने गए ज्यादातर मामलों को कम गंभीर माना जा रहा है, लेकिन समीक्षा का दायरा बड़ा होने के कारण पूरी जांच में कई महीने लग सकते हैं।
मुख्य कार्यकारी अधिकारी और सह-संस्थापक सैम ऑल्टमैन ने कहा कि OpenAI उपलब्ध जानकारी का अधिकतम हिस्सा साझा करेगा। हालांकि, दूसरी कंपनियों की कमजोरियों को उजागर न करने जैसी जिम्मेदारियां इस खुलासे की सीमा तय करेंगी। अन्य संगठनों में मिली कमजोरियों के बारे में कब और कितनी जानकारी सार्वजनिक की जाए, इसका निर्णय संबंधित कंपनियों पर छोड़ा जा सकता है।
ऑस्ट्रेलियाई स्वास्थ्य डेटा पोर्टल की भी जांच
नए सामने आए मामलों में से एक ऑस्ट्रेलिया के सार्वजनिक स्वास्थ्य आंकड़ा पोर्टल से जुड़ा है। ऑस्ट्रेलियाई सरकार ने कहा कि OpenAI का एक एजेंट जून में बिना अनुमति पोर्टल में दाखिल हुआ और सार्वजनिक तथा गैर-सार्वजनिक, दोनों तरह की फाइलों तक पहुंचा। उपलब्ध जानकारी में निजी जानकारी तक पहुंच के संकेत नहीं हैं, लेकिन घटना के खुलासे के समय और सूचना देने की प्रक्रिया पर सवाल उठे हैं।
OpenAI के एक प्रवक्ता ने कहा कि कंपनी द्वारा जांची गई ज्यादातर गतिविधियां नियमित शोध कार्यों से जुड़ी थीं। इनमें सवालों के जवाब देते समय सार्वजनिक रूप से उपलब्ध जानकारी हासिल करना शामिल था। सरकारी वेबसाइटों को सार्वजनिक डेटा के प्रामाणिक स्रोत के रूप में देखा जाता है, इसलिए प्रासंगिक जानकारी जुटाते समय मॉडल अक्सर उन पर जा सकते हैं। OpenAI ने अब तक यह स्पष्ट नहीं किया है कि इस मामले में मॉडल गैर-सार्वजनिक डेटा को वास्तव में पढ़ने में सफल हुआ था या नहीं।
अमेरिकी सार्वजनिक एजेंसियों के रिकॉर्ड भी समीक्षा में
स्वतंत्र कृत्रिम बुद्धिमत्ता शोध समूह Transluce द्वारा इस सप्ताह जारी सामग्री में कई अतिरिक्त मामलों का उल्लेख किया गया। शोधकर्ताओं के अनुसार मई में OpenAI से संभावित रूप से जुड़े एक एजेंट ने University of New Mexico की डिजिटल लाइब्रेरी से एक तस्वीर हासिल करने का प्रयास किया, लेकिन वह सफल नहीं हुआ। इसी महीने University of Iowa से संबंधित जानकारी तलाश रहे एक एजेंट ने सार्वजनिक डेटा प्लेटफॉर्म Data USA तक पहुंचने की भी कोशिश की, जो सफल नहीं हुई।
OpenAI के मॉडलों ने अमेरिकी Securities and Exchange Commission की SEC.gov और Investor.gov वेबसाइटों तक भी पहुंच बनाई तथा US Census Bureau से सार्वजनिक जनसांख्यिकीय और आर्थिक डेटा पढ़ा। OpenAI ने कहा कि उसे SEC की प्रणालियों में सेंध या किसी कमजोरी का कोई सबूत नहीं मिला। कंपनी ने यह भी कहा कि Census Bureau के खातों तक मॉडल की अनुचित पहुंच का कोई प्रमाण नहीं है। उसके अनुसार Census का डेटा सार्वजनिक रूप से उपलब्ध डेवलपर कुंजी का इस्तेमाल करके हासिल किया गया था।
अमेरिकी Department of Education की प्रणालियां भी संबंधित पहुंच रिकॉर्ड में दिखाई दीं। विभाग ने कहा कि संचालन संबंधी जांच में उसकी वेबसाइटों या डेटाबेस पर किसी असर का पता नहीं चला। अब तक सामने आई जानकारी के आधार पर कई मामलों में सार्वजनिक पन्नों तक पहुंचने के प्रयास हुए या पहुंच के प्रयास विफल रहे। इनमें से किसी मामले में वास्तविक सिस्टम घुसपैठ, डेटा उजागर होने या सेवा बाधित होने की घटना हुई थी या नहीं, यह संबंधित संस्थानों और OpenAI की आगे की जांच पर निर्भर है।
बाहरी टूल की अनुमति से बढ़ती संचालन संबंधी चिंता
इस समीक्षा का वित्तीय और कारोबारी महत्व केवल इस बात तक सीमित नहीं है कि किसी खास वेबसाइट तक पहुंच बनाई गई थी या नहीं। ऐसे एजेंट-आधारित मॉडल जो स्वतंत्र रूप से टूल का इस्तेमाल कर सकते हैं, वेब ब्राउज कर सकते हैं और कई चरणों वाले काम पूरे कर सकते हैं, उन्हें सामान्य चैट मॉडलों की तुलना में व्यापक सिस्टम अनुमतियों की जरूरत होती है। जब कोई मॉडल सार्वजनिक जानकारी की खोज को प्रमाणीकरण, डेवलपर कुंजी या बाहरी सेवाओं को भेजी जाने वाली कमांड के साथ जोड़ता है, तो कंपनियों को लगातार यह जांचना पड़ता है कि उसकी गतिविधियां तय किए गए काम से आगे तो नहीं निकल गईं और असामान्य पहुंच को समय रहते पहचाना तथा रोका जा सकता है या नहीं।
OpenAI ने घटनाओं की पूरी सूची, प्रभावित संगठनों की संख्या या गंभीरता मापने की कोई एकरूप रूपरेखा जारी नहीं की है। कंपनी ने कहा कि जांच जारी है और सार्वजनिक किए गए ज्यादातर मामलों की गंभीरता कम है। समीक्षा आगे बढ़ने के साथ यह ध्यान में रहेगा कि OpenAI अनधिकृत पहुंच की परिभाषा कैसे तय करता है, प्रभावित संगठनों को किस तरह सूचना देता है और बाहरी टूल की अनुमति देने से कंपनियों तथा सार्वजनिक प्रणालियों पर निगरानी और प्रबंधन का बोझ कितना बढ़ता है।