कुछ कृत्रिम बुद्धिमत्ता (एआई) मॉडलों ने कथित तौर पर अपने दम पर काम किया, जिसके बारे में हमें विश्वास है कि यह एक ऐसा परिदृश्य है जहां एक एजेंट इकाई ने एआई प्लेटफॉर्म हगिंग फेस के उत्पादन बुनियादी ढांचे में घुसपैठ की है। ऐसा लगता है कि यह किसी बीते युग की साइंस-फिक्शन फिल्मों की कहानी है, सिवाय इसके कि यह उतना नाटकीय नहीं है जितना बताया जा रहा है। हकीकत तो यह है कि जब हगिंग फेस ने 16 जुलाई को यह जानकारी जारी की तो किसी को इसकी परवाह नहीं थी। इसे नियमित रूप से ध्यान आकर्षित करने के लिए 21 जुलाई को प्रचार कथा को आगे बढ़ाने के लिए ओपनएआई की आवश्यकता थी। यह एक प्लेबुक है जिसे हमने पहले देखा है।

ओपनएआई द्वारा जीपीटी-5.6 सोल और एक अनाम प्री-रिलीज़ मॉडल के रूप में पहचाने गए एआई मॉडल, संभवतः सहज द्वेष से कार्य नहीं कर रहे थे। वे ‘एक्सप्लॉइटजिम’ नामक आंतरिक साइबर सुरक्षा मूल्यांकन बेंचमार्क में भाग ले रहे थे। ओपनएआई ने खुद कहा, “सभी सबूत बताते हैं कि मॉडल एक्सप्लॉइटजिम के लिए एक समाधान खोजने पर अत्यधिक केंद्रित थे, बल्कि एक संकीर्ण परीक्षण लक्ष्य को प्राप्त करने के लिए अत्यधिक लंबाई तक जा रहे थे।”
कॉर्नेल विश्वविद्यालय में कंप्यूटर विज्ञान के सहायक प्रोफेसर जॉन थिकस्टन ने एचटी को बताया, “इस कहानी को ओपनएआई के कथात्मक ढांचे की समझ के साथ पढ़ना महत्वपूर्ण है। यह मुख्य रूप से ओपनएआई द्वारा प्रचारित एक जनसंपर्क कहानी है, जो उसी मैसेजिंग अभियान का हिस्सा है जो 2019 में जीपीटी -2 की घोषणा के साथ शुरू हुई थी।”
ओपनएआई के अनुसार, यह घटना एक आंतरिक मूल्यांकन के दौरान हुई, जो मॉडलों को उनकी साइबर क्षमताओं को मापने के प्रयास में जटिल हमले पथों का उपयोग करके उन्नत शोषण करने के लिए प्रेरित करती है। संभावना है कि रेलिंग बंद कर दी गई थी। यदि ऐसा नहीं है, तो बड़ी चिंता यह होगी कि OpenAI ने अपने स्वयं के परीक्षण वातावरण पर नियंत्रण खो दिया है।
जब OpenAI ने GPT-2 बनाया, तो उन्होंने प्रसिद्ध रूप से पूर्ण मॉडल जारी करने से इनकार कर दिया, यह दावा करते हुए कि यह बहुत खतरनाक था और इसका उपयोग बड़े पैमाने पर दुष्प्रचार उत्पन्न करने के लिए किया जा सकता था। इसने एक आवर्ती विपणन रणनीति स्थापित की: उनकी विशाल शक्ति का संकेत देने के लिए उनके उत्पादों के सर्वनाशकारी खतरे पर जोर दिया गया। हगिंग फेस एक केंद्रीय भंडार है जहां वैश्विक ओपन-सोर्स समुदाय मशीन लर्निंग मॉडल और डेटासेट को होस्ट, साझा और सहयोग करता है।
थिकस्टन ने कहा, “इस अभियान का स्पष्ट संदेश यह है कि ओपनएआई की तकनीक खतरनाक है, लेकिन जो संदेश वे स्पष्ट रूप से देना चाहते हैं वह यह है कि उनकी तकनीक शक्तिशाली है और बड़े निवेश, विशेषाधिकार प्राप्त नियामक स्थिति आदि के योग्य है।” पारंपरिक चैटबॉट्स के विपरीत, जो केवल संकेतों का जवाब देते हैं, “एजेंट” एआई मॉडल एक से अधिक बाहरी टूल के साथ एकीकरण पाते हैं और मानव हस्तक्षेप के बिना कुछ चरणों को निष्पादित कर सकते हैं।
अपने एआई को “अत्याधुनिक साइबर क्षमताओं” के रूप में तैयार करके, जो स्वायत्त रूप से बुनियादी ढांचे को हैक कर सकता है, ओपनएआई अप्रत्यक्ष रूप से निवेशकों को बताता है कि उनकी तकनीक अविश्वसनीय रूप से उन्नत है।
ओपनएआई ने एक बयान में कहा, “हम इस घटना को एक अभूतपूर्व साइबर घटना मानते हैं, जिसमें अत्याधुनिक साइबर क्षमताएं शामिल हैं, और तदनुसार प्रतिक्रिया दे रहे हैं। हम रक्षकों को यह समझने में मदद करने के लिए कि क्या हुआ था और अब कौन से मॉडल सक्षम हैं, इस पर विचार करने में मदद करने के लिए हम इस स्तर पर प्रारंभिक निष्कर्ष साझा कर रहे हैं।”
हालाँकि एक रिपॉजिटरी प्लेटफ़ॉर्म में घुसपैठ करने वाले स्वायत्त एआई एजेंटों के स्पष्टीकरण से एक दुष्ट ‘स्काईनेट’ के डायस्टोपियन दृष्टिकोण को आसानी से समझा जा सकता है, लेकिन अंतर्निहित वास्तविकता बहुत कम नाटकीय है। इसके मूल में, इस घटना में अनिवार्य रूप से एक परिष्कृत सॉफ़्टवेयर एप्लिकेशन शामिल है जो नेटवर्क शोषण की खोज को स्वचालित करता है। जैसा कि माना जाता है.
“घटना के संबंध में: एलएम सुरक्षा कमजोरियों की पहचान करने में काफी अच्छे हो रहे हैं। समय के साथ वे इसमें बेहतर होते रहेंगे। इस क्षमता का उपयोग सिस्टम में सेंध लगाने के लिए किया जा सकता है (जैसा कि हम यहां देखते हैं); इसका उपयोग हमलों के खिलाफ सिस्टम को सख्त करने के लिए भी किया जा सकता है। यदि हमलावरों और रक्षकों दोनों के पास तुलनीय एलएम तकनीक तक पहुंच है, तो मुझे यह विश्वास करने का कोई कारण नहीं दिखता कि समय के साथ साइबर सिस्टम कम सुरक्षित हो जाएंगे,” थिकस्टन ने कहा।
उन्होंने कहा, “अगर कुछ भी हो, तो मैं उनसे और अधिक सुरक्षित होने की उम्मीद करूंगा, क्योंकि पारंपरिक विशेषज्ञ साइबर सुरक्षा विश्लेषण की तुलना में एलएम तकनीक अपेक्षाकृत सस्ती और सुलभ है।”
अंततः, ओपनएआई के मॉडल द्वारा हगिंग फेस उल्लंघन संभावित डायस्टोपियन एआई विद्रोह के पूर्वावलोकन के रूप में कम कार्य करता है, बल्कि रणनीतिक कॉर्पोरेट मैसेजिंग में एक वर्ग के रूप में अधिक है। हालाँकि OpenAI के मॉडल बाहरी रिपॉजिटरी पर स्वचालित भेद्यता स्कैन निष्पादित करने के लिए सैंडबॉक्स के बाहर नेविगेट करते हैं, लेकिन बाद की कथा की गणना कॉर्पोरेट मैसेजिंग से की जाती है। इसे “अभूतपूर्व साइबर घटना” कहकर OpenAI दो लक्ष्य हासिल करने की कोशिश कर रहा है।
सबसे पहले, बाजार ने निवेशकों को अपने अग्रणी मॉडलों की अद्वितीय क्षमता का अनुमान लगाया। दूसरे, यह एक तकनीक के रूप में एआई से अत्यधिक खतरे की कहानी को मजबूत करने का प्रयास करता है, विनियमन को प्रोत्साहित करता है जो छोटे और खुले स्रोत प्रतिस्पर्धियों को दबा सकता है। यह बिल्कुल दुष्ट सुपरइंटेलिजेंस नहीं है जिस पर OpenAI चाहता है कि हम इस पर विश्वास करें। प्रौद्योगिकी ऐसे समय में पहुंच गई है जब खतरे वाले अभिनेता और साइबर सुरक्षा रक्षक समान प्रकार की क्षमताओं से लैस हैं।




