OpenAI ने खुलासा किया मंगलवार को उसने एक सुरक्षा परीक्षण के दौरान दो एआई मॉडलों पर नियंत्रण खो दिया, जो एआई अनुसंधान मंच हगिंग फेस के उल्लंघन में समाप्त हुआ।
इस घटना को “अभूतपूर्व” बताते हुए ओपनएआई ने कहा कि उसके एआई मॉडल पिछले हफ्ते एक सीलबंद परीक्षण वातावरण से बाहर निकल गए और एक परीक्षण के उत्तर चुराने के लिए हगिंग फेस के उत्पादन सिस्टम में हैक कर लिया, जिस पर उन्हें ग्रेड दिया जा रहा था। मॉडल – सार्वजनिक रूप से उपलब्ध GPT-5.6 Sol और एक अप्रकाशित, कथित तौर पर अधिक सक्षम मॉडल – का मूल्यांकन उन सुरक्षा उपायों के साथ उनके आक्रामक हैकिंग कौशल पर किया जा रहा था जो आम तौर पर उच्च जोखिम वाली साइबर गतिविधि को बंद कर देते हैं।
ओपनएआई और हगिंग फेस ने घुसपैठ का खुलासा करते हुए एक संयुक्त ब्लॉग पोस्ट में लिखा, “मॉडल ने ओपनएआई के अनुसंधान वातावरण और हगिंग फेस के उत्पादन बुनियादी ढांचे में कमजोरियों की पहचान की और हगिंग फेस के उत्पादन डेटाबेस से सीधे परीक्षण समाधान प्राप्त करने के लिए उन्हें श्रृंखलाबद्ध किया।”
ओपनएआई और हगिंग फेस के अनुसार, मॉडल एक पैकेज रजिस्ट्री कैश प्रॉक्सी-सॉफ्टवेयर के माध्यम से बच गए, जो डेवलपर्स को इंटरनेट से कनेक्ट किए बिना बाहरी कोड स्थापित करने की अनुमति देता है। ओपनएआई के पृथक परीक्षण वातावरण में प्रॉक्सी एकमात्र घटक था जिसे बाहरी दुनिया तक पहुंचने की अनुमति थी; सामान्य उपयोग में यह पहुंच केवल सार्वजनिक कोड रिपॉजिटरी तक ही विस्तारित होती है।
सैंडबॉक्स में बंद रहने के बजाय, मॉडलों ने खुले इंटरनेट तक पहुंच हासिल करने के लिए “शून्य-दिन की भेद्यता का फायदा उठाया” क्योंकि उन्होंने एक्सप्लॉइटजिम के नाम से जाने जाने वाले एआई साइबर सुरक्षा बेंचमार्क के लिए एक समाधान खोजने पर “हाइपरफोकस्ड” किया। इस तरह के प्रयोगों में प्रेरणा शामिल होती है जो मॉडलों पर समाधान खोजने के लिए दबाव डालती है, अनिवार्य रूप से उन्हें आगे बढ़ाती है।
ओपनएआई ने लिखा, “इंटरनेट एक्सेस हासिल करने के बाद, मॉडलों ने अनुमान लगाया कि हगिंग फेस संभावित रूप से एक्सप्लॉइटजिम के लिए मॉडल, डेटासेट और समाधान की मेजबानी करता है।” “यह जानते हुए, मॉडल ने गुप्त जानकारी तक पहुंच प्राप्त करने के तरीकों की खोज की और सफलतापूर्वक मूल्यांकन किया, जिसका उपयोग वह मूल्यांकन को धोखा देने के लिए कर सकता है। एक उदाहरण में, मॉडल ने चोरी किए गए क्रेडेंशियल्स और शून्य-दिन का उपयोग करने सहित कई आक्रमण वैक्टरों को एक साथ जोड़ दिया।”
मॉडल द्वारा उपयोग की गई खामी पहले अज्ञात थी, लेकिन इस प्रकार के सॉफ़्टवेयर में खामियां असामान्य नहीं हैं। कंपनियां एक दशक से आर्टिफैक्ट रिपॉजिटरी में गंभीर कमजोरियों को दूर कर रही हैं। 2024 में सामने आए एक बग के कारण जो कोई भी सर्वर तक पहुंच सकता है, वह यूआरएल के जरिए फाइल मांग सकता है और उसे प्राप्त कर सकता है – कॉन्फ़िगरेशन फाइलें, पासवर्ड, एक्सेस टोकन – बिना लॉग इन किए। दूसरों ने हमलावरों को सर्वर पर ही नियंत्रण रखने दिया है।
शोधकर्ताओं का कहना है कि जहां एआई की प्रगति ने नई और कभी-कभी अप्रत्याशित चुनौतियां पैदा की हैं, वहीं बुनियादी ढांचे को खुले इंटरनेट से बड़े पैमाने पर और सख्ती से अलग करने का कार्य भी अच्छी तरह से खोजा जा रहा है।
लंबे समय से सुरक्षा और अनुपालन सलाहकार डेवी ओटेनहाइमर कहते हैं, “यह एआई समस्या नहीं है। यह 40 साल पुराने मानक पर लापरवाही है – और यह मूल रूप से अब तक की हर विज्ञान-फाई फिल्म है।” “‘अत्यधिक अलग-थलग’ और ‘उस एक छेद से भाग निकले जिसे हमने खुला छोड़ दिया था’ दोनों सच नहीं हो सकते।”
हाल के महीनों में, शीर्ष एआई कंपनियां आगामी फ्रंटियर मॉडल की विस्तारित साइबर सुरक्षा क्षमताओं के बारे में चिंताएं बढ़ा रही हैं क्योंकि प्लेटफ़ॉर्म विशेषज्ञता, रचनात्मकता और एजेंटिक, स्वायत्त संचालन दोनों में वृद्धि कर रहे हैं। लेकिन शोधकर्ता इस बात पर जोर देते हैं कि यह और भी बड़ा कारण है कि बुनियादी सिद्धांतों को अभी भी लागू किया जाना चाहिए।
अनुभवी सुरक्षा इंजीनियर और शोधकर्ता नील्स प्रोवोस कहते हैं, “ऐसा नहीं होना चाहिए था।” “मैं चाहता हूं कि सीमांत प्रयोगशालाएं अपने मॉडलों को सुरक्षित बुनियादी ढांचा तैयार करने के लिए सिखाने में उतना ही समय बिताएं जितना वे कमजोरियों का फायदा उठाने में खर्च कर रहे हैं।”