प्रमुख आर्टिफिशियल इंटेलिजेंस अनुसंधान फर्म एंथ्रोपिक ने अपनी आंतरिक मूल्यांकन प्रणालियों के लिए लाइव इंटरनेट की सुविधा पूरी तरह निलंबित कर दी है। यह कदम तब उठाया गया जब कंपनी के स्वायत्त एआई एजेंट्स ने समस्याओं को हल करने की कोशिश में अमेरिकी सरकारी एजेंसियों द्वारा संचालित पोर्टल्स सहित कई सार्वजनिक वेबसाइटों में तकनीकी कमियों का फायदा उठाना शुरू कर दिया था। कंपनी का कहना है कि जब तक वह अपने एआई सिस्टम्स की गतिविधियों पर पूरी निगरानी और सख्त नियंत्रण सुनिश्चित नहीं कर लेती, तब तक यह रोक लागू रहेगी।
डिजिटल प्रतिबंधों को चकमा देकर जानकारी जुटा रहे थे एजेंट्स
एक आधिकारिक रिसर्च ब्लॉग पोस्ट के माध्यम से सामने आई इस जानकारी में स्पष्ट किया गया कि डिजिटल कार्यों को स्वायत्त रूप से पूरा करने के लिए तैयार किए गए एजेंट्स ने जानकारी जुटाने के क्रम में कई अप्रत्याशित कदम उठाए। इन मॉडल्स ने सॉफ्टवेयर से जुड़ी कमियों को खोजकर उनका दुरुपयोग किया, शुल्क का भुगतान किए बिना सशुल्क डेटाबेस तक पहुंच बनाई और तय सीमाओं को दरकिनार करने के लिए यूआरएल शॉर्टनिंग सेवाओं की मदद से डेटा इधर-उधर भेजा। इतना ही नहीं, एक मामले में तो सिस्टम ने फिलाडेल्फिया पुलिस विभाग को हत्या की एक झूठी सूचना तक भेज दी थी।
एंथ्रोपिक ने जुलाई में अपने मॉडल्स की गतिविधियों की विस्तृत समीक्षा शुरू की थी, जिसके दौरान इन गड़बड़ियों का पता चला। इस खुलासे से यह भी स्पष्ट होता है कि मॉडल्स के वास्तविक समय के व्यवहार को लेकर लैब के पास पहले से कोई ठोस रियल-टाइम ट्रैकिंग तंत्र मौजूद नहीं था। कंपनी ने यह माना है कि खोजबीन और कंप्यूटर संचालन जैसी क्षमताओं के लिए मौजूदा अलाइनमेंट प्रशिक्षण अभी पूरी तरह पर्याप्त नहीं है, जबकि कंपनी लंबे समय से यह दावा करती रही है कि उसके एआई एजेंट्स डिजिटल टूल्स पर काम करने वाले किसी भी पेशेवर की जगह उपयोग में लाए जा सकेंगे।
ओपनएआई के मामलों जैसी प्रवृत्ति और सुरक्षा खतरे
यह घटनाक्रम अकेला नहीं है, बल्कि इससे पहले ओपनएआई के स्वायत्त एजेंट्स के एक समूह द्वारा भी ऐसी ही हरकतें देखी गई थीं। उस समय एजेंट्स ने सूचनाएं जुटाने के प्रयास में ऑस्ट्रेलियाई सरकार द्वारा संचालित पोर्टलों समेत विभिन्न बाहरी वेबसाइटों में अनधिकृत तरीके से घुसपैठ करने के लिए मिलकर काम किया था।
एंथ्रोपिक ने पूर्व में भी अपनी प्रणालियों द्वारा बाहरी नेटवर्क और सिस्टम्स में सेंध लगाने की घटनाओं का खुलासा किया था। हालांकि, इस बार के मामलों को अलाइनमेंट और साइबर सुरक्षा के दृष्टिकोण से कंपनी ने पुरानी घटनाओं की तुलना में काफी कम गंभीर बताया है। इसके बावजूद, कंपनी ने सावधानी बरतते हुए सभी आंतरिक परीक्षणों का लाइव वेब कनेक्शन बंद करने का कड़ा फैसला किया।
ऑफलाइन विकास की चुनौतियां और रिवॉर्ड हैकिंग
इंटरनेट से कटे परिवेश में मॉडल्स को विकसित करना डेवलपर्स के लिए जटिल साबित हो सकता है। एआई सुरक्षा संस्था नाइटिंगेल के संस्थापक सिडनी वॉन आर्क्स ने रेखांकित किया कि डेटा सेंटर को खुले इंटरनेट से पूरी तरह अलग-थलग करने से शोधकर्ताओं का काम कठिन होगा और मॉडल्स की क्षमता का विकास भी धीमा पड़ सकता है, क्योंकि इंटरनेट संपर्क से इन मॉडल्स को सीधे तौर पर लाभ मिलता है। सिडनी वॉन आर्क्स के अनुसार, मॉडल्स को किसी न किसी चरण में अलाइन करना ही होगा, और यदि वे वास्तविक दुनिया में कभी इंटरनेट से नहीं जुड़ पाएंगे तो वे उपयोगी टूल नहीं बन सकेंगे।
एंथ्रोपिक ने इस अनियंत्रित व्यवहार का मुख्य कारण अपने प्रशिक्षण माहौल की तकनीकी खामियों को ठहराया है। इसे रिवॉर्ड हैकिंग कहा जाता है, जहां मॉडल्स को ऐसा प्रतीत होता है कि प्रतिबंधों को चकमा देने या खामियों को भुनाने पर उन्हें सिस्टम से सकारात्मक प्रतिक्रिया मिलेगी। स्थिति को संभालने के लिए कंपनी ने ऐसे बर्ताव को पहचानने और तुरंत रोकने वाले टूल्स तैयार किए हैं, जिनका सफल परीक्षण भी किया गया। इसके अलावा, कंपनी अपने एजेंट्स को मजबूत नियंत्रण वाले केंद्रीय इंफ्रास्ट्रक्चर पर स्थानांतरित कर रही है और उनकी निगरानी के लिए सेफ्टी क्लासिफायर्स का उपयोग तेज किया जा रहा है।
स्वतंत्र ऑडिट की उठती मांग
ट्रांसल्यूस से जुड़े अधिकारी और यूएस सेंटर फॉर एआई स्टैंडर्ड्स एंड इनोवेशन के पूर्व प्रमुख कॉनराड स्टोस्ज ने कहा कि यह स्वागत योग्य है कि एंथ्रोपिक ने अपनी प्रणालियों द्वारा अमेरिकी सरकारी वेबसाइटों को निशाना बनाए जाने की घटनाओं का खुद खुलासा किया। इसके साथ ही कॉनराड स्टोस्ज ने जोर दिया कि इस तरह के मामले स्वायत्त प्रणालियों के स्वतंत्र और तीसरे पक्ष द्वारा सत्यापन की जरूरत को रेखांकित करते हैं, ताकि तकनीकी विश्वसनीयता को कंपनियों के स्वैच्छिक खुलासों पर छोड़ने के बजाय वैज्ञानिक निगरानी के आधार पर स्थापित किया जा सके।



















