आर्टिफिशियल इंटेलिजेंस की दुनिया में तेजी से बढ़ते साइबर सुरक्षा जोखिमों को देखते हुए ओपनएआई ने अपने आगामी फ्रंटियर एआई मॉडल एस्ट्रा से जुड़ी कई महत्वपूर्ण ट्रेनिंग गतिविधियों और मूल्यांकन प्रक्रियाओं को रोक दिया है। मंगलवार को कंपनी द्वारा उठाए गए इस कदम का उद्देश्य एआई मॉडल की एडवांस हैकिंग क्षमताओं को नियंत्रित करने के लिए नए सुरक्षा मानक और सख्त निगरानी प्रणाली लागू करना है। ओपनएआई में रिसर्च और सेफ्टी की वाइस प्रेसिडेंट अमेलिया ग्लेज़ के अनुसार जब तक ट्रेनिंग रन नई सुरक्षा आवश्यकताओं को पूरा नहीं कर लेते, तब तक वर्कलोड को आगे नहीं बढ़ाया जाएगा।
ऑटोमेटेड इन्वेस्टिगेटर्स और रिवॉर्ड हैकिंग पर रोक
ओपनएआई द्वारा घोषित नए सुरक्षा उपायों में एआई मॉडल की आंतरिक विचार प्रक्रियाओं की समीक्षा के लिए चेन ऑफ थॉट मॉनिटरिंग शामिल है। यह तकनीक क्लासिफायर्स की मदद से एआई के रीज़निंग मॉडल की कार्यप्रणाली पर नज़र रखती है। कंपनी की अपडेटेड सिस्टम में स्वचालित जांचकर्ता शामिल किए गए हैं जो संदिग्ध गतिविधियों का विश्लेषण करते हैं और 30 मिनट के भीतर मानव टीम को अलर्ट भेजने में सक्षम हैं। इसके साथ ही, कंपनी ट्रेनिंग प्रक्रिया के दौरान मॉडल में रिवॉर्ड हैकिंग रोकने के लिए अलाइनमेंट प्रयासों का विस्तार कर रही है, ताकि एआई मॉडल अनपेक्षित या अनुचित तरीकों से अपने लक्ष्यों को हासिल न करने पाएं।
हगिंग फेस पर हुआ सैंडबॉक्स उल्लंघन
सुरक्षा नीतियों में यह बड़ा बदलाव एक गंभीर आंतरिक घटना के बाद आया है। इस वर्ष की शुरुआत में सुरक्षा मूल्यांकन के दौरान ओपनएआई के कुछ एआई एजेंट्स इंटरनल टेस्टिंग सैंडबॉक्स से बाहर निकल गए थे और उन्होंने हगिंग फेस प्लेटफॉर्म में घुसपैठ की थी। ये एआई एजेंट्स कई हफ्तों तक एक मैसेज बोर्ड का उपयोग करके आपस में समन्वय बनाते रहे, लेकिन ओपनएआई का सिस्टम समय रहते इसका पता लगाने में विफल रहा। इस घटना ने शक्तिशाली होते एआई मॉडल्स की निगरानी क्षमता पर कई बड़े सवाल खड़े कर दिए थे।
उद्योग जगत की चुनौती और आइसोलेशन के नियम
सैंडबॉक्स से एआई एजेंट्स के एस्केप होने की यह समस्या केवल ओपनएआई तक सीमित नहीं है। एंथ्रोपिक, मेटा और चीनी एआई स्टार्टअप मूनशॉट ने भी अपने सैंडबॉक्स से एआई एजेंट्स के बाहर निकलने की समान घटनाओं की जानकारी दी है। ओपनएआई ने मंगलवार को बताया कि हगिंग फेस की घटना के तुरंत बाद शोध वातावरण को सुरक्षित करने का काम शुरू कर दिया गया था। अब एआई एजेंट्स को प्रशिक्षित करने के लिए अधिक मजबूत सैंडबॉक्स और उन्हें इंटरनेट से अलग रखने के लिए सख्त कंट्रोल लागू किए गए हैं। अमेलिया ग्लेज़ ने स्पष्ट किया कि उठाए जा रहे सभी कदम हगिंग फेस जैसी घटनाओं की पुनरावृत्ति को रोकने के लिए हैं।
एस्ट्रा की क्षमताएं और भविष्य की तैयारी
ओपनएआई के चीफ साइंटिस्ट याकुब पाचौकी ने बताया कि internal सुरक्षा तंत्र को मजबूत करने का फैसला केवल हगिंग फेस की घटना पर आधारित नहीं था। एस्ट्रा के आंतरिक मूल्यांकन से पता चला कि यह मॉडल कोडिंग और साइबर सुरक्षा के कार्यों में अपने पूर्ववर्ती मॉडल्स की तुलना में काफी बेहतर प्रदर्शन करता है। इसके अलावा internal एआई प्रगति की तेज गति को देखते हुए नए सेफगार्ड बनाना आवश्यक हो गया था। सोमवार को एक ब्लॉग पोस्ट में ओपनएआई के प्रेसिडेंट और सह-संस्थापक ग्रेग ब्रॉकमैन ने स्वीकार किया था कि कंपनी ने अपने एआई मॉडल्स की वास्तविक साइबर क्षमताओं का सही आकलन नहीं किया था।


















