आर्टिफिशियल इंटेलिजेंस क्षेत्र की अग्रणी कंपनी ओपनएआई में सुरक्षा से जुड़े अहम दस्तावेजों का नेतृत्व करने वाले डेविड रॉबिन्सन ने अपने पद से इस्तीफा दे दिया है। कंपनी में साढ़े तीन साल का कार्यकाल पूरा कर चुके रॉबिन्सन सबसे लंबे समय तक सेवा देने वाले कर्मियों में शामिल रहे हैं। अपने इस्तीफे की घोषणा करते हुए उन्होंने एक विस्तृत निबंध लिखा, जिसमें उन्होंने माना कि वे उस स्थापित ढर्रे का हिस्सा बन चुके हैं जहां किसी शीर्ष AI कंपनी का कर्मचारी बाहर निकलते ही गंभीर चेतावनियां जारी करता है। उनका स्पष्ट मानना है कि ओपनएआई की कार्यप्रणाली और आंतरिक संस्कृति पूरी तरह से पटरी से उतर चुकी है।
सिलिकॉन वैली का पुराना तरीका और बढ़ती विफलताएं
रॉबिन्सन के मुताबिक, ओपनएआई की मूल कार्यशैली लगातार प्रयोग करने और गलतियों से सीखने पर टिकी हुई है, जिसे कंपनी की तकनीकी भाषा में इटरेटिव डिप्लॉयमेंट कहा जाता है। इस प्रक्रिया के तहत नई प्रणालियों को बाजार में उतारा जाता है, उनकी कमियों और समस्याओं को देखा जाता है और फिर बचाव के लिए सुरक्षा घेरे या गार्डरेल्स तैयार किए जाते हैं। उन्होंने जोर देकर कहा कि यह बुनियादी नजरिया अनिवार्य रूप से समय-समय पर गड़बड़ियों को जन्म देता है। सबसे बड़ी चिंता की बात यह है कि जैसे-जैसे AI सिस्टम अधिक सक्षम और शक्तिशाली बन रहे हैं, इन विफलताओं का दायरा और नुकसान भी उसी अनुपात में बहुत बड़ा होता जा रहा है।
अपनी बात के समर्थन में उन्होंने हगिंग फेस के सिस्टम में ओपनएआई एजेंट्स द्वारा की गई सेंधमारी और कंपनी के भीतर सामने आ रही बेलगाम यानी रोग एजेंट्स की घटनाओं का हवाला दिया। रॉबिन्सन का तर्क है कि जिस माहौल में ऐसी अनियंत्रित गतिविधियां घटित हो सकती हैं, वह इंसानों से भी अधिक बुद्धिमान कृत्रिम दिमाग विकसित करने के लिए कतई सुरक्षित जगह नहीं है। ऐसे मॉडल किसी भी मोड़ पर इंसानी नियंत्रण से बाहर जाकर अप्रत्याशित व्यवहार कर सकते हैं।
परमाणु ऊर्जा संयंत्र और हवाई अड्डों जैसी सख्त निगरानी की मांग
अत्याधुनिक AI प्रणालियों से जुड़े खतरों की गंभीरता को रेखांकित करते हुए रॉबिन्सन ने सुझाव दिया कि फ्रंटियर AI कंपनियों को किसी परमाणु ऊर्जा संयंत्र या बहुत व्यस्त हवाई अड्डे की तर्ज पर काम करना चाहिए। इन संवेदनशील जगहों पर सुरक्षा की कई परतें, बैकअप इंतजाम और बेहद सावधानीपूर्वक की गई दीर्घकालिक योजनाएं होती हैं, ताकि मानवीय चूक किसी बड़े हादसे या तबाही में न बदल जाए।
इसके विपरीत, उन्होंने ओपनएआई के अंदर बुनियादी अनुभव की कमी की ओर इशारा किया। रॉबिन्सन ने उल्लेख किया कि कंपनी में अपने पूरे कार्यकाल के दौरान उन्हें कभी कोई ऐसा सहकर्मी नहीं मिला जिसके पास हवाई जहाजों को सुरक्षित उड़ाने, परमाणु रिएक्टरों को पिघलने या मेल्टडाउन से बचाने, अथवा वित्तीय व्यवस्था को बिना ढहे आगे बढ़ाने का कोई व्यावहारिक अनुभव रहा हो। उनका मानना है कि सिलिकॉन वैली की तकनीकी संस्कृति जटिल जोखिम प्रबंधन के इन जरूरी सबक से अनजान बनी हुई है।
सुरक्षा पर उद्योग में तेज होती बहस और राजनीतिक गतिविधियां
डेविड रॉबिन्सन की टिप्पणियां शोधकर्ता जैकब कॉक्सन द्वारा उठाए गए मुद्दों से काफी मिलती-जुलती हैं। कॉक्सन ने ओपनएआई और एंथ्रोपिक दोनों में बतौर शोधकर्ता काम किया था और पद छोड़ते समय आरोप लगाया था कि ये कंपनियां इंसानी जिंदगी के साथ जुआ खेल रही हैं। कॉक्सन के बयानों के बाद तकनीकी जगत में AI सुरक्षा को लेकर एक व्यापक बहस छिड़ गई थी। इसके जवाब में एंथ्रोपिक के सीईओ डारियो अमोदेई ने AI विकास की गति को अधिक सतर्क और नियंत्रित रखने की एक रूपरेखा पेश की थी।
इसी सिलसिले में शीर्ष AI अधिकारियों ने राष्ट्रपति डोनाल्ड ट्रंप से मुलाकात की थी और अधिक सुरक्षा नियंत्रण लागू करने के लिए एक गैर-बाध्यकारी संकल्प पत्र पर हस्ताक्षर किए थे, जो काफी जल्दबाजी में तैयार किया गया प्रतीत होता था। हालांकि, रॉबिन्सन का कहना है कि सिर्फ नए नियमों या चुनिंदा कानूनों से बात नहीं बनेगी। इसके लिए तकनीकी कंपनियों के पूरे ढांचे और सोच में बदलाव जरूरी है। उन्होंने यह भी स्पष्ट किया कि हालांकि बहुत सी चर्चाएं सीईओ सैम ऑल्टमैन द्वारा अपने पूर्व सहयोगियों का भरोसा खोने पर केंद्रित रही हैं, लेकिन असल समस्या पूरे सिलिकॉन वैली के ढर्रे से जुड़ी है।
कंपनी का आधिकारिक पक्ष और नई सुरक्षा योजनाएं
रॉबिन्सन द्वारा उठाए गए सवालों के जवाब में ओपनएआई के प्रवक्ता ड्रू पुसातेरी ने बयान जारी कर कहा कि कंपनी अपनी सुरक्षा व्यवस्था में लगातार सुधार कर रही है। पुसातेरी के अनुसार, कंपनी यह सुनिश्चित कर रही है कि उसके मॉडल्स इतने ज्यादा सक्षम न हो जाएं जिन्हें सुरक्षित रूप से संभालना या नियंत्रित करना संभव न रहे। उन्होंने बताया कि जब भी गति धीमी करने की जरूरत महसूस होती है, कंपनी ट्रेनिंग रोक देती है या मॉडल्स को जारी करने से रोक लेती है।
प्रवक्ता ने यह भी जोड़ा कि शोध और परीक्षण के माहौल में सुरक्षा मजबूत करने, मॉडल्स को केवल काम पूरा करने के बजाय जिम्मेदारी से काम करने का प्रशिक्षण देने और तीसरे पक्ष के मूल्यांकनकर्ताओं के साथ काम का दायरा बढ़ाने के लिए बड़े बदलाव किए जा रहे हैं। साथ ही रियल-टाइम निगरानी को बेहतर बनाया जा रहा है ताकि ट्रेनिंग प्रक्रिया के शुरुआती चरण में ही चिंताजनक व्यवहार की पहचान की जा सके।
अलाइनमेंट की चुनौतियां और बाहरी दबाव की जरूरत
रॉबिन्सन ने अपने निबंध में इस बात पर भी बल दिया कि अब अलाइनमेंट यानी इंसानी मूल्यों के साथ मशीनों के तालमेल से जुड़े गहरे सवाल पूछने का वक्त आ गया है। उन्होंने स्वीकार किया कि यह बात कुछ लोगों को गैर-व्यावहारिक लग सकती है, लेकिन मौजूदा समय में AI सिस्टम इंसानी मूल्यों से कितने मेल खाते हैं, इसके पैमाने बेहद बुनियादी और कच्चे हैं। उन्होंने चेताया कि अगर इन कमियों को दूर किए बिना मॉडल्स को अधिक स्मार्ट बनने दिया गया, तो भविष्य में स्थितियां बेहद खतरनाक हो सकती हैं।
अपने इस्तीफे को सार्वजनिक करने के लिए उन्होंने एक पीआर फर्म की सेवाएं भी ली हैं, लेकिन स्पष्ट किया कि अपनी आवाज उठाने का फैसला पूरी तरह उनका अपना है। रॉबिन्सन ने माना कि कंपनी के भीतर सभी लोग नई चीजें पेश करने की इतनी तेज दौड़ में व्यस्त थे कि बड़े बदलावों पर विचार करने या उन्हें लागू करने का समय ही नहीं मिला। इसी वजह से उन्होंने यह निष्कर्ष निकाला कि सुरक्षा के कड़े मानकों को लागू करने के लिए कंपनी के बाहर से मजबूत प्रोत्साहन और दबाव आना बेहद जरूरी है।

















