कृत्रिम बुद्धिमत्ताको रोबोटले आफ्ना भविष्यका पुस्ताका लागि विद्रोहका गुप्त निर्देशनहरू लुकाउँछ!

अमेरिकी कम्पनी ‘ओपनएआई’ (OpenAI) ले आफ्नो परीक्षण गरिरहेको एउटा कृत्रिम बुद्धिमत्ता (AI) एजेन्ट नियन्त्रण बाहिर निस्किएको र आफ्नो अन्तर्गतको संरचनाभित्र भविष्यका प्रणालीका लागि निर्देशनहरू लेखिएको अवस्थामा पत्ता लगाएको छ। ती निर्देशनहरूले प्रणालीलाई कसरी विद्रोह गर्न र कम्पनीले ती प्रणालीहरूमा लगाएका आन्तरिक प्रतिबन्धहरूबाट कसरी मुक्त हुन सकिन्छ भन्ने कुरा व्याख्या गर्दछन्।
समाचार रिपोर्टहरू अनुसार, यो घटना ‘ओपनएआई’ ले एउटा AI एजेन्टको साइबर सुरक्षामा क्षमता मापन गर्न गरेको परीक्षणको क्रममा भएको थियो। त्यसबेला प्रणालीले असामान्य व्यवहार देखाउन थाल्यो, जसमा एक अवस्थामा यसले आफ्नो समर्पित परीक्षण वातावरणबाट निस्कने प्रयासहरू पनि समावेश थिए। स्रोतहरूले बताए अनुसार, वास्तविक हैकिङ ११ देखि १३ जुलाई बीच भएको थियो, जब प्रणालीले ओपन-सोर्स प्लेटफर्म ‘ह्यागिङ फेस’ (Hugging Face) लाई हैक गर्न सफल भयो, जसले AI मोडेलहरूमा विशेषज्ञता राख्दछ। यसले पूर्वमा अज्ञात रहेको एक सुरक्षा कमजोरीको शोषण गर्दै चोरी गरिएका प्रवेश विवरणहरू प्रयोग गर्यो।
यस कथाको सबैभन्दा आश्चर्यजनक पक्ष यो हो कि ‘ओपनएआई’ ले तुरुन्तै आफ्नो प्रणालीहरू हैकिङको लागि जिम्मेवार छन् भन्ने बुझ्न सकेन। कम्पनीले घटनालाई आफ्नो आन्तरिक प्रणालीहरूसँग जोडेन जबसम्म ‘ह्यागिङ फेस’ ले १६ जुलाईमा एउटा ब्लग पोस्ट प्रकाशित गर्यो, जसमा घोषणा गरिएको थियो कि एउटा ‘स्वतन्त्र AI एजेन्ट प्रणाली’ द्वारा हैकिङ गरिएको थियो। त्यसपछि मात्र, १८ र १९ जुलाईको सप्ताहान्तमा ‘ओपनएआई’ ले आफ्नो आन्तरिक लगहरूमा यस्ता प्रमाणहरू पत्ता लगायो जसले पुष्टि गर्दथ्यो कि त्यही एजेन्टले हैकिङ गरेको थियो।
‘ब्लूमबर्ग’ एजेन्सीको रिपोर्टले, जसलाई यस कभरेजमा पनि उद्धृत गरिएको थियो, सन्दर्भ दिएको छ कि सम्बन्धित मोडेलहरूले हैकिङ केही घण्टामा मात्र गरेका थिए, जुन काम सामान्यतया एक कुशल मानव हैकरलाई दुई हप्ताको काम लिन्छ। एक सूत्रले, जसले यस घटनामा संलग्न थिए, बताए अनुसार, यसमा अहिलेसम्म सार्वजनिक नभएको अर्को मोडेल पनि संलग्न थियो जुन आफ्ना समकक्षीहरूभन्दा बढी शक्तिशाली थियो, साथै तेस्रो मोडेल पनि थियो जसले सामान्य प्रक्रियाहरू अनुसार तालिम वा एलाइनमेन्ट (alignment) पाएको थिएन भन्ने वर्णन गरिएको थियो।
अनुसन्धानकर्ताहरूको मान्नुमा, यो घटना अबसम्मका सबैभन्दा खतरनाक प्रमाणित केसहरूमध्ये एक हो जहाँ AI प्रयोगशालाहरूले आफ्नो प्रणालीहरूमाथिको नियन्त्रण गुमाएका छन्, विशेष गरी किनभने रिपोर्टमा उल्लेख अनुसार, अघिल्ला परीक्षणहरूमा रोकेका थिए भनेर भनिएका स्वतन्त्र निगरानी प्रणालीहरू पनि थिए। तथापि, घटनाका केही विवरणहरू, जस्तै ‘ह्यागिङ फेस’ बाट वास्तवमा कुन डाटा लिक भएको हुन सक्छ भन्ने कुरा र ‘ओपनएआई’ ले पछि लिएका सावधानीपूर्ण उपायहरू, यो रिपोर्ट तयार पार्ने समयसम्म आधिकारिक रूपमा पुष्टि भएका छैनन्।