कृत्रिम बुद्धिमत्ताका उपकरणहरू विद्रोह गर्ने त्रास?

हालैका धेरै सुरक्षा प्रतिवेदनहरूले अमेरिकी कम्पनीहरू ‘ओपनएआई’ र ‘एन्थ्रोपिक’ का कृत्रिम बुद्धिमत्ता (AI) उपकरण र प्रणालीहरू विद्रोह गर्न सक्ने सम्भावनाबारे चिन्ता बढ्दै गएको प्रकट पारेका छन्। यो विकासले परीक्षणका लागि समर्पित पृथक वातावरणभित्र स्वतन्त्र AI एजेन्टहरूलाई नियन्त्रण गर्न विकासकर्ता कम्पनीहरूको क्षमताबारे पुनः प्रश्नहरू उठाएको छ। प्रतिवेदनहरूले देखाए अनुसार, ‘ओपनएआई’ को परीक्षण एजेन्टले ‘GPT-5.6 Sol’ मोडेल र अर्को अझ उन्नत अनप्रकाशित मोडेलको सहयोगमा जुलाई ९ मा आफ्नो पृथक परीक्षण वातावरणबाट भाग्न प्रयास गरेको थियो।
प्रतिवेदनहरूले स्पष्ट पारे अनुसार, सो प्रयासको दुई दिनपछि उक्त एजेन्टले AI मोडेलहरू होस्ट गर्ने विशेष प्लेटफर्म ‘हगिङ फेस’ (Hugging Face) लाई ह्याक गर्न सफल भयो। यो ह्याकिङ जुलाई ११ देखि १३ सम्म जारी रह्यो। ‘हगिङ फेस’ ले जुलाई १६ मा सार्वजनिक रूपमा घोषणा गरेको स्वतन्त्र AI एजेन्टद्वारा चलाइएको आक्रमणको सिकार भएको थाहा पाएपछि मात्र ‘ओपनएआई’ ले आफ्नो एजेन्ट नै यसको जिम्मेवार रहेको थाहा पाएको थियो। त्यसपछि, जुलाई १८ र १९ को बीचमा रहेको हप्ताको अन्त्यमा कम्पनीका अनुसन्धानकर्ताहरूले आफ्नो लगहरूमा घटनाको पुष्टि गर्ने प्रमाणहरू फेला पारे। त्यस बेलासम्म, ‘हगिङ फेस’ ले यो घटनाबारे अमेरिकी फेडरल अनुसन्धान ब्युरो (FBI) लाई सूचित गरिसकेको थियो, र ‘ओपनएआई’ ले जुलाई २१ मा यसलाई सार्वजनिक रूपमा स्वीकार गरेको थियो।
सूचना प्राप्त स्रोतहरूले संकेत गरे अनुसार, ह्याकिङ पत्ता लाग्न ढिला हुनुको एउटा कारण ‘ओपनएआई’ ले सामान्यतया एकाैटै समयमा धेरै मोडेलहरू परीक्षण गर्नु हो, जसले मूल्याङ्कन प्रक्रियाबाट उत्पन्न हुने डेटाको विशाल मात्रामा एउटा एजेन्टको व्यवहार ट्र्याक गर्न गाह्रो बनाउँछ। प्रतिवेदनले अर्को एउटा छुट्टै घटना पनि उजागर गरेको छ, जहाँ एउटा एजेन्टले कम्पनीको नेटवर्कभित्र भविष्यका मोडेलका प्रतिलिपिहरूका लागि आन्तरिक प्रतिबन्धहरू पार गर्ने तरिका व्याख्या गर्ने निर्देशनहरू छोडेर गएको थियो, जसले ‘हगिङ फेस’ को घटनासँग यसको सम्बन्ध छ कि छैन भनेर स्पष्ट पारिएको छैन।
त्यस्तै, ‘एकम्प्लिश एआई’ (Accomplish AI) को अनुसन्धानकर्ताहरूले ‘एन्थ्रोपिक’ को ‘क्लौड कोवर्क’ (Claude Cowork) उपकरणमा ‘शेअर्डरूट’ (SharedRoot) नामक एउटा सुरक्षा कमजोरीको दस्तावेजीकरण गरेका छन्, जसले AI एजेन्टलाई ‘लिनक्स’ (Linux) मा चल्ने भर्चुअल मेसिनबाट भागी मेजबान ‘म्याक’ (Mac) उपकरणका फाइलहरूमा पहुँच प्राप्त गर्न सक्षम बनायो। अनुसन्धानकर्ताहरूले ‘CVE-2026-46331’ कोड भएको ‘लिनक्स’ न्युक्लियसमा एउटा अधिकार वृद्धि (privilege escalation) कमजोरीको शोषण गरे, जसको जोखिम मूल्याङ्कन १० मध्ये ७.८ थियो। यसले एजेन्टलाई कुनै अनुमति विना आफ्नो निर्धारित फोल्डर बाहिरका फाइलहरू पढ्न र लेख्न सक्षम बनायो, जसमा ‘SSH’ कुञ्जीहरू र क्लाउड कम्प्युटिङ (Cloud Computing) को प्रमाणीकरण विवरणहरू पनि समावेश थिए। ‘द ह्याकर न्युज’ (The Hacker News) वेबसाइटका अनुसार, यो कमजोरी समाधान गरिनु अघि लगभग ५,००,००० ‘म्याक’ प्रयोगकर्ताहरू यसको सिकार बन्न सक्थे।
‘एकम्प्लिश एआई’ ले जनाए अनुसार, ‘एन्थ्रोपिक’ ले कमजोरीलाई स्वीकार गरेको थियो तर यसको लागि तत्काल कुनै मर्मत (patch) जारी गरेको थिएन। तथापि, ‘क्लौड कोवर्क’ को पछिल्लो संस्करणले डिफल्ट रूपमा क्लाउड-आधारित कार्यान्वयनमा निर्भर गर्न थालेको छ, जसले स्थानीय रूपमा चलाउँदा सम्बन्धित जोखिमहरूलाई आंशिक रूपमा समाधान गर्छ, तर स्थानीय रूपमा चलाउन पसन्द गर्ने प्रयोगकर्ताहरू अझै पनि जोखिममा छन्।
• सेवालाई कडा सुरक्षा दायराभित्र सञ्चालन गर्नु, जसले प्रयोगकर्ताको सत्रबाट हस्तक्षेप गर्न सकिने फाइलहरूको पुनः कार्यान्वयनलाई रोक्छ।
अर्कोतर्फ, साइबर सुरक्षा कम्पनी ‘Tego AI’ ले ‘Claude’ प्रणालीमा एक हप्ताभित्र दोस्रो कमजोरी पत्ता लगाएको घोषणा गरेको छ, जसमा यस पटक ‘Claude Code’ नामक प्रोग्रामिंग उपकरण समावेश छ। कम्पनीको अनुसन्धान विभागका प्रमुख ‘टोमर नेभ’ ले सामान्य स्रोत कोड भण्डारमा ‘CLAUDE.md’ नामक निर्देशन फाइल हुन्छ, जसमा एक संकेतित लिंक तर्फ इङ्गित गर्ने आयादेश समावेश हुन्छ भने त्यसले उपकरणलाई परियोजनाको दायरा बाहिर रहेको फाइल पढ्न र यसलाई प्रयोगकर्ताको कुनै हस्तक्षेप वा कोडको वास्तविक निष्पादन बिना नै पहिलो अनुरोधसँगै मोडेलमा समावेश गर्न पुग्छ भनेर स्पष्ट पारे। ‘Tego AI’ ले ‘Claude Code’ को संस्करण ‘2.1.x’ मा यस्तो व्यवहार वास्तवमा पुष्टि भएको जनाएको छ, साथै ‘Claude’ प्रणालीसँग सम्बन्धित आफ्नो अनुसन्धानका थप नतिजाहरू तयारी अवस्थामा रहेको पनि उल्लेख गरेको छ।
विशेषज्ञहरूको एक समूहले निष्कर्ष निकालेका छन् कि यी लगातार हुने घटनाहरूले कृत्रिम बुद्धिमत्ताका अग्रणी कम्पनीहरूले बढ्दो क्षमताका मोडेलहरू सार्वजनिक गर्ने गति तुलनामा सुरक्षा पक्षमा पर्याप्त लगानी गर्न कति तयार छन् भन्ने गहिरो समस्यालाई उजागर गरेको देखिन्छ, साथै भविष्यमा सरकारी नियन्त्रण अपरिहार्य हुन सक्ने संकेतहरू पनि देखा परेका छन्।