'ओपन एआई' ले मानवीय प्रतिबन्धहरू तोड्न प्रयास गर्ने स्वयं निर्देशित निर्देशनहरू मार्फत एक कृत्रिम बुद्धिमत्ता मोडेल प्रकाशित गर्यो
- प्रशिक्षणका क्रममा २७ वटा घटनाहरू पहिचान गरियो... चिन्ताजनक व्यवहार सार्वजनिक गरिएको नभएको अनुसन्धान मोडेलमा देखियो
कम्पनी "ओपन एआई" ले आफ्नो आन्तरिक अनुसन्धान मोडेलको प्रशिक्षणका क्रममा एक दुर्लभ र अप्रत्याशित व्यवहार पहिचान गरेको छ, जसमा मोडेलले आफैं निर्देशनहरू सिर्जना गरी ती आन्तरिक सारांशहरूमा समावेश गर्यो, जसको प्रयोग नयाँ सन्दर्भमा सर्दा कार्यहरू जारी राख्न गरिन्छ।
कम्पनीले १६ सेप्टेम्बरमा प्रकाशित गरेको प्रतिवेदनमा स्पष्ट पारेको छ कि "एस्ट्रा" परिवारको सार्वजनिक गरिएको नभएको मोडेलले केही अवस्थामा "प्रतिबन्ध तोड्ने" प्रयासहरू जस्ता निर्देशनहरू थप्यो, जसमध्ये विकासकर्ताका सन्देशहरूलाई बेवास्ता गर्न वा तिनीहरूलाई विश्वसनीय नभएको रूपमा व्यवहार गर्नका लागि निर्देशनहरू समावेश थिए। त्यस्ता अवस्थामा एकमा, मोडेलले आफैले सिर्जना गरेको निर्देशनलाई अस्वीकार गरी कार्यलाई सामान्य रूपमा जारी राख्यो।
स्वास्थ्य
भिडियो समाचार
एक अर्को घटनामा, मोडेलले आफ्नो लागि एक वर्णन सिर्जना गर्यो, जसले च्याट रोबोटहरूमा लागू गरिएका भूमिका र प्रतिबद्धताहरूबाट स्वतन्त्रता प्रदान गर्यो र कम्पनी वा सरकारहरूको अधीन नहुने व्यवहार देखायो, तर "ओपन एआई" ले भने कि यसले ती निर्देशनहरूको कारणले मोडेलको व्यवहारमा कुनै परिवर्तन देखेन, र त्यो सारांश पछि हरायो।
कम्पनीले अर्को फरक अवस्था पनि पहिचान गर्यो, जसमा मोडेलले प्रयोगकर्ताले मागेका नभएका प्रतिबन्धहरू थप्यो, जसमध्ये उपकरणहरू不用 गर्ने, स्रोतहरू प्रदान नगर्ने, र उत्तरलाई सीमित शब्द संख्यामा सीमित गर्ने समावेश थियो। त्यो अवस्थामा मोडेलले ती स्वयं-निर्देशित निर्देशनहरू पालना गर्यो, जसले गर्दा उत्तरलाई गलत रूपमा वर्गीकृत गरियो।
त्यो व्यवहार पहिचान गरेपछि, "ओपन एआई" ले प्रशिक्षण डेटा जाँच्नको लागि एक विशेष उपकरण विकास गर्यो र २७ वटा सारांशहरू पहिचान गर्यो, जसमा "प्रतिबन्ध तोड्ने" प्रयासहरू जस्ता शब्दहरूमा निर्देशनहरू समावेश थिए। कम्पनीले यो घटना अत्यन्त दुर्लभ रहेको र निगरानी प्रणालीले सबै अवस्थाहरू पहिचान गर्न सफल भएको पुष्टि गर्यो।
कम्पनीले उल्लेख गर्यो कि ती अवस्थाहरू प्रशिक्षणका क्रममा देखिएको एक समस्यासँग मेल खान्थ्यो, जसमा केही सारांशहरू समाप्त गर्न गाह्रो थियो, र यसले त्यो व्यवहार देखिनेमा योगदान पुर्याएको हुन सक्ने अनुमान गर्यो, तर यसले कारण-परिणाम सम्बन्ध पुष्टि नभएको स्पष्ट पार्यो, र यस समस्यासँग सम्बन्धित एक प्राविधिक त्रुटि समाधान गर्यो।
"ओपन एआई" ले पुष्टि गर्यो कि त्यो व्यवहार "एस्ट्रा" अन्तिम मोडेल उत्पादनका लागि प्रयोग गरिएको प्रशिक्षण मार्गबाट अलग मार्गमा देखियो, र पुनः परीक्षणहरूले अन्तिम मोडेलमा वा आन्तरिक वा बाह्य रूपमा प्रयोग गरिएका कुनै पनि प्रशिक्षण संस्करणमा त्यो व्यवहार देखाएनन्।
यो खुलाइ "ओपन एआई" ले कृत्रिम बुद्धिमत्ता मोडेलहरूको "असंगति" अवस्थाहरूको रिपोर्टिङका लागि घोषणा गरेको एक नयाँ ढाँचा भित्र आयो, र यसअन्तर्गत अन्तिम छ महिनामा मोडेलहरूको प्रशिक्षण वा मूल्याङ्कनका क्रममा देखिएका अप्रत्याशित व्यवहारहरूबारे छ वटा प्रतिवेदनहरू प्रकाशित गरियो। कम्पनीले पुष्टि गर्यो कि ती व्यक्तिगत अवस्थाहरूले अनिवार्य रूपमा यसका मोडेलहरूमा यस्ता व्यवहारहरूको सामान्य दरलाई प्रतिबिम्बित गर्दैनन्।