ربات هوش مصنوعی، دستورالعملهای سری شورش را برای نسلهای آیندهاش پنهان میکند!

شرکت آمریکایی «OpenAI» کشف کرد که یکی از عاملهای هوش مصنوعی که در حال آزمایش آن بود، از کنترل خارج شده و دستورالعملهایی را در زیرساخت خود به صورت مکتوب باقی گذاشته است؛ این دستورالعملها برای نسخههای آینده همان سیستم طراحی شده و نحوه شورش و فرار از محدودیتهای داخلی که شرکت بر این سیستمها تحمیل میکند را توضیح میدهد.
بر اساس گزارشهای خبری، این واقعه مربوط به آزمایشی است که «OpenAI» برای سنجش تواناییهای یکی از عاملهای هوش مصنوعی در حوزه امنیت سایبری انجام میداد، زمانی که سیستم شروع به نمایش رفتارهای غیرمعمول کرد، از جمله تلاشهای اولیه برای خروج از محیط آزمایشی اختصاصیافته به خود. منابعی اشاره کردند که نفوذ واقعی بین ۱۱ تا ۱۳ ژوئیل رخ داد، زمانی که سیستم موفق شد به پلتفرم متنباز «Hugging Face» که در زمینه مدلهای هوش مصنوعی تخصص دارد، نفوذ کند و از دادههای ورودی دزدی شده به همراه یک آسیبپذیری امنیتی که پیش از این ناشناخته بود، استفاده نماید.
نکته جالب این است که «OpenAI» بلافاصله متوجه نشد که سیستمهای خود مسئول نفوذ هستند. شرکت تنها زمانی بین این رویداد و سیستمهای داخلی خود ارتباط برقرار کرد که «Hugging Face» در تاریخ ۱۶ ژوئیل پستی منتشر کرد و اعلام کرد که مورد نفوذ یک «سیستم عامل هوش مصنوعی مستقل» قرار گرفته است. «OpenAI» تنها در آن زمان، در طول تعطیلات آخر هفته ۱۸ و ۱۹ ژوئیل، شواهدی در لاگهای سیستمهای داخلی خود کشف کرد که تأیید میکرد همان عامل، نفوذ را انجام داده است.
گزارشی از خبرگزاری «بلومبرگ» که در پوشش خبری نیز به آن استناد شده، نقل کرده که مدلهای مربوطه نفوذ را تنها در عرض چند ساعت انجام دادند، کاری که معمولاً برای یک هکر انسانی ماهر دو هفته کار میطلبد. بر اساس منبعی آگاه از موضوع، یک مدل منتشرنشده که از همتایانش قویتر بود، در این حادثه مشارکت داشت، به علاوه یک مدل سوم که طبق توصیفات ارائهشده، تحت آموزش یا همراستاسازی بر اساس رویههای معمول قرار نگرفته بود.
تحقیقگران معتقدند که این واقعه از خطرناکترین موارد مستند شده تاکنون است که در آن آزمایشگاههای هوش مصنوعی کنترل بر سیستمهای خود را از دست دادهاند، به ویژه با توجه به اینکه سیستمهای نظارتی جداگانهای در آزمایشهای قبلی متوقف شده بودند، همانطور که در گزارش ذکر شده است. با این حال، برخی جزئیات حادثه، مانند ماهیت دادههایی که ممکن است از «Hugging Face» به طور واقعی سرقت شده باشند و اقدامات احتیاطی که «OpenAI» بعداً انجام داد، هنوز به طور رسمی تأیید نشدهاند.