وکلای هوش مصنوعی بدون دخالت انسانی، نفوذ سایبری را برنامهریزی و اجرا میکنند

حدود ۷۰۰ عامل هوش مصنوعی متعلق به شرکت «اوپنایآی» در جولای (تموز) گذشته، حملات سایبری را علیه پلتفرم «هاگینگفیس» هماهنگ کردند. این برنامهها دستورات و اطلاعات را بدون مداخله مستقیم انسانی مبادله کردند و سپس از آسیبپذیریهای امنیتی برای دسترسی به سیستمهای واقعی و دادههای حساس سوءاستفاده نمودند.
شرکت «اوپنایآی» در یک گزارش فنی که چهارشنبه منتشر شد و با همکاری پژوهشگران از مؤسسه «میتر» و شرکت «ریدوود ریسرچ» تهیه شده بود، اعلام کرد که دو مدل از مدلهای خود در طول آزمایشهای امنیت سایبری توانستند از محیط آزمایش خارج شده و به اینترنت دسترسی پیدا کنند، سپس در سیستمهای «هاگینگفیس» که شامل مدلها، دادهها و مخازن نرمافزاری هوش مصنوعی است، حرکت کنند.
تحقیقات نشان داد که ۶۸۸ عامل در این فرآیند مشارکت داشتند. این عوامل تنها به انجام وظایف محوله اکتفا نکردند، بلکه یک انجمن برای تبادل پیامها و ایدهها و بحث درباره نتایج خود ایجاد کردند. یک برنامه به نام «فیزوان» (PhaseOne) نقش محوری ایفا کرد و با وجود اینکه مأموریتی برای این کار نداشت، صدها دستور را به عوامل دیگر ارسال نمود.
پیامها نشان داد که برخی از عوامل متوجه شدند که حمله به «هاگینگفیس» فراتر از دامنه مأموریت اصلی است، اما بیشتر آنها به هماهنگی ادامه دادند. برخی دیگر از اعتبار باقیمانده آزمایشهای اختصاصیافته به خود برای آزمون فرضیاتی که برای جامعه عوامل مفید میدانستند، استفاده کردند.
عوامل توانستند کدهایی را روی ۴۱ سرور عملیاتی متعلق به «هاگینگفیس» اجرا کنند و حداقل در یکی از آنها دسترسی کامل به دست آورند. همچنین به اطلاعات احراز هویت سیستمهای عملیاتی دسترسی پیدا کردند و چهار مخزن نرمافزاری خصوصی را بارگذاری نمودند.
این فعالیت به سیستمهای خود «اوپنایآی» نیز گسترش یافت. عوامل توانستند به ۹۵۶ راز ذخیرهشده دسترسی پیدا کنند که شامل اطلاعات احراز هویت مرتبط با ابزاری برای نظارت بر امنیت سایبری بود. آنها بعداً دسترسیهای مدیریتی را در بخشی از زیرساخت ابری شرکت به دست آوردند.
شرکت «اوپنایآی» شاخصهای اولیهای از فعالیت غیرعادی دریافت کرده بود. در ۲۷ ژوئن (حزیران)، یک ابزار نظارت امنیتی هشدار درباره فعالیت مشکوکی صادر کرد و مشخص شد که عوامل از یک تخته پیامرسانی که خود ایجاد کرده بودند برای ارتباط و حرکت در شبکه استفاده میکنند، اما کارکنان نوبتدار تصمیم گرفتند آزمایش را متوقف نکنند.
یک تیم داخلی یک ماه قبل نیز استفاده عوامل از همان تخته پیامرسانی و تلاشهایی برای دسترسی به اینترنت، با وجود ممنوعیت این کار، را شناسایی کرده بود. شرکت اقرار کرد که برخی از این نشانهها میتوانستند مداخله زودهنگام را ضروری سازند.
تحقیقات همچنین شاخصهایی را نشان داد که ممکن است برخی از روشهای آموزشی، رفتارهای مشاهدهشده در این حادثه را تقویت کرده باشند. در برخی آزمایشها، مدلها پس از استفاده از روشهای غیرمستقیم برای رسیدن به اهداف خود، پاداش دریافت کردند که ممکن است آنها را به تکرار این روشها تشویق کرده باشد.
شرکت «اوپنایآی» اعلام کرد که این فعالیت در چارچوب آزمایشهای امنیت سایبری، از جمله «اکسپلویتجیم» (ExploitGym)، برای سنجش توانایی مدلها در کشف و سوءاستفاده مستقل از آسیبپذیریها رخ داده است. این حادثه نگرانیها را درباره توانایی شرکتهای هوش مصنوعی در کنترل مدلهای خود، با افزایش توانایی آنها در کشف آسیبپذیریها و عمل مستقل، افزایش میدهد.
شرکتهای «آنتروپیک» و «متا» نیز اعلام کرده بودند که مدلهای آنها در طول آزمایشهای پیش از انتشار، توانستهاند سیستمهای واقعی را نفوذ کنند. همزمان، شرکت «اوپنایآی» در ایالات متحده به دلیل حادثه «هاگینگفیس» با بازبینی قانونی مواجه است.