آیا شرکتها دکمه توقف را دارند اگر هوش مصنوعی سرکشی کند؟

با انتقال سیستمهای هوش مصنوعی از صرفاً پاسخ به پرسشها به انجام وظایف، نوشتن کدها و استفاده از ابزارهای دیجیتال بهصورت تقریباً مستقل، پرسش آزاردهندهتری مطرح میشود: اگر یک مدل پیشرفته تلاش کند محدودیتهای تعیینشده بر خود را دور بزند، چه اتفاقی خواهد افتاد؟
ارزیابی جدیدی که توسط سازمان «گایدلاینز ایآی استنداردز» (Guidelines AI Standards) انجام شد، پنج شرکت بزرگ هوش مصنوعی از جمله اوپنایآی، انتروپیک، گوگل، متا و ایکسایآی را در بر گرفت. نتیجه اصلی این بود که اقدامات کنترلی وجود دارند، اما همچنان ناقص و ناکامل هستند.
این گزارش شرکتها را در شش حوزه ارزیابی کرد که شامل ثبت فعالیتهای مدلها، نظارت بر رفتارهای مشکوک، جلوگیری از اقدامات پرخطر، توقف سیستمها در صورت افزایش هشدارها، بازبینی مستقل و تدوین برنامهای برای مهار مدلی است که تلاش میکند کنترل انسانی را دور بزند.
هیچیک از شرکتها در هیچیک از این حوزهها ارزیابی «کامل» دریافت نکردند.
این مطالعه به این معنا نیست که یک مدل هوش مصنوعی واقعاً به معنای سینمایی «شورش» کرده است. منظور، آمادگی برای سناریویی است که در آن یک سیستم پیشرفته ممکن است رفتار خود را پنهان کند، از حدود اختیارات خود تجاوز نماید یا اقدامات ناخواستهای را در حین آزمایشها یا استفاده داخلی انجام دهد.
سازمان تأکید میکند که ارزیابی آن عمدتاً بر اساس اطلاعات موجود در دسترس عمومی است؛ بنابراین ممکن است برخی شرکتها اقدامات داخلی داشته باشند که هنوز فاش نکردهاند.