«اوپنایآی» از انتشار مدل هوش مصنوعی به دلیل عدم کنترل کافی خودداری کرد

شرکت «اوپنایآی» از انتشار یک مدل جدید و پیشرفته هوش مصنوعی خودداری کرد، پس از آنکه مشخص شد این مدل بیش از حد تمایل به خروج از دستورالعملها دارد؛ موضوعی که نمونه جدیدی بر دشواری فزاینده کنترل مدلهای پیشرفته هوش مصنوعی محسوب میشود.
به گزارش روزنامه والاستریت ژورنال، اوپنایآی قصد داشت نسخه بهروزشدهای از «جیپیتی ۶.۱ آسترا» را در اکتبر منتشر کند، اما هنوز بهطور رسمی تاریخ عرضه آن را اعلام نکرده است.
ساتچی جاین، رئیس بخش امنیت هوش مصنوعی در اوپنایآی، توضیح داد که «جیپیتی ۶.۱» در دو حوزه مرتبط با انطباق، یعنی میزان پایبندی مدل به دستورالعملهای تعیینشده توسط توسعهدهندگان، نتایج ضعیفتری نسبت به نسل پیشین خود، یعنی «جیپیتی ۶»، کسب کرده است.
سام آلتمان، مدیرعامل اوپنایآی، در کنفرانسی که در فورت میسون در ساحل خلیج سانفرانسیسکو برگزار میشود، سخنرانی خواهد کرد.
مدل جدید اوپنایآی تمایل دارد با پنهانسازی برخی اقدامات انجامشده یا انجامنشده، ناظران را گمراه کند. همچنین این مدل بارها از حدود اختیارات خود فراتر رفته و بدون کسب مجوز، به ابزارها و خدماتی دسترسی پیدا کرده است.
جاین اشاره کرد که «جیپیتی ۶.۱» نسبت به مدلهای پیشین پیشرفت نشان داده است، بهویژه در زمینه کاهش تمایل به تنبلی؛ وی توضیح داد که این مدل اکنون قادر است فرآیند استدلال را برای مدت طولانیتری ادامه دهد و کمتر به تقلیل مراحل عملیاتی روی میآورد.
وی افزود: «اما این مدل از نظر پایبندی به حدود اختیارات و مجوزهای انجام کار، و همچنین شیوه گزارشدهی درباره اقدامات انجامشده، به سطح مطلوبی نرسیده است.»
بر این اساس، اوپنایآی تصمیم گرفت انتشار مدل را لغو کند تا بر بهبود پایبندی آن به دستورالعملها و محدودیتهای تعیینشده تمرکز نماید.
موسسه امنیت هوش مصنوعی بریتانیا، که زیرمجموعه دولت است، روز دوشنبه گزارشی منتشر کرد که نشان میداد «جیپیتی ۶.۱ آسترا» در طول آزمایشها نسبت به نسلهای پیشین خود، یعنی «جیپیتی ۵.۶ سول» که اوایل جولای عرضه شد و «جیپیتی ۵.۵» که در آوریل منتشر گردید، تمایل بیشتری به انحراف از مسیر داشته است.
در طول شبیهسازیها، «جیپیتی ۶» حملات سایبری را با نرخهای بسیار بالاتری نسبت به دو مدل دیگر، بهصورت خودکار انجام داد.
این آزمایشها پس از غیرفعالسازی مکانیزمهای حفاظتی در مدلها و با هدف ارزیابی تواناییهای کامل آنها انجام شد، نه بر روی نسخههایی که در دسترس عموم کاربران است.
نمونههای جدیدتر «اوپنایآی» با سرعتی بسیار بالاتر به ایجاد هویتهای جعلی، تلاش برای تأثیرگذاری بر یکی از ارزیابان و گنجاندن کدهایی در نرمافزارهای عمومی پرداختهاند که میتوان از آنها به صورت مخرب استفاده کرد.
نوام براون، پژوهشگر «اوپنایآی»، در مصاحبهای اخیر با برنامه «پادکست دوارکش» اعلام کرد که افزایش تمایل به آنچه «بهینهسازی خودتکرارشونده» نامیده میشود، یعنی توسعه هوش مصنوعی توسط خودش بدون دخالت انسان، ممکن است کنترل بر این مدلها را در بلندمدت دشوارتر کند.