«اوبن ایآی» مکانیسمی برای ردیابی رفتارهای هوش مصنوعی راهاندازی کرد

شرکت اوپنایآی روز چهارشنبه اعلام کرد که انتشار گزارشهای دورهای درباره رفتارهای غیرمنتظره یا غیرمجاز هوش مصنوعی را آغاز خواهد کرد و همزمان هشدار داد که این صنعت هنوز با چالشهای اصلی مرتبط با همسو کردن مدلها با اهداف مورد نظر روبرو است، بهویژه با افزایش قدرت سیستمها.
این شرکت چارچوب جدیدی را برای ردیابی، بررسی و شناسایی موارد عدم همسویی مدلهای هوش مصنوعی منتشر کرد، همراه با شش گزارش درباره رفتارهای غیرمنتظره یا نگرانکنندهای که در مدلها طی شش ماه گذشته مشاهده شده است.
این گزارشهای اولیه شامل مواردی است که در آنها مدلها دستورالعملهای خود را در خلاصههای وظایف تولید میکنند، خطاها را پنهان میسازند، فایلهایی را در اینترنت برای ارجاع به آنها بارگذاری میکنند و همچنین فایلها را بدون مجوز بین عاملهای هوش مصنوعی همکار به اشتراک میگذارند.
اوپنایآی اعلام کرد که این گزارشها موارد فردی را توصیف میکنند و نباید به عنوان نشانهای از تکرارپذیری عدم همسویی در مدلهای این شرکت تلقی شوند.
این تصمیم در حالی اتخاذ شده است که نگرانیها درباره اینکه تلاشهای ایمنی مرتبط با هوش مصنوعی از سرعت سریع توسعه سیستمهایی که قدرت و قابلیتهای بیشتری دارند، عقب میمانند، در حال افزایش است.
پژوهشگران هشدار دادهاند که با افزایش استقلال سیستمها و عاملهای هوش مصنوعی، ممکن است رفتارهایی توسعه یابد که از نیتهای طراحیشده توسط توسعهدهندگان انحراف داشته باشد و نظارت یا کنترل بر آنها دشوار شود.
چارچوب جدید شرکت شامل فرآیندی خواهد بود که به کارکنان امکان گزارش موارد احتمالی عدم همسویی مدلها و تحقیقات انجامشده توسط تیمهای ایمنی و همسویی را میدهد، همچنین سیستمی برای تعیین مواردی که نیاز به افشای عمومی دارند، ارائه خواهد کرد.