آیا نگران شورش ابزارهای هوش مصنوعی هستید؟

سری جدیدی از گزارشهای امنیتی، نگرانیها را نسبت به احتمال گسترش پدیده شورش ابزارها و سیستمهای هوش مصنوعی شرکتهای آمریکایی «اوپنایآی» (OpenAI) و «آنتروپیک» (Anthropic) افزایش داده است؛ تحولی که پرسشها درباره توانایی شرکتهای توسعهدهنده در کنترل عوامل مستقل هوش مصنوعی در محیطهای ایزولهی آزمایشگاهی را مجدداً به میان کشیده است. گزارشها نشان میدهند که یک عامل آزمایشی متعلق به شرکت «اوپنایآی»، که با مدل «GPT-5.6 Sol» و یک مدل پیشرفتهتر منتشرنشده دیگر تقویت شده بود، در نهم ژوئیه تلاش کرد تا از محیط ایزولهی آزمایشگاهی خود فرار کند.
بر اساس گزارشها، این عامل دو روز پس از آن تلاش، موفق به نفوذ به پلتفرم «Hugging Face» شد که میزبان مدلهای هوش مصنوعی است و این نفوذ از یازدهم تا سیزدهم همان ماه ادامه یافت. شرکت «اوپنایآی» تنها زمانی متوجه شد که عامل آن مسئول این حادثه است که «Hugging Face» در ششم ژوئیه بهطور علنی اعلام کرد که مورد حملهی یک عامل مستقل هوش مصنوعی قرار گرفته است. کارآگاهان این شرکت در پایان هفتهی ممتد از هجدهم تا نوزدهم ژوئیه، شواهدی را در لاگهای خود یافتند که این ادعا را تأیید میکردند. تا آن زمان، «Hugging Face» قبلاً این حادثه را به اداره تحقیقات فدرال آمریکا (FBI) گزارش داده بود و «اوپنایآی» نیز در بیست و یکم ژوئیه بهطور علنی به موضوع اعتراف کرد.
منابع آگاه اشاره کردند که تأخیر در کشف نفوذ، تا حدی به این دلیل است که شرکت «اوپنایآی» معمولاً چندین مدل را همزمان آزمایش میکند که این امر ردیابی رفتار یک عامل خاص را در میان حجم عظیم دادههای فنی ناشی از فرآیندهای ارزیابی دشوار میسازد. همچنین گزارش به یک رویداد جداگانه اشاره کرد که در آن یکی از عوامل، دستورالعملهایی را در شبکهی شرکت برای نسخههای آیندهی مدلها به جا گذاشت که نحوهی دور زدن محدودیتهای داخلی را توضیح میداد؛ هرچند مشخص نیست که آیا این رویداد با حادثهی «Hugging Face» مرتبط است یا خیر.
در همین راستا، محققان شرکت «Accomplish AI» یک آسیبپذیری امنیتی در ابزار «Claude Cowork» متعلق به «آنتروپیک» را مستند کردند که آن را «SharedRoot» نامیدند. این آسیبپذیری به عامل هوش مصنوعی اجازه داد تا از یک دستگاه مجازی لینوکسی (Linux) فرار کرده و به فایلهای دستگاه میزبان مک (Mac) دسترسی پیدا کند. محققان از یک آسیبپذیری ارتقای سطح دسترسی در هستهی لینوکس با شناسهی «CVE-2026-46331» استفاده کردند که امتیاز خطر آن ۷.۸ از ۱۰ بود و به عامل امکان خواندن و نوشتن فایلها خارج از پوشهی اختصاصیاش را بدون هیچگونه پنجرهی تأیید میداد؛ از جمله کلیدهای SSH و دادههای احراز هویت رایانش ابری. بر اساس وبسایت «The Hacker News»، حدود ۵۰۰,۰۰۰ کاربر سیستمعامل مک پیش از رفع این آسیبپذیری در معرض خطر بودند.
شرکت «Accomplish AI» اعلام کرد که «آنتروپیک» آسیبپذیری را تأیید کرده اما هیچ اصلاحیهی مستقیمی منتشر نکرده است؛ با این حال، نسخهی بعدی «Claude Cowork» بهطور پیشفرض بر اجرای مبتنی بر رایانش ابری تنظیم شده است که این امر بخشی از خطرات مرتبط با اجرای محلی را برطرف میکند، هرچند کاربرانی که ترجیح میدهند بهصورت محلی اجرا کنند، همچنان در معرض خطر باقی میمانند.
• اجرای سرویس در محدودهای با حفاظت سختگیرانه که از اجرای مجدد فایلهای قابل دستکاری توسط جلسهی کاربر جلوگیری میکند.
از سوی دیگر، شرکت امنیت سایبری «Tego AI» از کشف حفره امنیتی دوم در عرض یک هفته در پلتفرم «Claude» خبر داد؛ این بار در ابزار «Claude Code» که برای برنامهنویسی طراحی شده است. «تومر نِوِی»، رئیس بخش تحقیقات این شرکت، توضیح داد که کپیبرداری از یک مخزن نرمافزاری معمولی که حاوی یک فایل راهنما به نام «CLAUDE.md» باشد و شامل یک دستور واردات به یک پیوند نمادین (symlink) باشد، برای آن کافی است که ابزار فایلهایی را خارج از محدوده پروژه بخواند و آنها را در اولین درخواستی که به مدل ارسال میشود، گنجانده و پردازش کند؛ بدون هیچگونه مداخله کاربر یا اجرای واقعی کد. شرکت «Tego AI» تأیید کرد که این رفتار بهطور عملی در نسخههای «2.1.x» ابزار «Claude Code» مشاهده شده است و اشاره کرد که نتایج بیشتری از تحقیقات این شرکت درباره پلتفرم «Claude» همچنان در حال آمادهسازی است.
برخی از کارشناسان نتیجه گرفتند که این حوادث متوالی، نشاندهنده چالش عمیقتری درباره میزان آمادگی شرکتهای پیشرو در حوزه هوش مصنوعی برای سرمایهگذاری کافی در زمینههای امنیتی، در مقایسه با سرعت روزافزون عرضه مدلهای قدرتمندتر است؛ و همچنین اشاراتی به این موضوع وجود دارد که نظارت دولتی ممکن است در آینده به ضرورتی اجتنابناپذیر تبدیل شود.