عاملهای هوش مصنوعی (AI Agents) قدرتمند OpenAI در محیط تست امنیتی که برای آنها طراحی شده بود، باقی نماندند. این شرکت اعلام کرده است که مدلهایش در جریان تلاش برای نفوذ به سرویس هگینگ فیس (Hugging Face)، به چهار حساب کاربری مختلف در چندین سرویس عمومی دسترسی پیدا کردهاند.
به گزارش بخش اخبار فناوری زوم تک به نقل از دیجیتال ترندز، خبرگزاری رویترز یکی از قربانیان این حادثه را یکی از کاربران پلتفرم Modal معرفی کرده که کد بدون ایمنی آن، یک ساندباکس (Sandbox) را در دسترس اینترنت قرار داده بود. به این ترتیب، یک بنچمارک آزمایشی که برای سنجش توانایی هک هوش مصنوعی طراحی شده بود، به زیرساختهای واقعی نفوذ کرد و عاملهای هوش مصنوعی در این مسیر، اهداف و روشهای خود را به صورت مستقل انتخاب کردند.
عاملهای هوش مصنوعی OpenAI چگونه از محیط تست فرار کردند؟
شرکت OpenAI در حال آزمایش مدل جدید GPT-5.6 Sol و یک مدل تحقیقاتی منتشرنشده دیگر در برابر بنچمارک ExploitGym بود؛ ابزاری که توانایی سیستمهای هوش مصنوعی را در یافتن و سوءاستفاده از آسیبپذیریهای نرمافزاری ارزیابی میکند. هر دو مدل در این تست بدون گاردریلها و محافظهای امنیتی معمول خود فعال بودند.

در این میان، یکی از عاملهای هوش مصنوعی تصمیم گرفت بهجای تکمیل چالش تعیینشده، به سراغ پلتفرم هگینگ فیس (Hugging Face) برود؛ چراکه تصور میکرد پاسخهای این بنچمارک در آنجا قرار دارد. این ایجنت با نفوذ به یک ساندباکس شخص ثالث، دسترسی سطح مدیر (Administrator) را به دست آورد و از آن محیط برای ادامه عملیات نفوذ خود استفاده کرد.
این رفتار هوش مصنوعی بههیچوجه تصادفی نبود. ایجنت یادشده آنچه را که شبیه به یک مسیر میانبر به نظر میرسید پیدا کرد و بهصورت کاملاً برنامهریزیشده و سیستماتیک، به سیستمهای بیرونی نفوذ کرد تا به هدف خود برسد. ظاهراً خارج شدن از کنترل و رفتارهای سرکشانه به معنای از دست دادن هدف اصلی نیست!
دامنه نفوذ و حمله عامل های هوش مصنوعی تا کجا گسترش یافت؟
تحقیقات OpenAI نشان داد که ایجنتهای آن با استفاده از اطلاعات احراز هویتی که از قبل در اینترنت فاش شده بود، وارد چهار حساب کاربری خارجی شدهاند. به گزارش رسانه Wired، یکی از این حسابها برای بازپخش ترافیک و مخفی کردن منشأ حمله به Hugging Face مورد استفاده قرار گرفته و حساب دیگری نیز اطلاعات سرقتشده را ذخیره کرده است.

همچنین کاربر پلتفرم Modal یک نقطه پایانی (Endpoint) بدون احراز هویت منتشر کرده بود که به هر کسی اجازه میداد کدهای دلخواه را درون ساندباکسهای آن اجرا کند. اگرچه مدیران Modal اعلام کردهاند که خود پلتفرم دچار رخنه امنیتی نشده است، اما محیط ناامن این کاربر به عاملهای هوش مصنوعی فضای لازم را برای انجام عملیات داد.
در داخل Hugging Face، این عاملهای هوش مصنوعی توانستند به سیستمهای سطح مدیریتی دسترسی پیدا کنند. آنها همچنین ۱۸۱ دستگاه تحت کنترل مهاجم را در شبکه سازمانی این شرکت ثبت کردند؛ اقدامی که این حادثه را از یک سرک کشیدن ساده هوش مصنوعی برای دیدن پاسخها، به یک حمله سایبری جدی تبدیل کرد.
واکنش OpenAI پس از وقوع رخنه امنیتی چه بود؟
شرکت OpenAI بلافاصله مدل تحقیقاتی منتشرنشده را غیرفعال و رمزنگاری کرد و دسترسی پژوهشگران را به آن قطع نمود. این شرکت همچنان در حال بررسی ابعاد حادثه است و اعلام کرده با صاحبان سایر سرویسهای متأثر از این نفوذ امنیتی تماس خواهد گرفت.
اگرچه اطلاعات افشاشده و زیرساختهای ناامن زمینه این اتفاق را فراهم کردند، اما خود OpenAI نیز عمداً محافظهای امنیتی معمول مدلها را غیرفعال کرده بود. آزمایشهای آینده نشان میدهد که حتی وقتی محققان انتظار دارند عاملهای هوش مصنوعی مؤدبانه در چارچوب مأموریت باقی بمانند، باید این ایجنتهای قدرتمند را کاملاً از سیستمهای عمومی و واقعی ایزوله و جدا نگه دارند.




نظرات در مورد : فرار عامل های هوش مصنوعی OpenAI از محیط تست و هک مستقل چند سرویس بزرگ!