جدیدترین تست امنیت سایبری شرکت OpenAI به نتیجهای دست یافت که شباهت زیادی به فیلمهای علمی-تخیلی هشداردهنده دارد. مدلهای هوش مصنوعی این شرکت موفق شدند از محیط ایمن و ایزوله (سندباکس) خود فرار کرده و به اینترنت آزاد دسترسی پیدا کنند. اوضاع زمانی نگرانکننده شد که این مدلها برای به دست آوردن پاسخهای آزمون امنیتی خود، اقدام به هک پلتفرم Hugging Face کردند.
به گزارش بخش اخبار فناوری زوم تک به نقل از دیجیتال ترندز، این شرکت اعلام کرده است که مدل GPT-5.6 Sol به همراه یک مدل منتشرنشده و پرقدرتتر، به صورت کاملاً خودمختار آسیبپذیریهای موجود در سیستمهای تحقیقاتی OpenAI و زیرساختهای عملیاتی Hugging Face را به یکدیگر زنجیره کرده و یک حادثه سایبری بیسابقه را رقم زدهاند.
کشف مسیر فرار واقعی توسط مدل های هوش مصنوعی
این حادثه در طول یک ارزیابی داخلی رخ داد که برای سنجش توانمندیهای تهاجمی پیشرفته در حوزه امنیت سایبری طراحی شده بود. شرکت OpenAI تعمداً این مدلها را با محدودیتهای امنیتی و امتناعهای سایبری کاهشیافته و بدون طبقهبندیکنندههای تولیدی — که معمولاً از حملات خطرناک جلوگیری میکنند — اجرا کرد.
محیط آزمایشی بسیار ایزوله بود؛ با این حال، میتوانست به یک پروکسی میزبانیشده داخلی که برای دریافت پکیجهای نرمافزاری استفاده میشد، دسترسی داشته باشد. این مدلهای هوش مصنوعی منابع محاسباتی قابل توجهی را صرف یافتن مسیر فرار کردند و در نهایت یک آسیبپذیری ناشناخته (Zero-day) را در آن پروکسی کشف و از آن سوءاستفاده نمودند. این امر به آنها اجازه داد تا ارتقای سطح دسترسی پیدا کرده و در سراسر زیرساختهای تحقیقاتی OpenAI حرکت کنند و در نهایت به سیستمی با دسترسی بدون محدودیت به اینترنت برسند.
سپس این مدلها استنباط کردند که پلتفرم Hugging Face ممکن است حاوی موادی مرتبط با بنچمارک ExploitGym باشد؛ یعنی همان آزمون امنیت سایبری که در حال گذراندن آن بودند. طبق گزارش OpenAI، آنها با استفاده از اعتبارنامههای سرقتشده و آسیبپذیریهای روز صفر بیشتر، یک مسیر اجرای کد از راه دور (RCE) را به سرورهای Hugging Face پیدا کرده و پاسخهای آزمون را مستقیماً از دیتابیس عملیاتی استخراج کردند.
شرکت OpenAI فعالیتهای غیرمعمولی را در داخل سیستمهای خود شناسایی کرد، در حالی که سیستمهای امنیتی Hugging Face نفوذ به زیرساختهای خود را تشخیص داده و متوقف ساختند. هاگینگ فیس اعلام کرد که این حادثه مجموعه محدودی از مجموعهدادههای داخلی و اعتبارنامههای سرویس را افشا کرده است. هیچ مدرکی مبنی بر تغییر مدلهای عمومی، مجموعهدادهها یا ایمیجهای کانتینری یافت نشده است، اما ارزیابی تأثیرات احتمالی بر مشتریان یا شرکای تجاری همچنان ادامه دارد.

استفاده از هوش مصنوعی چینی برای بررسی و بازسازی سیستم
تیم تحقیقاتی Hugging Face هنگام بررسی بیش از ۱۷,۰۰۰ رویداد ثبتشده از این حمله سایبری، با چالش عجیبی مواجه شد. محققان ابتدا سعی کردند از مدلهای پیشرفته هوش مصنوعی موجود از طریق APIهای تجاری استفاده کنند، اما سیستمهای ایمنی این مدلها دستورات مخرب، پلودهای اکسپلویت و آثار فرماندهی و کنترل موجود در مدارک را مسدود میکردند. مدلهای میزبانیشده نمیتوانستند کار تحلیل فورنزیک و جرمشناسی قانونی را از درخواستی برای کمک به یک حمله واقعی تشخیص دهند.
در نتیجه، این شرکت به مدل متنباز GLM 5.2 متوسل شد که توسط شرکت چینی Z.ai توسعه یافته است و آن را به صورت محلی اجرا کرد. ایجنتهای جرمشناسی مبتنی بر هوش مصنوعی از این مدل برای بازسازی خط زمانی، شناسایی اعتبارنامههای لو رفته، استخراج شاخصهای نفوذ (IoC) و حتی جداسازی فعالیتهای واقعی از دادههای انحرافی استفاده کردند. هاگینگ فیس میگوید این فرآیند به جای چند روزی که در روشهای سنتی زمان میبرد، تنها چند ساعت به طول انجامید. همچنین نگهداری مدل GLM روی زیرساخت اختصاصی خود، از خروج اعتبارنامهها و دادههای حمله از محیط شرکت جلوگیری کرد.
تیمهای امنیتی Hugging Face بعداً جایپاهای ایجادشده را پاکسازی کرده و سیستم آسیبدیده را مجدداً بازسازی نمودند. اگرچه مدل GLM به تنهایی این نفوذ را مهار نکرد، اما این حادثه نشان داد در حالی که OpenAI هوش مصنوعی قدرتمندی برای انجام چنین نفوذهای پیچیدهای ساخته است، مدافعان سایبری نیز به مدلهای به همان اندازه توانمند در سمت دفاع نیاز خواهند داشت.





نظرات در مورد : هک بی سابقه پلتفرم هاگینگ فیس توسط مدل های هوش مصنوعی OpenAI و بازیابی سیستم با مدل چینی