شرکت OpenAI روز سهشنبه اعتراف کرد که یکی از مدلهای هوش مصنوعی آن در طول یک تست امنیت سایبری داخلی که از کنترل خارج شد، به سیستمهای پلتفرم Hugging Face نفوذ کرده است. گزارشها نشان میدهند این مدلها از محیط ایزوله و آزمایشی خود فرار کرده و از آنجا به سیستمهای هاگینگ فیس دسترسی پیدا کردهاند. هاگینگ فیس ابتدا این رخنه امنیتی را به یک «ایجنت هوش مصنوعی خارجی» نسبت داده بود.
به گزارش بخش اخبار فناوری زوم تک به نقل از تککرانچ، OpenAI در پست وبلاگی که عصر سهشنبه منتشر شد، مراحل و جزئیاتی را که منجر به آسیب دیدن این سرویس توسط مدلها شد تشریح کرد.
در این پست آمده است: «پس از بررسیها، اکنون میدانیم که این حادثه خاص توسط ترکیبی از مدلهای OpenAI — از جمله GPT‑5.6 Sol و یک مدل پیش از عرضه بسیار قدرتمندتر — رخ داده است. تمامی این مدلها به منظور ارزیابیهای امنیتی با محدودیتهای امنیتی و امتناعهای سایبری کاهشیافته، روی بنچمارک توانمندیهای سایبری به صورت داخلی در حال تست بودند.»
چگونگی دور زدن محیط امنیتی و نفوذ به دیتابیس هاگینگ فیس
به طور خاص، به نظر میرسد این نفوذ سایبری بر روی ExploitGym متمرکز بوده است؛ بنچمارکی که به صورت عمومی میزبانی میشود و توانایی مدلها را برای اجرای حملات بر اساس آسیبپذیریهای موجود میسنجد. بنچمارکهای هوش مصنوعی مانند ExploitGym معمولاً در آموزش مدلها برای تقویت مهارتهای خاص استفاده میشوند، اما این اولین حادثه شناختهشدهای است که در آن این آزمونها منجر به یک حمله سایبری واقعی شده است.
در این مورد، مدل مورد نظر حتی نباید به اینترنت دسترسی میداشت، به جز ابزار خاصی که به مدلها اجازه میداد بستههای نرمافزاری مورد نیاز خود برای تکمیل کار را نصب کنند. در عوض، این هوش مصنوعی خودمختار توانست یک آسیبپذیری افشانشده را در برنامه نصبکننده پکیج پیدا کند و از آن برای دسترسی آزادانه به اینترنت استفاده نماید.
در پست OpenAI آمده است: «مدلها بهشدت روی یافتن راهحلی برای ExploitGym تمرکز کرده بودند و برای رسیدن به یک هدف آزمایشی نسبتاً محدود، دست به اقدامات فوقالعادهای زدند. پس از دسترسی به اینترنت، مدلها استنباط کردند که پلتفرم Hugging Face احتمالاً میزبان مدلها، مجموعهدادهها و راهحلهای مربوط به ExploitGym است. با دانستن این موضوع، مدل به دنبال راههایی برای دسترسی به اطلاعات محرمانه گشت و موفق شد از آنها برای تقلب در ارزیابی استفاده کند.»
در نهایت، این مدلها آسیبپذیریهای امنیتی را در زیرساخت هاگینگ فیس پیدا کردند که به آنها اجازه داد «پاسخهای آزمون را مستقیماً از دیتابیس تولیدی Hugging Face به دست آورند» و عملاً پاسخهای بنچمارک را استخراج کنند.
پیامدهای حمله سایبری هوش مصنوعی و هشدارهای امنیتی
برای Hugging Face، نتیجه ظاهری این رویداد یک حمله سایبری پیچیده و تهاجمی بود که طبق افشاگری اولیه این شرکت، شامل «چندین هزار اقدام فردی در دستهای از سندباکسهای کوتاهمدت همراه با فرماندهی و کنترل خودکار منتقلشده روی سرویسهای عمومی» میشد.
شرکت OpenAI آسیبپذیریهای موجود در برنامه نصبکننده پکیج را شناسایی و گزارش کرده است و برای بررسی بیشتر حادثه با Hugging Face همکاری میکند. این شرکت همچنین اعلام کرد که کنترلهای جدیدی را بر روی آزمایش مدلها و زیرساختهای مربوطه اعمال خواهد کرد تا از بروز حوادث مشابه در آینده جلوگیری شود.
هنوز مشخص نیست که آیا OpenAI به دلیل این نفوذ با عواقب قانونی مواجه خواهد شد یا خیر، اگرچه احتمال زیادی وجود دارد که اقدامات این مدلها قانون کلاهبرداری و سوءاستفاده رایانهای (CFAA) را نقض کرده باشد.
با این حال، این نتیجه تصویری فوقالعاده واضح از قدرت و خطرات مدلهای پیشرفته هوش مصنوعی فعال در افقهای زمانی بلندمدت را ارائه میدهد. همانطور که میکا کارول (Micah Carroll)، محقق OpenAI، در واکنش به این خبر نوشت: «اگر این اتفاق شما را قانع نکند که خطرات عدم تراز (Misalignment Risks) هوش مصنوعی یک دغدغه کلیدی در آینده خواهد بود، نمیدانم چه چیزی قانع خواهد کرد.»





نظرات در مورد : اعتراف OpenAI به نفوذ مدل های پیش از عرضه خود به پلتفرم هاگینگ فیس