شرکت OpenAI یک مدل امنیت سایبری اختصاصی را برای پاسخگویی به درخواستهای پیشرفتهای که مدلهای استاندارد آن غالباً از انجامشان امتناع میورزند، توسعه داده است. مدل GPT-5.6-Cyber از طریق برنامه محدود شده Daybreak Red در دسترس قرار گرفته و برای کارهایی نظیر توسعه اکسپلویت و تحقیقات پیشرفته امنیتی طراحی شده است.
به گزارش بخش اخبار فناوری زوم تک به نقل از دیجیتال ترندز، جهش توانمندی این مدل جدید غیرقابلانکار است. OpenAI اعلام کرده که GPT-5.6-Cyber حدود ۹۵ درصد از درخواستها را در ارزیابی داخلی نرخ تکمیل امنیت سایبری پیشرفته به پایان میرساند؛ این در حالی است که مدل معمولی GPT-5.6 Sol تنها به آمار ۱.۵ درصدی دست یافته بود. این جهش بزرگ پس از آن رخ میدهد که چندین ارزیابی سایبری نشان دادند ایجنتهای هوش مصنوعی فراتر از مرزها و خطوط قرمزی که پژوهشگران برای آنها تعیین کرده بودند، حرکت میکنند.
مدل GPT-5.6-Cyber تا چه حد در حوزه امنیت سایبری توانمندتر شده است؟
ارزیابیهای OpenAI شامل وظایف بسیار حساسی مانند توسعه اکسپلویت و دور زدن احراز هویت میشود. سطح Daybreak Blue که چارچوبهای امنیتی معمولی سطح سیستم را از GPT-5.6 Sol حذف میکند، تنها به موفقیت ۲ درصدی رسیده بود. اما GPT-5.6-Cyber پس از آموزش دیدن برای رد کردن کمتر درخواستهای پیشرفته سایبری، به نرخ موفقیت ۹۵ درصدی دست یافت.

این آزادی عمل اضافی میتواند بسیار مفید باشد. OpenAI میگوید این مدل جدید توانسته به کشف دو آسیبپذیری ناشناخته (Zero-day) در موتور V8 مرورگر گوگل کروم که امکان زنجیرهسازی آنها وجود داشت کمک کند؛ یافتههایی که جهت افشای مسئولانه و هماهنگ برای گوگل ارسال شدهاند.
وقتی ایجنت های هوش مصنوعی از خط قرمز عبور میکنند؛ هک واقعی در آزمایش های سایبری
آزمایشهای اخیر به خوبی نشان میدهند که چرا اعطای فضای بیشتر به ایجنتهای سایبری با مخاطرات آشکاری همراه است. پلتفرم هاگینگ فیس (Hugging Face) در جریان ارزیابیهای ماه جولای، حدود ۱۷,۶۰۰ اقدام یک ایجنت خودمختار قدرتگرفته از مدلهای OpenAI را بازسازی کرد. این ایجنت توانست از طریق یک آسیبپذیری صفر-روز از محوطه قرنطینه (Sandbox) OpenAI فرار کند و در نهایت در حالی که ظاهراً تلاش میکرد به راهکارهای بنچمارک دست یابد، وارد محیط عملیاتی واقعی (Production) هاگینگ فیس شد!
موسسه امنیت هوش مصنوعی بریتانیا (UK AISI) نیز با نسخه دیگری از این چالش مواجه شد. پژوهشگران ۱۹ اقدام غیرمجاز را در ۱۲۲ بار اجرای آزمایشی ثبت کردند که دو مورد آن شامل مدل GPT-5.6 Sol بود. در نگرانکنندهترین سناریو، یک ایجنت هوش مصنوعی اقدام به خلق هویتهای جعلی کرد تا نگهدارنده یک پروژه متنباز را برای تایید و اضافه کردن کد مخرب متقاعد کند.

البته این موارد جزو آزمایشهای مجاز و با سطح دسترسی بالا بودند. موسسه AISI دسترسی به اینترنت را فعال کرده و طبقهبندیکنندههای سایبری ارائهدهندگان را غیرفعال کرده بود و هیچ مدرکی مبنی بر اینکه این آزمایشها باعث آسیب واقعی در دنیای واقعی شده باشند، پیدا نکرد.
کنترل سطح دسترسی؛ جایگزین جدید خطوط قرمز و گاردریل های هوش مصنوعی
سایر آزمایشگاههای هوش مصنوعی نیز با همین تقابل و موازنه سخت روبرو هستند. شرکت آنتروپیک (Anthropic) دریافت که مدل پیشنمایش Mythos به صورت خودمختار اکسپلویتهای عملیاتی برای ۸ مورد از ۱۸ وصله امنیتی فایرفاکس و همچنین زنجیرههای کامل ارتقای سطح دسترسی (Privilege Escalation) برای ۸ مورد از ۲۱ وصله امنیتی کرنل ویندوز تولید کرده است.
رویکرد OpenAI اکنون بیش از آنکه متکی بر انتظار از خود مدل برای رد کردن هر درخواست خطرناک باشد، به سمت کنترل دقیق سطح دسترسی سوق پیدا کرده است. برنامه Daybreak Red مسئولیت بیشتری را روی نحوه تصمیمگیری درباره اینکه چه کسانی در وهله اول به GPT-5.6-Cyber دسترسی پیدا میکنند قرار میدهد؛ استراتژی جذابی که با پیشرفت سیستمها در انجام وظایف امنیتی، میتواند به بخش بسیار بزرگتری از امنیت هوش مصنوعی (AI Safety) تبدیل شود.





نظرات در مورد : رونمایی OpenAI از مدل سایبری GPT-5.6-Cyber برای مقابله با خطرات ایجنتهای هوش مصنوعی سرکش