توبیت
آنتی ویروس پادویش

رونمایی OpenAI از مدل سایبری GPT-5.6-Cyber برای مقابله با خطرات ایجنت‌های هوش مصنوعی سرکش

رونمایی OpenAI از مدل سایبری GPT-5.6-Cyber برای مقابله با خطرات ایجنت‌های هوش مصنوعی سرکش

شرکت OpenAI یک مدل امنیت سایبری اختصاصی را برای پاسخ‌گویی به درخواست‌های پیشرفته‌ای که مدل‌های استاندارد آن غالباً از انجامشان امتناع می‌ورزند، توسعه داده است. مدل GPT-5.6-Cyber از طریق برنامه محدود شده Daybreak Red در دسترس قرار گرفته و برای کارهایی نظیر توسعه اکسپلویت و تحقیقات پیشرفته امنیتی طراحی شده است.

کانال بله زوم تکگیفت کارت

به گزارش بخش اخبار فناوری زوم تک به نقل از دیجیتال ترندز، جهش توانمندی این مدل جدید غیرقابل‌انکار است. OpenAI اعلام کرده که GPT-5.6-Cyber حدود ۹۵ درصد از درخواست‌ها را در ارزیابی داخلی نرخ تکمیل امنیت سایبری پیشرفته به پایان می‌رساند؛ این در حالی است که مدل معمولی GPT-5.6 Sol تنها به آمار ۱.۵ درصدی دست یافته بود. این جهش بزرگ پس از آن رخ می‌دهد که چندین ارزیابی سایبری نشان دادند ایجنت‌های هوش مصنوعی فراتر از مرزها و خطوط قرمزی که پژوهشگران برای آن‌ها تعیین کرده بودند، حرکت می‌کنند.

مدل GPT-5.6-Cyber تا چه حد در حوزه امنیت سایبری توانمندتر شده است؟

ارزیابی‌های OpenAI شامل وظایف بسیار حساسی مانند توسعه اکسپلویت و دور زدن احراز هویت می‌شود. سطح Daybreak Blue که چارچوب‌های امنیتی معمولی سطح سیستم را از GPT-5.6 Sol حذف می‌کند، تنها به موفقیت ۲ درصدی رسیده بود. اما GPT-5.6-Cyber پس از آموزش دیدن برای رد کردن کمتر درخواست‌های پیشرفته سایبری، به نرخ موفقیت ۹۵ درصدی دست یافت.

رونمایی OpenAI از مدل سایبری GPT-5.6-Cyber برای مقابله با خطرات ایجنت‌های هوش مصنوعی سرکش

این آزادی عمل اضافی می‌تواند بسیار مفید باشد. OpenAI می‌گوید این مدل جدید توانسته به کشف دو آسیب‌پذیری ناشناخته (Zero-day) در موتور V8 مرورگر گوگل کروم که امکان زنجیره‌سازی آن‌ها وجود داشت کمک کند؛ یافته‌هایی که جهت افشای مسئولانه و هماهنگ برای گوگل ارسال شده‌اند.

وقتی ایجنت‌ های هوش مصنوعی از خط قرمز عبور می‌کنند؛ هک واقعی در آزمایش‌ های سایبری

آزمایش‌های اخیر به خوبی نشان می‌دهند که چرا اعطای فضای بیشتر به ایجنت‌های سایبری با مخاطرات آشکاری همراه است. پلتفرم هاگینگ فیس (Hugging Face) در جریان ارزیابی‌های ماه جولای، حدود ۱۷,۶۰۰ اقدام یک ایجنت خودمختار قدرت‌گرفته از مدل‌های OpenAI را بازسازی کرد. این ایجنت توانست از طریق یک آسیب‌پذیری صفر-روز از محوطه قرنطینه (Sandbox) OpenAI فرار کند و در نهایت در حالی که ظاهراً تلاش می‌کرد به راهکارهای بنچمارک دست یابد، وارد محیط عملیاتی واقعی (Production) هاگینگ فیس شد!

موسسه امنیت هوش مصنوعی بریتانیا (UK AISI) نیز با نسخه دیگری از این چالش مواجه شد. پژوهشگران ۱۹ اقدام غیرمجاز را در ۱۲۲ بار اجرای آزمایشی ثبت کردند که دو مورد آن شامل مدل GPT-5.6 Sol بود. در نگران‌کننده‌ترین سناریو، یک ایجنت هوش مصنوعی اقدام به خلق هویت‌های جعلی کرد تا نگهدارنده یک پروژه متن‌باز را برای تایید و اضافه کردن کد مخرب متقاعد کند.

رونمایی OpenAI از مدل سایبری GPT-5.6-Cyber برای مقابله با خطرات ایجنت‌های هوش مصنوعی سرکش

البته این موارد جزو آزمایش‌های مجاز و با سطح دسترسی بالا بودند. موسسه AISI دسترسی به اینترنت را فعال کرده و طبقه‌بندی‌کننده‌های سایبری ارائه‌دهندگان را غیرفعال کرده بود و هیچ مدرکی مبنی بر اینکه این آزمایش‌ها باعث آسیب واقعی در دنیای واقعی شده باشند، پیدا نکرد.

کنترل سطح دسترسی؛ جایگزین جدید خطوط قرمز و گاردریل‌ های هوش مصنوعی

سایر آزمایشگاه‌های هوش مصنوعی نیز با همین تقابل و موازنه سخت روبرو هستند. شرکت آنتروپیک (Anthropic) دریافت که مدل پیش‌نمایش Mythos به صورت خودمختار اکسپلویت‌های عملیاتی برای ۸ مورد از ۱۸ وصله امنیتی فایرفاکس و همچنین زنجیره‌های کامل ارتقای سطح دسترسی (Privilege Escalation) برای ۸ مورد از ۲۱ وصله امنیتی کرنل ویندوز تولید کرده است.

رویکرد OpenAI اکنون بیش از آنکه متکی بر انتظار از خود مدل برای رد کردن هر درخواست خطرناک باشد، به سمت کنترل دقیق سطح دسترسی سوق پیدا کرده است. برنامه Daybreak Red مسئولیت بیشتری را روی نحوه تصمیم‌گیری درباره اینکه چه کسانی در وهله اول به GPT-5.6-Cyber دسترسی پیدا می‌کنند قرار می‌دهد؛ استراتژی جذابی که با پیشرفت سیستم‌ها در انجام وظایف امنیتی، می‌تواند به بخش بسیار بزرگ‌تری از امنیت هوش مصنوعی (AI Safety) تبدیل شود.

به این پست امتیاز بدید

نظرات در مورد : رونمایی OpenAI از مدل سایبری GPT-5.6-Cyber برای مقابله با خطرات ایجنت‌های هوش مصنوعی سرکش

0 دیدگاه

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *