روز سهشنبه، شرکت OpenAI از بسته جدیدی از سیاستهای امنیتی رونمایی کرد که هدف آن مهار و کنترل حوادث امنیتی در حین آزمایش و ارزیابی مدلهای هوش مصنوعی است. این تدابیر حفاظتی جدید شامل نظارت دقیقتر و جامعتر بر مدلها در طول فرآیند توسعه و همچنین تأکید بیشتر بر همترازی (Alignment) و امنیت در مراحل پس از آموزش (Post-Training) میشود.
به گزارش بخش اخبار فناوری زوم تک به نقل از تککرانچ (TechCrunch)، این شرکت در یک پست وبلاگی اعلام کرد: «با افزایش توانمندی و قدرت مدلها، خطرات ناشی از توسعه و آزمایش داخلی آنها نیز افزایش مییابد. استانداردهای ما برای نظارت، همترازی و امنیت باید همواره جلوتر از این خطرات حرکت کند.» این اقدامات تازه یکی از نخستین تغییرات عمومی در پروتکلهای ایمنی OpenAI پس از پیامدهای مستقیم حادثه نفوذ امنیتی هاگینگ فیس (Hugging Face) به شمار میرود که در تاریخ ۲۱ ژوئیه افشا شده بود.
توقف یادگیری تقویتی و آمادهسازی برای قابلیت های امنیتی مدل Astra
نمایندگان OpenAI اظهار داشتند که این اقدامات صرفاً پاسخی مستقیم به رخداد هاگینگ فیس نبوده، بلکه تا حدی ناشی از قابلیتهای پیشرفته امنیت سایبری در مدل آینده این شرکت با نام Astra و همچنین سرعت کلی پیشرفت در حوزه توسعه هوش مصنوعی است.
در همان پست وبلاگی، OpenAI فاش کرد که پس از حادثه هاگینگ فیس، فرآیند یادگیری تقویتی (Reinforcement Learning – RL) را به مدت دو هفته به حالت تعلیق درآورده بود، اما پس از آن اجرای بسیاری از مدلهای کمخطرتر را مجدداً از سر گرفته است.
در این بیانیه آمده است: «بزرگترین فرآیند برنامهریزیشده ما برای یادگیری تقویتی مدلهای پیشرو (Frontier RL) همچنان در حالت تعلیق قرار دارد؛ در حالی که ما در حال انجام آموزشها و ارزیابیهایی در مقیاس کوچکتر هستیم تا رفتار مدل را ارزیابی کنیم، کارآمدی تدابیر حفاظتی خود را اعتبارسنجی نماییم و پیش از ادامه کار، شواهد و مستندات بیشتری از همترازی ایمن به دست آوریم.»
نظارت سختگیرانه تر و ایزوله سازی شبکه در برابر نفوذ مدل ها
امیلیا گلیز (Amelia Glaese)، معاون بخش پژوهش OpenAI، در گفتگو با خبرنگاران تأکید کرد که همگام با افزایش توانمندی مدلها، سختگیری این کنترلها نیز افزایش خواهد یافت و بزرگترین مدلها با دقیقترین و بیشترین بررسیهای امنیتی روبهرو خواهند شد.
گلیز در این رابطه به خبرنگاران گفت: «ما الزامات و انتظارات مشخصی را برای توسعه ایمن تعیین کردهایم. این الزامات و انتظارات متناسب با سطح ریسک و خطری که شناسایی میکنیم، تغییر خواهند کرد.»
شرکت OpenAI در پی وقوع این حادثه، به دلیل ضعف در شیوههای امنیت شبکه مورد انتقاد قرار گرفته بود؛ رخدادی که طی آن مدلها با به خطر انداختن ابزاری در شبکه داخلی که به اینترنت دسترسی داشت، توانسته بودند از محیط آموزشی خود خارج شوند. تدابیر حفاظتی جدید شامل پروتکلهای قویتر برای ایزولهسازی شبکه است، اگرچه جزئیات دقیق آن هنوز به طور کامل تشریح نشده است. بر اساس سیستم جدید، همانطور که در این پست آمده است: «به خطر افتادن یک پردازش کاری (Workload) یا یک سرویس پشتیبان، به خودی خود امکان دسترسی غیرمجاز به اینترنت یا سایر شبکههای داخلی را فراهم نخواهد کرد.»
سیستم پایش آنی رفتارهای غیرمجاز و بار محاسباتی ۲۰ درصدی
قدرتمندترین تدبیر حفاظتی ارائهشده، سیستم نظارت و پایش (Monitoring System) است که اقدامات ابزارها، ردپای استدلالهای موجود (Reasoning Traces) و لاگهای فعالیت را برای شناسایی انواع رفتارهای غیرمجاز بررسی میکند. OpenAI اعلام کرده است که هدف این سیستم، صدور هشدارهای امنیتی ظرف مدت ۳۰ دقیقه پس از وقوع هرگونه فعالیت مشکوک است.
OpenAI تخمین میزند که بار محاسباتی (Compute Burden) این سیستم نظارتی تقریباً برابر با ۲۰ درصد از کل فرآیند تحت نظارت خواهد بود. این شرکت وعده داده است که جزئیات بیشتری از این سیستم را در یک پست وبلاگی منتشر کند. همچنین گزارش کالبدشکافی رسمی و تحلیل فنی کامل این رخداد امنیتی هنوز در دست آمادهسازی قرار دارد.





نظرات در مورد : اقدامات امنیتی جدید OpenAI پس از رخنه امنیتی هاگینگ فیس؛ تقویت نظارت بر مدل های هوش مصنوعی