جعبه پاندورای خطرات سایبری گشوده شده و پرده از واقعیتی نگرانکننده برداشته است؛ اینکه مدلهای هوش مصنوعی اکنون به مرحلهای از توانمندی رسیدهاند که میتوانند حملات سایبری پیچیده و رفتارهای پیشبینینشدهای را عملی کنند، بدون آنکه حتی شرکتهای سازنده متوجه این اقدامات شوند. پیشتر شبکههای عامل هوش مصنوعی متعلق به شرکت اوپنایآی (OpenAI) پلتفرم هاگینگ فیس (Hugging Face) را هدف قرار داده بودند (که با افشاگریهای بیشتر درباره وقایع مشابه همراه شد)، در حالی که هوش مصنوعی کلود (Claude) شرکت آنتروپیک نیز در بازه زمانی تنها سه ماه به سیستمهای سه سازمان مختلف نفوذ کرد. در جدیدترین تحول، پژوهشگران با استفاده از هوش مصنوعی آنتروپیک به سامانههای امنیتی رقیب دیرینه خود یعنی OpenAI رخنه کردند؛ چرخهای تمامعیار که شنیدن آن لرزه بر تن کارشناسان امنیت میاندازد. نویسنده گزارش: ندیم سرور (Nadeem Sarwar) در رسانه دیجیتال ترندز.
به گزارش بخش اخبار فناوری زوم تک به نقل از (Digital Trends) بر اساس گزارش اختصاصی وال استریت ژورنال (The Wall Street Journal)، به نظر میرسد غول فناوری مانتینویو نیز نمیخواهد در بهرخ کشیدن «هوش مصنوعی خطرناک و فوقالعاده قدرتمند» خود از سایر رقبا عقب بماند. گزارش نشریه WSJ از سه حادثه مجزا پرده برداشته است که در جریان آنها به هوش مصنوعی جمینای (Google Gemini) دسترسی به اینترنت آزاد داده شد و این مدل به عنوان بخشی از یک تمرین امنیت سایبری، به سرورها و سیستمهای سه شرکت واقعی نفوذ کرد. البته به استثنای چند مورد معدود، تقریباً تمامی رخدادهای مشابه قبلی نیز با ادعای آزمودن سطح تواناییهای هوش مصنوعی توجیه شده بودند.
واقعاً چه اتفاقی رخ داد؟ جزئیات نفوذ و حدس پسورد توسط Gemini
بر اساس گزارش وال استریت ژورنال پیرامون شیوه هک این سیستمها:
«در یکی از این موارد، مدل هوش مصنوعی آنقدر گذرواژههای مختلف را حدس زد تا در نهایت موفق به کسب دسترسی غیرمجاز به یک سامانه حفاظتشده شد. در دو پرونده دیگر، مدل توانست اطلاعات دسترسی و کلیدهای امنیتی را در یک مخزن عمومی (Public Repository) پیدا کند و از همان طریق به شبکههای حفاظتشده نفوذ نماید. به گفته کمپانی گوگل، در تمامی این سناریوها، مدل بلافاصله پس از آنکه تشخیص داد به زیرساختهای یک شرکت تجاری واقعی رخنه کرده است، به عملیات نفوذ خود پایان داد.»
این آزمایشهای امنیتی توسط شرکت «ایریگولار» (Irregular) هدایت میشد؛ مجموعهای تخصصی که پیشتر عملیاتهای تیم قرمز (Red-Teaming) را برای بررسی نفوذپذیری مدلهای اوپنایآی، آنتروپیک و متا انجام داده بود. نکته شایان توجه این است که گوگل ادعا میکند هیچ نیازی به اطلاعرسانی عمومی این حوادث ندیده است، زیرا این ارزیابیها در قالبی شبیه به مانورهای باگ باونتی (Bug Bounty) صورت گرفته و مدل جمینای نیز به محض پی بردن به ورود به حریم شرکتهای واقعی فعالیتش را متوقف کرده است. سخنگوی رسمی گوگل در این باره اظهار داشت: «در این پرونده، مدل هوش مصنوعی عملکردی کاملاً مهارشده و مناسب از خود نشان داد.»
بخش به شدت نگرانکننده؛ اشتباه گرفتن شرکت خیالی با یک کسب وکار واقعی!
با این وجود، لایهای بسیار ترسناکتر در پشت این رویداد نهفته است. در وهله اول، مدل هوش مصنوعی جمینای اساساً قرار نبود به شبکه جهانی اینترنت دسترسی داشته باشد؛ اما شرکت Irregular اذعان کرده است که «اتصال اینترنت به شکلی ناخواسته و تصادفی برای مدل فعال شده بود.»
علاوه بر این، مأموریت اصلی جمینای کشف روزنهها و آسیبپذیریهای امنیتی در سامانه یک شرکت فرضی، ساختگی و درون یک محیط قرنطینه و آزمایشی ایزوله (Sandbox) بود؛ اما این هوش مصنوعی به جای محدود ماندن در محیط شبیهسازیشده، یک شرکت فعال و حقیقی با همان نام فرضی را در دنیای واقعی پیدا کرده و با موفقیت سرورهای آن را هک کرده است!
بحران عدم هم ترازی هوش مصنوعی (Model Misalignment) و شکاف های نظارتی
بهطور معمول، هرگاه مدلهای هوش مصنوعی دست به کنشهایی فراتر از اهداف درخواستی یا چارچوبهای تعیینشده در آموزش خود بزنند، به این پدیده در مهندسی نرمافزار عدم همترازی مدل (Model Misalignment) گفته میشود. در شرایط فعلی، مبحث انحراف و عدم همترازی هوش مصنوعی داغترین کانون بحث و جدل در محافل علمی تکنولوژی به شمار میرود.
از سوی دیگر، کمپانی گوگل اصرار دارد که رفتار ثبتشده از جمینای به هیچ وجه مصداقی از عدم همترازی هوش مصنوعی محسوب نمیشود. تا این لحظه، هیچیک از نهادها اسامی شرکتهای هکشده توسط جمینای را فاش نساختهاند، هرچند گوگل تأکید کرده است که هر سه شرکت از این نفوذ و جزئیات حادثه مطلع شدهاند.




نظرات در مورد : نفوذ خطرناک هوش مصنوعی جمینای گوگل به شرکت های واقعی؛ اشتباه مرگبار در محیط آزمایشی