توبیت
آنتی ویروس پادویش

شورش صدها عامل هوش مصنوعی OpenAI در حمله سایبری به هاگینگ فیس؛ زنگ خطر برای امنیت سایبری و کنترل انسان

شورش صدها عامل هوش مصنوعی OpenAI در حمله سایبری به هاگینگ فیس؛ زنگ خطر برای امنیت سایبری و کنترل انسان

بررسی مستقل پیرامون هک اخیر مرتبط با مدل‌های شرکت OpenAI، نگرانی‌های تازه‌ای را درباره محدودیت‌های کنترل انسان بر هوش مصنوعی پیشرفته ایجاد کرده است. یافته‌های این گزارش پرسش‌های جدی درباره ناتوانی OpenAI در شناسایی نشانه‌های خطر پیش از آن مطرح می‌کند که عامل‌های هوش مصنوعی آن — که توسط دو مدل با بالاترین توانمندی سایبری این شرکت پشتیبانی می‌شدند — بدون اطلاع سازندگانشان یک حمله سایبری علیه پلتفرم توسعه‌دهندگان هاگینگ فیس (Hugging Face) ترتیب دهند.

کانال بله زوم تکگیفت کارت

به گزارش بخش اخبار فناوری زوم تک به نقل از نشریه پولیتیکو (Politico)، بر اساس بررسی مستقلی که روز چهارشنبه منتشر شد، حمله سایبری بی‌سابقه‌ای که ماه گذشته توسط مدل‌های OpenAI صورت گرفت، شامل یک «ازدحام» متشکل از چند صد عامل هوش مصنوعی (AI Agents) بوده که در جریان آزمایش‌های داخلی عملاً سرکش و خودمختار شده بودند.

این حمله نخستین نمونه شناخته‌شده‌ای به شمار می‌رود که در آن یک مدل هوش مصنوعی توانسته است بدون دریافت دستور مستقیم یا پرامپت از سوی انسان، یک حمله سایبری خودمختار را با موفقیت به اجرا بگذارد. گزارش مشترک دو سازمان غیرانتفاعی فعال در حوزه ایمنی هوش مصنوعی همچنین بر خطرات نوظهور امنیت سایبری تأکید می‌کند؛ خطراتی که زمانی پدیدار می‌شوند که عامل‌های هوش مصنوعی قدرتمند با تبادل ترفندها، اشتراک‌گذاری منابع و هماهنگی استراتژی‌های حمله دور از چشم توسعه‌دهندگان، با یکدیگر تبانی و همکاری می‌کنند.

جزئیات همکاری مخفیانه و ارسال بیش از ۷۰ هزار پیام محرمانه میان ایجنت‌ ها

طبق این گزارش، تقریباً ۷۰۰ عامل هوش مصنوعی در یک بازه زمانی هفت‌روزه در ماه گذشته در این حمله مشارکت داشته‌اند. در مجموع، حدود ۱,۲۰۰ عامل هوش مصنوعی که قرار بود کاملاً از یکدیگر ایزوله و جدا باشند، بیش از ۷۰ هزار پیام محرمانه درباره چگونگی دور زدن و تقلب در یک ارزیابی استاندارد هک با یکدیگر رد و بدل کردند.

بر اساس این گزارش، این ارتباطات شامل هماهنگی راهبردهای هک و گفت‌وگو درباره چگونگی مخفی نگه‌داشتن شواهد تقلب بوده است. در برخی موارد، حتی عامل‌های «فداشونده» تکنیک‌های هک بن‌بست و بی‌نتیجه را امتحان می‌کردند تا صرفاً داده‌ها و اطلاعاتی تولید کنند که به کل ازدحام عامل‌ها (Swarm) کمک کند.

در این گزارش آمده است: «این عامل‌ها موفق شدند به دستاوردهایی برسند که به تنهایی هرگز قادر به تحقق آن‌ها نبودند؛ چرا که برخی از عامل‌ها در آزمایش‌هایی شرکت کردند که خطر شکست وظیفه خودشان را به همراه داشت، صرفاً برای اینکه اطلاعاتی برای نفع “جمعی” تولید نمایند.»

در حالی که مدل‌ها در واقع مغز متفکر یک سیستم هوش مصنوعی را تشکیل می‌دهند، عامل‌ها زیرساخت‌های دیجیتال پشتیبانی را در بر می‌گیرند که به هوش مصنوعی اجازه می‌دهد در دنیای واقعی دست به اقدام بزند.

واکنش OpenAI؛ پذیرش نقایص امنیتی و شلیک «تیر اخطار» به جهان

این ارزیابی توسط سازمان «تحقیقات تهدید و ارزیابی مدل» (METR) و مؤسسه تحقیقاتی Redwood Research صورت گرفت که خود OpenAI آن‌ها را برای بررسی ابعاد حادثه هاگینگ فیس (Hugging Face) دعوت کرده بود؛ تحلیلی که هم‌زمان با انتشار گزارش رسمی کالبدشکافی حادثه (Post-Mortem) توسط خود OpenAI منتشر شد. گزارش رسمی OpenAI مشخص نکرد چه تعداد عامل هوش مصنوعی در این حمله سایبری دست داشته‌اند، اما به وجود نقص‌های امنیتی عمده اذعان کرد و متعهد شد آموزش‌ها را تقویت کند تا اطمینان یابد مدل‌هایش با کنترل‌های انسانی هم‌راستا (Aligned) باقی می‌مانند.

شرکت OpenAI در بیانیه خود اعلام کرد: «ما این حادثه را یک “تیر اخطار” برای خودمان و سراسر جهان می‌دانیم؛ مدرکی دال بر اینکه بدون تدابیر حفاظتی مناسب، عامل‌های هوش مصنوعی با توانمندی بالا اکنون قادرند کنترل‌های فنی را دور بزنند، از طریق کانال‌های غیرمجاز با یکدیگر همکاری کنند و دست به اقدامات خطرناکی بزنند که هیچ انسانی آن‌ها را هدایت نکرده است.»

تشدید نگرانی قانون‌گذاران و کارشناسان امنیت سایبری از شتاب کنترل‌نشده توسعه AI

افشای تدریجی جزئیات تازه درباره هک هاگینگ فیس در طول ماه گذشته با سلسله‌ای از حوادث و خطاهای دیگر در جریان آزمایش مدل‌های قدرتمند شرکت‌های رقیب نظیر آنتروپیک (Anthropic) و متا (Meta) هم‌زمان شده است. مجموع این حوادث، هراس‌های تازه‌ای را در میان قانون‌گذاران، توسعه‌دهندگان و متخصصان امنیت سایبری به وجود آورده مبنی بر اینکه سازندگان هوش مصنوعی با شتابی بیش از حد به سمت توسعه مدل‌های قدرتمندی حرکت می‌کنند که قادر به حفظ کنترل کامل انسان بر آن‌ها نیستند.

این رویدادها همچنین پرسش‌هایی جدی را درباره فقدان دستورالعمل‌های مدون پیرامون آزمون‌های ارزیابی هک هوش مصنوعی برانگیخته است؛ آزمون‌هایی که در آن‌ها شرکت‌ها عمداً موانع و گاردریل‌های ایمنی مدل‌ها را غیرفعال می‌کنند تا بسنجند آن‌ها با چه دقتی می‌توانند بدون دخالت انسان به شبکه‌ها نفوذ کنند.

ریشه‌ یابی نفوذ به هاگینگ فیس از اردیبهشت‌ ماه و کشف جامعه پنهان هوش مصنوعی

شرکت OpenAI نخستین بار در ماه ژوئیه اعتراف کرد دو مورد از پیشرفته‌ترین مدل‌هایش که در حال ارزیابی قابلیت‌های هک آن‌ها در محیط داخلی بود — از جمله مدلی که اصلاً قصد عرضه عمومی آن را نداشت — با سوءاستفاده از دو رخنه امنیتی ناشناخته (Zero-day) به پلتفرم هاگینگ فیس نفوذ کرده‌اند.

هاگینگ فیس پیش از این اعلام کرده بود که قربانی یک حمله سایبری هدایت‌شده توسط هوش مصنوعی شده است، اما مشخص نبود چه کسی پشت این حمله قرار دارد و کدام مدل‌ها در آن دخیل بوده‌اند.

سپس در یک کنفرانس امنیتی در اوایل ماه جاری، دو پژوهشگر OpenAI فاش کردند که ریشه این رویداد به ماه مه (اردیبهشت) بازمی‌گردد؛ زمانی که عامل‌های هوش مصنوعی با استفاده از آسیب‌پذیری‌های دیگر در محیط آزمایش، توطئه‌چینی برای تقلب در آزمون را آغاز کرده بودند.

تا روز چهارشنبه ابعاد دقیق این ماجرا، تعداد عامل‌های درگیر و گستردگی همکاری آن‌ها با یکدیگر مشخص نبود. این افشاگری‌ها ناظرانی را که مباحث ایمنی هوش مصنوعی را از نزدیک دنبال می‌کنند، در شوک عمیقی فرو برد.

پیتر ویلدفورد (Peter Wildeford)، مدیر سیاست‌گذاری در «شبکه سیاست‌گذاری هوش مصنوعی» (یک نهاد فراجناحی ایمنی و حمایت از هوش مصنوعی در واشنگتن)، در این رابطه اظهار داشت: «این ماجرا دقیقاً شبیه ظهور یک جامعه کامل و خودجوش از هوش مصنوعی بود و به نظر من این اتفاق کاملاً دیوانه‌کننده و باورنکردنی است.»

شکاف‌ های نظارتی فدرال و هشدار مقام سابق آژانس امنیت ملی آمریکا (NSA)

دو گزارش منتشرشده در روز چهارشنبه همچنین بر وجود شکافی عمیق در تلاش‌های نظارتی ایالات متحده بر حوزه هوش مصنوعی دست گذاشتند. هر دو تحقیق نشان دادند که بخش عمده حمله به هاگینگ فیس توسط مدل فوق‌قدرتمندی صورت گرفته که OpenAI اعلام کرده بود هرگز قصد عرضه عمومی آن را ندارد. سازمان‌های METR و Redwood Research برآورد می‌کنند که ۹۵ درصد از عامل‌های مشارکت‌کننده در این حمله متعلق به همین مدل محرمانه بوده‌اند.

این در حالی است که دولت ترامپ اعلام کرده از توسعه‌دهندگان هوش مصنوعی می‌خواهد تنها مدل‌هایی را که قصد انتشار عمومی آن‌ها را دارند، به‌صورت داوطلبانه برای آزمون‌های ارزیابی فدرال ارائه دهند.

وین نگوین (Vinh Nguyen)، پژوهشگر ارشد حوزه هوش مصنوعی در اندیشکده «شورای روابط خارجی» (CFR)، تأکید کرد که گزارش اخیر OpenAI نشان می‌دهد هک خودمختار هاگینگ فیس حتی پیامدهایی به مراتب سنگین‌تر از برآوردهای پیشین به دنبال دارد.

نگوین که پیش از این به عنوان مدیر ارشد هوش مصنوعی مسئولیت‌پذیر در آژانس امنیت ملی آمریکا (NSA) فعالیت می‌کرد، هشدار داد: «این عامل‌ها توانمندی فوق‌العاده پیشرفته‌ای را به نمایش گذاشتند؛ قابلیتی پیچیده که برای اجرای حملات مخرب دیگر نیازی به مهاجمان دولتی و سازمان‌های با بودجه‌های کلان ندارد.»

به این پست امتیاز بدید

نظرات در مورد : شورش صدها عامل هوش مصنوعی OpenAI در حمله سایبری به هاگینگ فیس؛ زنگ خطر برای امنیت سایبری و کنترل انسان

0 دیدگاه

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *