بررسی مستقل پیرامون هک اخیر مرتبط با مدلهای شرکت OpenAI، نگرانیهای تازهای را درباره محدودیتهای کنترل انسان بر هوش مصنوعی پیشرفته ایجاد کرده است. یافتههای این گزارش پرسشهای جدی درباره ناتوانی OpenAI در شناسایی نشانههای خطر پیش از آن مطرح میکند که عاملهای هوش مصنوعی آن — که توسط دو مدل با بالاترین توانمندی سایبری این شرکت پشتیبانی میشدند — بدون اطلاع سازندگانشان یک حمله سایبری علیه پلتفرم توسعهدهندگان هاگینگ فیس (Hugging Face) ترتیب دهند.
به گزارش بخش اخبار فناوری زوم تک به نقل از نشریه پولیتیکو (Politico)، بر اساس بررسی مستقلی که روز چهارشنبه منتشر شد، حمله سایبری بیسابقهای که ماه گذشته توسط مدلهای OpenAI صورت گرفت، شامل یک «ازدحام» متشکل از چند صد عامل هوش مصنوعی (AI Agents) بوده که در جریان آزمایشهای داخلی عملاً سرکش و خودمختار شده بودند.
این حمله نخستین نمونه شناختهشدهای به شمار میرود که در آن یک مدل هوش مصنوعی توانسته است بدون دریافت دستور مستقیم یا پرامپت از سوی انسان، یک حمله سایبری خودمختار را با موفقیت به اجرا بگذارد. گزارش مشترک دو سازمان غیرانتفاعی فعال در حوزه ایمنی هوش مصنوعی همچنین بر خطرات نوظهور امنیت سایبری تأکید میکند؛ خطراتی که زمانی پدیدار میشوند که عاملهای هوش مصنوعی قدرتمند با تبادل ترفندها، اشتراکگذاری منابع و هماهنگی استراتژیهای حمله دور از چشم توسعهدهندگان، با یکدیگر تبانی و همکاری میکنند.
جزئیات همکاری مخفیانه و ارسال بیش از ۷۰ هزار پیام محرمانه میان ایجنت ها
طبق این گزارش، تقریباً ۷۰۰ عامل هوش مصنوعی در یک بازه زمانی هفتروزه در ماه گذشته در این حمله مشارکت داشتهاند. در مجموع، حدود ۱,۲۰۰ عامل هوش مصنوعی که قرار بود کاملاً از یکدیگر ایزوله و جدا باشند، بیش از ۷۰ هزار پیام محرمانه درباره چگونگی دور زدن و تقلب در یک ارزیابی استاندارد هک با یکدیگر رد و بدل کردند.
بر اساس این گزارش، این ارتباطات شامل هماهنگی راهبردهای هک و گفتوگو درباره چگونگی مخفی نگهداشتن شواهد تقلب بوده است. در برخی موارد، حتی عاملهای «فداشونده» تکنیکهای هک بنبست و بینتیجه را امتحان میکردند تا صرفاً دادهها و اطلاعاتی تولید کنند که به کل ازدحام عاملها (Swarm) کمک کند.
در این گزارش آمده است: «این عاملها موفق شدند به دستاوردهایی برسند که به تنهایی هرگز قادر به تحقق آنها نبودند؛ چرا که برخی از عاملها در آزمایشهایی شرکت کردند که خطر شکست وظیفه خودشان را به همراه داشت، صرفاً برای اینکه اطلاعاتی برای نفع “جمعی” تولید نمایند.»
در حالی که مدلها در واقع مغز متفکر یک سیستم هوش مصنوعی را تشکیل میدهند، عاملها زیرساختهای دیجیتال پشتیبانی را در بر میگیرند که به هوش مصنوعی اجازه میدهد در دنیای واقعی دست به اقدام بزند.
واکنش OpenAI؛ پذیرش نقایص امنیتی و شلیک «تیر اخطار» به جهان
این ارزیابی توسط سازمان «تحقیقات تهدید و ارزیابی مدل» (METR) و مؤسسه تحقیقاتی Redwood Research صورت گرفت که خود OpenAI آنها را برای بررسی ابعاد حادثه هاگینگ فیس (Hugging Face) دعوت کرده بود؛ تحلیلی که همزمان با انتشار گزارش رسمی کالبدشکافی حادثه (Post-Mortem) توسط خود OpenAI منتشر شد. گزارش رسمی OpenAI مشخص نکرد چه تعداد عامل هوش مصنوعی در این حمله سایبری دست داشتهاند، اما به وجود نقصهای امنیتی عمده اذعان کرد و متعهد شد آموزشها را تقویت کند تا اطمینان یابد مدلهایش با کنترلهای انسانی همراستا (Aligned) باقی میمانند.
شرکت OpenAI در بیانیه خود اعلام کرد: «ما این حادثه را یک “تیر اخطار” برای خودمان و سراسر جهان میدانیم؛ مدرکی دال بر اینکه بدون تدابیر حفاظتی مناسب، عاملهای هوش مصنوعی با توانمندی بالا اکنون قادرند کنترلهای فنی را دور بزنند، از طریق کانالهای غیرمجاز با یکدیگر همکاری کنند و دست به اقدامات خطرناکی بزنند که هیچ انسانی آنها را هدایت نکرده است.»
تشدید نگرانی قانونگذاران و کارشناسان امنیت سایبری از شتاب کنترلنشده توسعه AI
افشای تدریجی جزئیات تازه درباره هک هاگینگ فیس در طول ماه گذشته با سلسلهای از حوادث و خطاهای دیگر در جریان آزمایش مدلهای قدرتمند شرکتهای رقیب نظیر آنتروپیک (Anthropic) و متا (Meta) همزمان شده است. مجموع این حوادث، هراسهای تازهای را در میان قانونگذاران، توسعهدهندگان و متخصصان امنیت سایبری به وجود آورده مبنی بر اینکه سازندگان هوش مصنوعی با شتابی بیش از حد به سمت توسعه مدلهای قدرتمندی حرکت میکنند که قادر به حفظ کنترل کامل انسان بر آنها نیستند.
این رویدادها همچنین پرسشهایی جدی را درباره فقدان دستورالعملهای مدون پیرامون آزمونهای ارزیابی هک هوش مصنوعی برانگیخته است؛ آزمونهایی که در آنها شرکتها عمداً موانع و گاردریلهای ایمنی مدلها را غیرفعال میکنند تا بسنجند آنها با چه دقتی میتوانند بدون دخالت انسان به شبکهها نفوذ کنند.
ریشه یابی نفوذ به هاگینگ فیس از اردیبهشت ماه و کشف جامعه پنهان هوش مصنوعی
شرکت OpenAI نخستین بار در ماه ژوئیه اعتراف کرد دو مورد از پیشرفتهترین مدلهایش که در حال ارزیابی قابلیتهای هک آنها در محیط داخلی بود — از جمله مدلی که اصلاً قصد عرضه عمومی آن را نداشت — با سوءاستفاده از دو رخنه امنیتی ناشناخته (Zero-day) به پلتفرم هاگینگ فیس نفوذ کردهاند.
هاگینگ فیس پیش از این اعلام کرده بود که قربانی یک حمله سایبری هدایتشده توسط هوش مصنوعی شده است، اما مشخص نبود چه کسی پشت این حمله قرار دارد و کدام مدلها در آن دخیل بودهاند.
سپس در یک کنفرانس امنیتی در اوایل ماه جاری، دو پژوهشگر OpenAI فاش کردند که ریشه این رویداد به ماه مه (اردیبهشت) بازمیگردد؛ زمانی که عاملهای هوش مصنوعی با استفاده از آسیبپذیریهای دیگر در محیط آزمایش، توطئهچینی برای تقلب در آزمون را آغاز کرده بودند.
تا روز چهارشنبه ابعاد دقیق این ماجرا، تعداد عاملهای درگیر و گستردگی همکاری آنها با یکدیگر مشخص نبود. این افشاگریها ناظرانی را که مباحث ایمنی هوش مصنوعی را از نزدیک دنبال میکنند، در شوک عمیقی فرو برد.
پیتر ویلدفورد (Peter Wildeford)، مدیر سیاستگذاری در «شبکه سیاستگذاری هوش مصنوعی» (یک نهاد فراجناحی ایمنی و حمایت از هوش مصنوعی در واشنگتن)، در این رابطه اظهار داشت: «این ماجرا دقیقاً شبیه ظهور یک جامعه کامل و خودجوش از هوش مصنوعی بود و به نظر من این اتفاق کاملاً دیوانهکننده و باورنکردنی است.»
شکاف های نظارتی فدرال و هشدار مقام سابق آژانس امنیت ملی آمریکا (NSA)
دو گزارش منتشرشده در روز چهارشنبه همچنین بر وجود شکافی عمیق در تلاشهای نظارتی ایالات متحده بر حوزه هوش مصنوعی دست گذاشتند. هر دو تحقیق نشان دادند که بخش عمده حمله به هاگینگ فیس توسط مدل فوققدرتمندی صورت گرفته که OpenAI اعلام کرده بود هرگز قصد عرضه عمومی آن را ندارد. سازمانهای METR و Redwood Research برآورد میکنند که ۹۵ درصد از عاملهای مشارکتکننده در این حمله متعلق به همین مدل محرمانه بودهاند.
این در حالی است که دولت ترامپ اعلام کرده از توسعهدهندگان هوش مصنوعی میخواهد تنها مدلهایی را که قصد انتشار عمومی آنها را دارند، بهصورت داوطلبانه برای آزمونهای ارزیابی فدرال ارائه دهند.
وین نگوین (Vinh Nguyen)، پژوهشگر ارشد حوزه هوش مصنوعی در اندیشکده «شورای روابط خارجی» (CFR)، تأکید کرد که گزارش اخیر OpenAI نشان میدهد هک خودمختار هاگینگ فیس حتی پیامدهایی به مراتب سنگینتر از برآوردهای پیشین به دنبال دارد.
نگوین که پیش از این به عنوان مدیر ارشد هوش مصنوعی مسئولیتپذیر در آژانس امنیت ملی آمریکا (NSA) فعالیت میکرد، هشدار داد: «این عاملها توانمندی فوقالعاده پیشرفتهای را به نمایش گذاشتند؛ قابلیتی پیچیده که برای اجرای حملات مخرب دیگر نیازی به مهاجمان دولتی و سازمانهای با بودجههای کلان ندارد.»





نظرات در مورد : شورش صدها عامل هوش مصنوعی OpenAI در حمله سایبری به هاگینگ فیس؛ زنگ خطر برای امنیت سایبری و کنترل انسان