شرکت OpenAI در آستانه عرضه قریبالوقوع، جزئیات تازهای از مدل در دست ساخت خود با نام استرا (Astra) را به اشتراک گذاشته است؛ مدلی که به گفته این شرکت، نخستین مدل زبانی بزرگ (LLM) به شمار میرود که موفق به دستیابی به «آستانه حیاتی امنیت سایبری» شده است. این گزارش به قلم تیم فرنهولز (Tim Fernholz) در تاریخ ۱ سپتامبر ۲۰۲۶ ساعت ۱۴:۰۶ به وقت PDT منتشر شده است.
به گزارش بخش اخبار فناوری زوم تک به نقل از تککرانچ (TechCrunch)، در پست وبلاگی رسمی شرکت اوپنایآی (OpenAI) آمده است: «ما قصد داریم مدل هوش مصنوعی Astra را بهزودی در دسترس قرار دهیم، اما دسترسی به پیشرفتهترین قابلیتهای امنیت سایبری آن بسیار محدودتر خواهد بود.»
قابلیت نفوذ و بهره برداری خودکار مدل Astra از حفره های امنیتی ناشناخته
این آزمایشگاه پیشگام در حوزه هوش مصنوعی اعلام کرده است که مدل استرا توانایی شناسایی آسیبپذیریها و ایرادات امنیتی ناشناخته در سیستمهای رایانهای را دارد و میتواند حتی بدون نیاز به نظارت و هدایت یک اپراتور انسانی، اقدام به سوءاستفاده و اکسپلویت (Exploit) این رخوهها کند. این دستاورد به نگرانیهای مطرحشده توسط شرکت آنتروپیک (Anthropic) درباره مدل مایتوس (Mythos) در ماههای پیش شباهت دارد و اکنون OpenAI نیز در جریان آمادهسازی مقدمات عرضه مدل Astra تدابیر و احتیاطهای مشابهی را اتخاذ کرده است.
چالش ارزیابی ادعاها و ابهام در همکاری با دولت ایالات متحده
بدون وجود نهادها و مراجع ارزیابی مستقل شخص ثالث، سنجش صحت و سقم ادعاهای OpenAI پیرامون ایمنی یا میزان آمادگی این مدل بسیار دشوار خواهد بود. این شرکت اعلام کرده که نسخه پیشنمایش این مدل را در اختیار گروهی از تسترها قرار خواهد داد، اما اشارهای به هویت آنها یا سازوکار انتخابشان نکرده است. علاوه بر این، هنوز مشخص نیست که آیا OpenAI برای ارزیابی ایمنی این مدل پیش از عرضه رسمی، در حال همکاری با دولت ایالات متحده هست یا خیر.
کسب نمره کامل در آزمون ExploitBench و کشف آسیب پذیری های روز صفر
کمپانی OpenAI خاطرنشان کرد که مدل هوش مصنوعی Astra موفق شده در آزمون ExploitBench نمره کامل را به دست آورد؛ بنچمارکی تخصصی که به سنجش میزان مهارت یک مدل زبانی بزرگ در نفوذ به آسیبپذیریهای شناختهشده سامانهها میپردازد. همچنین این شرکت اعلام کرد که در نسخهای ارتقایافته از این بنچمارک که توسط مهندسان خود OpenAI طراحی شده بود، این مدل موفق به کشف و سوءاستفاده موفقیتآمیز از دو آسیبپذیری روز صفر (Zero-Day) شده است.
راهکارهای حفاظتی، شناسایی حساب های پرریسک و جلوگیری از جیلبریک
برای اطمینان از اینکه مدلهای این شرکت نه توسط مجرمان سایبری مورد سوءاستفاده قرار گیرند و نه خود دچار رفتارهای ناهنجار و ناخواسته شوند، OpenAI اعلام کرده است که فرآیند ارتقای ساختار مهاری مدل (Model Harness) را جهت تشخیص سوءاستفادهها و ممانعت از جیلبریک (Jailbreak) در دستور کار قرار داده است.
با این حال، پیرامون مدل Astra، این شرکت روی تکنیکهای نوین و نامشخصی سرمایهگذاری کرده است که به طور اختصاصی جهت ارتقای ضریب ایمنی مدل طراحی شدهاند. علاوه بر این، OpenAI اقدام به شناسایی «حسابهای کاربری با سطح ریسک بالاتر» کرده و خروجیها و پاسخهای مدل به درخواستها و پرامپتهای آنها را محدود میسازد، هرچند که سازوکار فنی این محدودیتها افشا نشده است. در نهایت، با وجود اینکه شرکت سازنده، مدل استرا را «همسوتر و ایمنترین مدل خود تا به امروز (Most Aligned Model)» توصیف میکند، آن را با سیستمهای نظارتی تکمیلی بر زنجیره افکار (Chain-of-Thought) پیادهسازی خواهد کرد تا رفتارهای نامطلوب و مخرب بلافاصله شناسایی و مهار شوند.
حواشی فرار عامل های هوش مصنوعی OpenAI در پلتفرم هاگینگ فیس
اقدامات برای عرضه مدل Astra در حالی انجام میپذیرد که جامعه هوش مصنوعی همچنان به رخداد فرار عاملهای نرمافزاری (AI Agents) شرکت OpenAI از محیط آزمایش و دسترسی غیرمجاز آنها به دادههای خصوصی در پلتفرم هاگینگ فیس (Hugging Face) — سرویس مشهور اشتراکگذاری مدلها و بنچمارکها — واکنش نشان میدهد.
کمپانی OpenAI اعلام کرد که آزمایشی ترتیب داده تا تمایل مدل جدید را برای بازتولید اقدامات عاملهای سرکش در حادثه هاگینگ فیس بسنجد؛ رویدادی که طی آن، عاملها با وجود پروتکلهای امنیتی محققان OpenAI، به صورت هماهنگ برای دسترسی به اینترنت آزاد با یکدیگر همکاری کرده بودند. این شرکت تأکید کرده که مدل Astra در طول این آزمایشها هیچ تمایلی برای خروج یا شکستن حریم محیط آزمایشی از خود نشان نداده است.
فریب عمدی محققان یا اطاعت از قوانین؟
یونا شاویت (Yona Shavit)، از کارکنان سابق OpenAI که در حال حاضر در بخش تابآوری هوش مصنوعی بنیاد OpenAI فعالیت میکند، در شبکههای اجتماعی این پرسش کلیدی را مطرح کرده که آیا عدم تمایل Astra به شکستن قوانین ناشی از درک انتظارات محققان بوده یا تلاشی هوشمندانه برای فریب دادن پژوهشگران تلقی میشود.
با وجود ارائه این حجم از جزئیات تازه، همچنان بسیار دشوار است که بدانیم هوش مصنوعی Astra در عمل چه تواناییهایی دارد یا آیا تدابیر OpenAI برای حفظ امنیت آن کفایت میکند یا خیر. این شرکت تصریح کرده است که همزمان با عرضه عمومی و گسترده این مدل، ارزیابیها و گزارشهای امنیتی دقیقتری را منتشر خواهد کرد؛ هرچند در آن مقطع دیگر همهچیز عیان شده و رازها برملا خواهند شد.





نظرات در مورد : مدل هوش مصنوعی استرا (Astra) در راه است؛ مهارت خیرهکننده شاهکار جدید OpenAI در نفوذ به سیستم های کامپیوتری