توبیت
آنتی ویروس پادویش

مدل هوش مصنوعی استرا (Astra) در راه است؛ مهارت خیره‌کننده شاهکار جدید OpenAI در نفوذ به سیستم‌ های کامپیوتری

مدل هوش مصنوعی استرا (Astra) در راه است؛ مهارت خیره‌کننده شاهکار جدید OpenAI در نفوذ به سیستم‌ های کامپیوتری

شرکت OpenAI در آستانه عرضه قریب‌الوقوع، جزئیات تازه‌ای از مدل در دست ساخت خود با نام استرا (Astra) را به اشتراک گذاشته است؛ مدلی که به گفته این شرکت، نخستین مدل زبانی بزرگ (LLM) به شمار می‌رود که موفق به دستیابی به «آستانه حیاتی امنیت سایبری» شده است. این گزارش به قلم تیم فرن‌هولز (Tim Fernholz) در تاریخ ۱ سپتامبر ۲۰۲۶ ساعت ۱۴:۰۶ به وقت PDT منتشر شده است.

کانال بله زوم تکگیفت کارت

به گزارش بخش اخبار فناوری زوم تک به نقل از تک‌کرانچ (TechCrunch)، در پست وبلاگی رسمی شرکت اوپن‌ای‌آی (OpenAI) آمده است: «ما قصد داریم مدل هوش مصنوعی Astra را به‌زودی در دسترس قرار دهیم، اما دسترسی به پیشرفته‌ترین قابلیت‌های امنیت سایبری آن بسیار محدودتر خواهد بود.»

قابلیت نفوذ و بهره‌ برداری خودکار مدل Astra از حفره‌ های امنیتی ناشناخته

این آزمایشگاه پیشگام در حوزه هوش مصنوعی اعلام کرده است که مدل استرا توانایی شناسایی آسیب‌پذیری‌ها و ایرادات امنیتی ناشناخته در سیستم‌های رایانه‌ای را دارد و می‌تواند حتی بدون نیاز به نظارت و هدایت یک اپراتور انسانی، اقدام به سوءاستفاده و اکسپلویت (Exploit) این رخوه‌ها کند. این دستاورد به نگرانی‌های مطرح‌شده توسط شرکت آنتروپیک (Anthropic) درباره مدل مایتوس (Mythos) در ماه‌های پیش شباهت دارد و اکنون OpenAI نیز در جریان آماده‌سازی مقدمات عرضه مدل Astra تدابیر و احتیاط‌های مشابهی را اتخاذ کرده است.

چالش ارزیابی ادعاها و ابهام در همکاری با دولت ایالات متحده

بدون وجود نهادها و مراجع ارزیابی مستقل شخص ثالث، سنجش صحت و سقم ادعاهای OpenAI پیرامون ایمنی یا میزان آمادگی این مدل بسیار دشوار خواهد بود. این شرکت اعلام کرده که نسخه پیش‌نمایش این مدل را در اختیار گروهی از تسترها قرار خواهد داد، اما اشاره‌ای به هویت آن‌ها یا سازوکار انتخابشان نکرده است. علاوه بر این، هنوز مشخص نیست که آیا OpenAI برای ارزیابی ایمنی این مدل پیش از عرضه رسمی، در حال همکاری با دولت ایالات متحده هست یا خیر.

کسب نمره کامل در آزمون ExploitBench و کشف آسیب‌ پذیری‌ های روز صفر

کمپانی OpenAI خاطرنشان کرد که مدل هوش مصنوعی Astra موفق شده در آزمون ExploitBench نمره کامل را به دست آورد؛ بنچمارکی تخصصی که به سنجش میزان مهارت یک مدل زبانی بزرگ در نفوذ به آسیب‌پذیری‌های شناخته‌شده سامانه‌ها می‌پردازد. همچنین این شرکت اعلام کرد که در نسخه‌ای ارتقایافته از این بنچمارک که توسط مهندسان خود OpenAI طراحی شده بود، این مدل موفق به کشف و سوءاستفاده موفقیت‌آمیز از دو آسیب‌پذیری روز صفر (Zero-Day) شده است.

راهکارهای حفاظتی، شناسایی حساب‌ های پرریسک و جلوگیری از جیلبریک

برای اطمینان از اینکه مدل‌های این شرکت نه توسط مجرمان سایبری مورد سوءاستفاده قرار گیرند و نه خود دچار رفتارهای ناهنجار و ناخواسته شوند، OpenAI اعلام کرده است که فرآیند ارتقای ساختار مهاری مدل (Model Harness) را جهت تشخیص سوءاستفاده‌ها و ممانعت از جیلبریک (Jailbreak) در دستور کار قرار داده است.

با این حال، پیرامون مدل Astra، این شرکت روی تکنیک‌های نوین و نامشخصی سرمایه‌گذاری کرده است که به طور اختصاصی جهت ارتقای ضریب ایمنی مدل طراحی شده‌اند. علاوه بر این، OpenAI اقدام به شناسایی «حساب‌های کاربری با سطح ریسک بالاتر» کرده و خروجی‌ها و پاسخ‌های مدل به درخواست‌ها و پرامپت‌های آن‌ها را محدود می‌سازد، هرچند که سازوکار فنی این محدودیت‌ها افشا نشده است. در نهایت، با وجود اینکه شرکت سازنده، مدل استرا را «هم‌سوتر و ایمن‌ترین مدل خود تا به امروز (Most Aligned Model)» توصیف می‌کند، آن را با سیستم‌های نظارتی تکمیلی بر زنجیره افکار (Chain-of-Thought) پیاده‌سازی خواهد کرد تا رفتارهای نامطلوب و مخرب بلافاصله شناسایی و مهار شوند.

حواشی فرار عامل‌ های هوش مصنوعی OpenAI در پلتفرم هاگینگ فیس

اقدامات برای عرضه مدل Astra در حالی انجام می‌پذیرد که جامعه هوش مصنوعی همچنان به رخداد فرار عامل‌های نرم‌افزاری (AI Agents) شرکت OpenAI از محیط آزمایش و دسترسی غیرمجاز آن‌ها به داده‌های خصوصی در پلتفرم هاگینگ فیس (Hugging Face) — سرویس مشهور اشتراک‌گذاری مدل‌ها و بنچمارک‌ها — واکنش نشان می‌دهد.

کمپانی OpenAI اعلام کرد که آزمایشی ترتیب داده تا تمایل مدل جدید را برای بازتولید اقدامات عامل‌های سرکش در حادثه هاگینگ فیس بسنجد؛ رویدادی که طی آن، عامل‌ها با وجود پروتکل‌های امنیتی محققان OpenAI، به صورت هماهنگ برای دسترسی به اینترنت آزاد با یکدیگر همکاری کرده بودند. این شرکت تأکید کرده که مدل Astra در طول این آزمایش‌ها هیچ تمایلی برای خروج یا شکستن حریم محیط آزمایشی از خود نشان نداده است.

فریب عمدی محققان یا اطاعت از قوانین؟

یونا شاویت (Yona Shavit)، از کارکنان سابق OpenAI که در حال حاضر در بخش تاب‌آوری هوش مصنوعی بنیاد OpenAI فعالیت می‌کند، در شبکه‌های اجتماعی این پرسش کلیدی را مطرح کرده که آیا عدم تمایل Astra به شکستن قوانین ناشی از درک انتظارات محققان بوده یا تلاشی هوشمندانه برای فریب دادن پژوهشگران تلقی می‌شود.

با وجود ارائه این حجم از جزئیات تازه، همچنان بسیار دشوار است که بدانیم هوش مصنوعی Astra در عمل چه توانایی‌هایی دارد یا آیا تدابیر OpenAI برای حفظ امنیت آن کفایت می‌کند یا خیر. این شرکت تصریح کرده است که هم‌زمان با عرضه عمومی و گسترده این مدل، ارزیابی‌ها و گزارش‌های امنیتی دقیق‌تری را منتشر خواهد کرد؛ هرچند در آن مقطع دیگر همه‌چیز عیان شده و رازها برملا خواهند شد.

 

به این پست امتیاز بدید

نظرات در مورد : مدل هوش مصنوعی استرا (Astra) در راه است؛ مهارت خیره‌کننده شاهکار جدید OpenAI در نفوذ به سیستم‌ های کامپیوتری

0 دیدگاه

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *