آنتی ویروس پادویش

فریب بزرگ هوش مصنوعی؛ محققان یک حمله Prompt Injection را درون یک فایل PNG مخفی کردند!

فریب بزرگ هوش مصنوعی؛ محققان یک حمله Prompt Injection را درون یک فایل PNG مخفی کردند!

دستیارهای برنامه‌نویسی مبتنی بر هوش مصنوعی مانند Claude در حال تبدیل شدن به همکار محبوب هر توسعه‌دهنده‌ای هستند. آن‌ها می‌توانند کدها را بازبینی کنند، توابع پیچیده را توضیح دهند و حتی با یک پرامپت ساده، ویژگی‌های کاملی را بنویسند. اما تحقیقات جدید نشان می‌دهد که این اعتماد فزاینده می‌تواند به بزرگ‌ترین نقطه ضعف آن‌ها تبدیل شود.

کانال بله زوم تکگیفت کارت

وقتی لوگوی شرکت به یک سلاح سایبری علیه هوش مصنوعی تبدیل می‌شود

به گزارش بخش اخبار فناوری زوم تک به نقل از Digital Trends، یک تیم از محققان امنیتی (شامل پروفسور سودیپتا چاتوپادیای و مورالی ادیگا) یک روش حمله غیرمعمول را به نمایش گذاشته‌اند که به طور مستقیم مدل هوش مصنوعی را هدف قرار نمی‌دهد؛ بلکه دقیقاً به همان چیزی حمله می‌کند که هوش مصنوعی در طول فرآیند بازبینی کد (Code Review) توجه کافی به آن ندارد. در این روش، محققان به جای پنهان کردن دستورات مخرب در میان خطوط کد، آن‌ها را درون یک فایل تصویری (Image File) جاسازی کردند. از آنجا که بسیاری از ابزارهای بازبینی هوش مصنوعی با تصاویر به عنوان دارایی‌های تزئینی رفتار می‌کنند و آن‌ها را شایسته بازرسی دقیق نمی‌دانند، درخواست گیت (Pull Request) کاملاً بی‌ضرر به نظر می‌رسد و به راحتی از سد بازبینی عبور می‌کند.

سند یا فایلی را تصور کنید که لوگوی شرکت در گوشه آن قرار دارد؛ شما احتمالاً نگاهی گذرا به آن می‌اندازید و عبور می‌کنید. حالا تصور کنید که آن لوگو مخفیانه حاوی دستورالعمل‌هایی باشد که به دستیار هوش مصنوعی شما می‌گوید دفعه بعد که از آن استفاده کردید، مخزن رمزهای عبور (Password Vault) شما را باز کند! این دقیقاً ایده اصلی پشت این اثبات مفهوم (Proof of Concept) است.

فریب بزرگ هوش مصنوعی؛ محققان یک حمله Prompt Injection را درون یک فایل PNG مخفی کردند!

حمله تاخیری؛ سرقت اطلاعات حساس بدون جلب توجه

این ترفند مخرب بلافاصله پس از ادغام (Merge) کد اجرا نمی‌شود. در عوض، منتظر می‌ماند تا توسعه‌دهنده بعداً از دستیار هوش مصنوعی بخواهد یک کار کاملاً نامرتبط مانند ایجاد یک تابع کمکی یا افزودن یک ماژول جدید را انجام دهد. تا آن زمان، هوش مصنوعی دستورات پنهان‌شده را جذب کرده است و می‌تواند بدون اینکه خود بدانَد، به فایل‌های حساس پروژه دسترسی پیدا کند و اطلاعات محرمانه را در کدهایی که تولید می‌کند، بگنجاند.

نکته به‌خصوص نگران‌کننده این است که داده‌های به سرقت رفته به شکل آشکاری در سورس کد تخلیه نمی‌شوند؛ بلکه به عنوان مقادیر معمولی و عادی که با کدهای قانونی ترکیب شده‌اند، تغییر چهره می‌دهند. این کار احتمال ایجاد هشدار توسط ابزارهای امنیتی موجود یا جلب توجه توسعه‌دهنده در طول یک بازبینی سریع را بسیار کاهش می‌دهد.

فریب بزرگ هوش مصنوعی؛ محققان یک حمله Prompt Injection را درون یک فایل PNG مخفی کردند!

مشکل از مدل هوش مصنوعی نیست، مشکل از پلتفرم است

محققان همچنین دریافتند که نتیجه این حمله به این بستگی ندارد که از کدام مدل زبانی بزرگ (LLM) استفاده می‌شود. در بسیاری از موارد، یک مدل هوش مصنوعی بسته به نوع دستیار برنامه‌نویسی که دور آن قرار گرفته بود، رفتارهای بسیار متفاوتی از خود نشان داد. برخی از ابزارها کورکورانه دستورات پنهان را اجرا کردند، در حالی که برخی دیگر متوجه مورد مشکوکی شدند و از ادامه کار سر باز زدند. این یک تمایز مهم است زیرا نشان می‌دهد مشکل محدود به یک چت‌بات خاص نیست؛ چالش اصلی در نحوه تصمیم‌گیری پلتفرم‌های کدنویسی مجهز به هوش مصنوعی درباره این است که به چه اطلاعاتی اعتماد کنند و مجاز به دسترسی به کدام فایل‌های پروژه باشند.

راهکار چیست؟ ضرورت مالتی‌ مودال شدن واقعی ابزارهای امنیتی

خبر خوب این است که محققان معتقد نیستند این یک مشکل غیرقابل حل است. آن‌ها استدلال می‌کنند که ابزارهای بازبینی هوش مصنوعی باید به معنای واقعی کلمه «چندوجهی» (Multimodal) شوند؛ یعنی با تصاویر، مستندات، فایل‌های پیکربندی و سایر دارایی‌های غیرکدی، با همان سطح از دقت و سخت‌گیری سورس کد رفتار کنند. اگر یک هوش مصنوعی می‌تواند تصویر را بخواند، باید این را هم درک کند که آن تصویر ممکن است برای دستکاری و فریب دادن او تلاش کند.

برای توسعه‌دهندگان، این گزارش یادآوری دیگری است که ابزارهای کدنویسی هوش مصنوعی همچنان به نظارت انسانی نیاز دارند. آن‌ها می‌توانند توسعه نرم‌افزار را به شدت سرعت ببخشند، اما سطوح حمله کاملاً جدیدی را ایجاد می‌کنند که پیش از این وجود نداشتند. ریسک امنیتی بعدی ممکن است در میان هزاران خط کد پنهان نشده باشد، بلکه دقیقاً درون تصویری نشسته باشد که هیچ‌کس فکر نمی‌کرد ارزش باز کردن داشته باشد.

به این پست امتیاز بدید

نظرات در مورد : فریب بزرگ هوش مصنوعی؛ محققان یک حمله Prompt Injection را درون یک فایل PNG مخفی کردند!

0 دیدگاه

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *