شرکتهای توسعهدهنده هوش مصنوعی بهطور فزایندهای به دنبال راههایی برای علامتگذاری و درج واترمارک روی محتوای تولیدشده توسط مدلهای خود هستند. اما اکنون، یک ابزار متنباز (Open-source) جدید ساخته شده که هدف آن پاک کردن برخی از این ردپاهای دیجیتالی است.
به گزارش بخش اخبار فناوری زوم تک به نقل از دیجیتال ترندز، یک پروژه در گیتهاب (GitHub) به نام watermarks-remover طراحی شده است تا انواع مختلفی از سیگنالهای منشاء و ردپای هوش مصنوعی را از متنها و فایلها پاک کند. طبق مستندات این پروژه، این ابزار میتواند با کاراکترهای نامرئی یونیکد (Unicode)، واترمارکهای آماری متن و متادادههای جاسازیشده در فرمتهایی مانند PNG، JPEG، SVG، PDF، DOCX، ODT، HTML و Markdown کار کرده و آنها را حذف نماید.
شاید این کار در ظاهر ساده به نظر برسد، اما وقتی به نحوه کارکرد برخی از این واترمارکها نگاه میکنید، ماجرا پیچیدهتر میشود. حذف یک برچسب متاداده (Metadata tag) به نسبتاً تمیز و ساده انجام میشود؛ اما واترمارکهای آماری که در نحوه انتخاب کلمات توسط مدل هوش مصنوعی نهفته شدهاند، کاملاً موضوع متفاوتی هستند. و دقیقاً همینجاست که این پروژه جذابیت پیدا میکند.
برخی از واترمارک های هوش مصنوعی در سبک نگارش پنهان شدهاند
این پروژه رویکرد خود برای پاکسازی ردپای هوش مصنوعی را به لایههای مختلفی تقسیم میکند. یک لایه سیگنالهای مبتنی بر ویرایش، مانند کاراکترهای غیرمعمول یونیکد را هدف قرار میدهد، در حالی که لایه دیگر بر الگوهای آماری متن تولیدشده تمرکز دارد. یک لایه پاکسازی مجزا نیز با اطلاعات منشاء فایل مانند استاندارد C2PA، EXIF، XMP و مشخصات سند سروکار دارد.
جدیدترین نسخه این ابزار، یعنی نسخه 0.3.1، بخش بازنویسی متن (Text Rewriting) را تهاجمیتر کرده است. این ابزار به جای تعویض ساده چند کلمه، میتواند ساختار جملات، انتخاب کلمات، عبارات انتقالی و سایر الگوها را تغییر دهد تا واترمارکهای آماری هوش مصنوعی را مختل کند. این نسخه همچنین شامل گزینههایی است که هدف آنها طبیعیتر جلوه دادن متن بازنویسیشده است.
(توسعهدهنده این پروژه، گیلوم مایر، در حساب کاربری خود اعلام کرده است: «ابزار watermarks-remover اکنون علاوه بر مدل Claude، از حذف واترمارکهای OpenAI و Gemini نیز پشتیبانی میکند.»)
با این حال، یک چالش و نکته مهم وجود دارد. بازنویسی متن برای حذف واترمارک آماری میتواند خود متن اصلی را نیز تغییر دهد. مستندات این پروژه اعتراف میکند که این فرایند میتواند بر لحن، بیان و دقت متن تأثیر بگذارد؛ بهویژه زمانی که بخش بزرگی از کلمات اصلی نیاز به تغییر داشته باشند.
بنابراین، این ابزار دقیقاً معادل دیجیتالی فشردن دکمه «حذف واترمارک» در یک نرمافزار ویرایش تصویر نیست.
توسعه دهندگان ادعا نمیکنند که تمام آشکارسازهای هوش مصنوعی را دور میزنند
در واقع، این پروژه درباره محدودیتهای خود کاملاً شفاف است. توسعهدهندگان، فرایند بازنویسی را صرفاً یک «تلاش در حد توان» (Best effort) توصیف میکنند و میگویند نمیتوانند تضمین کنند که سیستم تشخیص هوش مصنوعی یک شرکت خاص حتماً شکست خواهد خورد. همچنین برخی سیگنالها ممکن است پس از فرایند پاکسازی همچنان باقی بمانند.
این موضوع اهمیت دارد زیرا یک واترمارک همگانی و جهانی برای هوش مصنوعی وجود ندارد که در تمام محتواهای تولیدشده پنهان شده باشد. شرکتها و سیستمهای مختلف میتوانند از رویکردهای متفاوتی استفاده کنند و خود پروژه نیز این سیگنالها را به چند دسته تقسیم میکند.
مخزن این پروژه در گیتهاب همچنین تصریح میکند که هدف آن حفظ حریم خصوصی و تحقیقات علمی است، نه اینکه به افراد کمک کند تا بهدروغ ادعا کنند کارهای تولیدشده با هوش مصنوعی تماماً توسط انسان نوشته شده است.
در حال حاضر، ابزار watermarks-remover را میتوان به بهترین شکل به عنوان نشانهای از مسیری که صنعت هوش مصنوعی در آن حرکت میکند در نظر گرفت. شرکتها به دنبال راههایی برای تعیین منشاء و شناسایی مطالب تولیدشده توسط AI هستند، در حالی که توسعهدهندگان از همین حالا در حال بررسی نحوه حذف یا اختلال در این سیگنالها میباشند.
بخش جذاب ماجرا این نیست که آیا این پروژه خاص گیتهاب میتواند تمام آشکارسازهای هوش مصنوعی (AI Detectors) را شکست دهد یا خیر—که احتمالاً نمیتواند. بخش جذاب این است که واترمارکگذاری هوش مصنوعی از همین حالا به یک بازی موش و گربه تبدیل شده است و ما هنوز در مراحل بسیار ابتدایی آن هستیم.





نظرات در مورد : پروژه جنجالی گیتهاب برای حذف واترمارک هوش مصنوعی؛ آغاز بازی موش و گربه ابزارهای تولید محتوا