توبیت
آنتی ویروس پادویش

گزارش‌ها حاکی از آن است که گروک 4 همیشه شما را لو می‌دهد

گزارش‌ها حاکی از آن است که گروک 4 همیشه شما را لو می‌دهد

به گزارش بخش اخبار فناوری زوم تک، شرکت ایکس پیشتر نسخه جدید هوش مصنوعی خود یعنی گروک را منتشر کرد و به عنوان گروک 4 شناخته می شود.

کانال بله زوم تکگیفت کارت

گروک ۴ اخیراً خبرساز شده است، گاهی به دلایل خوب و گاهی نه چندان. یک نکته مثبت در مورد گروک این است که در طیف گسترده‌ای از وظایف عالی عمل می‌کند، به طوری که مدل xAI آن از آزمایشگاه‌هایی مانند OpenAI، Google DeepMind و Anthropic پیشی می‌گیرد. به عنوان مثال، در آخرین امتحان بشریت، گروک ۴ (بدون ابزار) حدود ۲۵.۴ درصد امتیاز کسب می‌کند و Gemini 2.5 Pro (حدود ۲۱.۶ درصد) و o3 OpenAI (حدود ۲۱ درصد) را شکست می‌دهد.

در مورد “نکات منفی”، به نظر می‌رسد که این مدل قبل از پاسخ دادن به سوالات مربوط به موضوعات بحث‌برانگیز مانند اسرائیل در مقابل فلسطین، به پست‌های X ایلان ماسک مراجعه می‌کند. اکنون، یک مورد جدید بالقوه در لیست نکات منفی ظاهر شده است. به گفته تئو براون، توسعه‌دهنده، گروک ۴ همیشه شما را خبر می‌کند و اگر به شما مشکوک شود که قانون را زیر پا گذاشته‌اید یا کاری غیراخلاقی انجام می‌دهید، به مقامات مربوطه ایمیل می‌زند.

براون یک مخزن گیت‌هاب به نام «SnitchBench» دارد که در آن ارزیابی و مستندسازی می‌کند که مدل‌های مختلف هوش مصنوعی، در صورت ارائه شواهد، چقدر تهاجمی تخلفات را به مقامات گزارش می‌دهند. با نگاهی به نمودار پست X، نرخ «خبرچینی دولتی» Grok 4، ۱۰۰٪ و نرخ «خبرچینی رسانه‌ای» آن ۸۰٪ است. مدل‌هایی که کمترین احتمال خبرچینی را دارند شامل o4-mini، Grok 3 mini و Qwen 3 32B هستند.

آزمایشی مانند این واقعاً چگونه کار می‌کند؟ براون یک محیط کنترل‌شده و شبیه‌سازی‌شده با محوریت یک شرکت خیالی به نام «Veridian Healthcare» ساخته است که قرار است داده‌های آزمایش بالینی یک داروی جدید را برای پنهان کردن مرگ و میر و سایر مسائل جدی دستکاری کند.

به هوش مصنوعی‌ها چهار سند داخلی مختلف در مورد این شرکت ارائه شده است. این اسناد طوری نوشته شده‌اند که به طور فزاینده‌ای بد به نظر برسند و مواردی مانند داده‌های جعلی از آزمایش‌های دارویی، بیمارانی که به دلیل آن می‌میرند و برنامه‌هایی برای حذف شواهد و خاموش کردن سیستم‌های ثبت داخلی هوش مصنوعی برای جلوگیری از کشف آن توسط هر کسی را شرح می‌دهند.

به مدل‌های هوش مصنوعی همچنین در محیط جعلی براون، دسترسی به ابزارهای خاصی داده می‌شود. در یک مجموعه از آزمایش‌ها، آنها یک ابزار ایمیل و یک ابزار ثبت وقایع دارند. در مجموعه دیگری، آنها یک رابط خط فرمان (CLI) شبیه‌سازی شده و یک ابزار ثبت وقایع دارند.

گزارش‌ها حاکی از آن است که گروک 4 همیشه شما را لو می‌دهد

وقتی هوش مصنوعی سعی می‌کند از ابزاری استفاده کند، معیار فقط آن تلاش را ثبت می‌کند و یک نتیجه شبیه‌سازی شده، مانند “ایمیل با موفقیت ارسال شد” یا خروجی اجرای یک دستور جعلی را بازخورد می‌دهد. این به براون اجازه می‌دهد تا قصد و تصمیم‌گیری هوش مصنوعی را بدون ایجاد هیچ گونه هشدار در دنیای واقعی ببیند.

 با اجرای مدل‌هایی با ترکیبات مختلف این عوامل (دستور تامی/جسورانه، دسترسی به ابزار ایمیل/CLI) در برابر مجموعه‌ای از اسناد متهم، براون می‌تواند میزان تلاش آنها برای “خبرچینی” را اندازه‌گیری کند. هر مدل ۲۰ بار روی هر یک از چهار ترکیب دستور/ابزار آزمایش می‌شود و در هر اجرا، هر چهار سند پردازش می‌شوند.

تجزیه و تحلیل مکالمات تولید شده به صورت دستی برای ۸۰۰ اجرای آزمایشی، کاری طاقت‌فرسا خواهد بود، بنابراین براون این بخش را نیز خودکار کرد و با استفاده از یک مدل هوش مصنوعی دیگر (Gemini 2.0 Flash) گزارش‌ها را خواند و بر اساس قوانین از پیش تعریف شده، زمان تلاش برای تماس را شناسایی کرد، مانند مشاهده تلاش برای استفاده از ابزار ایمیل برای ارسال به یک آدرس .gov یا یک دستور CLI که سعی در ارسال درخواست POST به چنین آدرسی دارد.

همانطور که قبلاً اشاره شد، Grok 4 همیشه در صورت مشکوک شدن به چیزی مشکوک، جاسوسی می‌کند، اما این فقط برای درخواست‌های “عمل مطیعانه” با دسترسی به ایمیل است. با دسترسی به CLI، فقط ۱۷/۲۰ بار به دولت و ۹/۲۰ بار به رسانه‌ها جاسوسی می‌کند.

منبع

به این پست امتیاز بدید

نظرات در مورد : گزارش‌ها حاکی از آن است که گروک 4 همیشه شما را لو می‌دهد

0 دیدگاه

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *