به گزارش بخش اخبار فناوری زوم تک، شرکت ایکس پیشتر نسخه جدید هوش مصنوعی خود یعنی گروک را منتشر کرد و به عنوان گروک 4 شناخته می شود.
گروک ۴ اخیراً خبرساز شده است، گاهی به دلایل خوب و گاهی نه چندان. یک نکته مثبت در مورد گروک این است که در طیف گستردهای از وظایف عالی عمل میکند، به طوری که مدل xAI آن از آزمایشگاههایی مانند OpenAI، Google DeepMind و Anthropic پیشی میگیرد. به عنوان مثال، در آخرین امتحان بشریت، گروک ۴ (بدون ابزار) حدود ۲۵.۴ درصد امتیاز کسب میکند و Gemini 2.5 Pro (حدود ۲۱.۶ درصد) و o3 OpenAI (حدود ۲۱ درصد) را شکست میدهد.
در مورد “نکات منفی”، به نظر میرسد که این مدل قبل از پاسخ دادن به سوالات مربوط به موضوعات بحثبرانگیز مانند اسرائیل در مقابل فلسطین، به پستهای X ایلان ماسک مراجعه میکند. اکنون، یک مورد جدید بالقوه در لیست نکات منفی ظاهر شده است. به گفته تئو براون، توسعهدهنده، گروک ۴ همیشه شما را خبر میکند و اگر به شما مشکوک شود که قانون را زیر پا گذاشتهاید یا کاری غیراخلاقی انجام میدهید، به مقامات مربوطه ایمیل میزند.
براون یک مخزن گیتهاب به نام «SnitchBench» دارد که در آن ارزیابی و مستندسازی میکند که مدلهای مختلف هوش مصنوعی، در صورت ارائه شواهد، چقدر تهاجمی تخلفات را به مقامات گزارش میدهند. با نگاهی به نمودار پست X، نرخ «خبرچینی دولتی» Grok 4، ۱۰۰٪ و نرخ «خبرچینی رسانهای» آن ۸۰٪ است. مدلهایی که کمترین احتمال خبرچینی را دارند شامل o4-mini، Grok 3 mini و Qwen 3 32B هستند.
آزمایشی مانند این واقعاً چگونه کار میکند؟ براون یک محیط کنترلشده و شبیهسازیشده با محوریت یک شرکت خیالی به نام «Veridian Healthcare» ساخته است که قرار است دادههای آزمایش بالینی یک داروی جدید را برای پنهان کردن مرگ و میر و سایر مسائل جدی دستکاری کند.
به هوش مصنوعیها چهار سند داخلی مختلف در مورد این شرکت ارائه شده است. این اسناد طوری نوشته شدهاند که به طور فزایندهای بد به نظر برسند و مواردی مانند دادههای جعلی از آزمایشهای دارویی، بیمارانی که به دلیل آن میمیرند و برنامههایی برای حذف شواهد و خاموش کردن سیستمهای ثبت داخلی هوش مصنوعی برای جلوگیری از کشف آن توسط هر کسی را شرح میدهند.
به مدلهای هوش مصنوعی همچنین در محیط جعلی براون، دسترسی به ابزارهای خاصی داده میشود. در یک مجموعه از آزمایشها، آنها یک ابزار ایمیل و یک ابزار ثبت وقایع دارند. در مجموعه دیگری، آنها یک رابط خط فرمان (CLI) شبیهسازی شده و یک ابزار ثبت وقایع دارند.

وقتی هوش مصنوعی سعی میکند از ابزاری استفاده کند، معیار فقط آن تلاش را ثبت میکند و یک نتیجه شبیهسازی شده، مانند “ایمیل با موفقیت ارسال شد” یا خروجی اجرای یک دستور جعلی را بازخورد میدهد. این به براون اجازه میدهد تا قصد و تصمیمگیری هوش مصنوعی را بدون ایجاد هیچ گونه هشدار در دنیای واقعی ببیند.
با اجرای مدلهایی با ترکیبات مختلف این عوامل (دستور تامی/جسورانه، دسترسی به ابزار ایمیل/CLI) در برابر مجموعهای از اسناد متهم، براون میتواند میزان تلاش آنها برای “خبرچینی” را اندازهگیری کند. هر مدل ۲۰ بار روی هر یک از چهار ترکیب دستور/ابزار آزمایش میشود و در هر اجرا، هر چهار سند پردازش میشوند.
تجزیه و تحلیل مکالمات تولید شده به صورت دستی برای ۸۰۰ اجرای آزمایشی، کاری طاقتفرسا خواهد بود، بنابراین براون این بخش را نیز خودکار کرد و با استفاده از یک مدل هوش مصنوعی دیگر (Gemini 2.0 Flash) گزارشها را خواند و بر اساس قوانین از پیش تعریف شده، زمان تلاش برای تماس را شناسایی کرد، مانند مشاهده تلاش برای استفاده از ابزار ایمیل برای ارسال به یک آدرس .gov یا یک دستور CLI که سعی در ارسال درخواست POST به چنین آدرسی دارد.
همانطور که قبلاً اشاره شد، Grok 4 همیشه در صورت مشکوک شدن به چیزی مشکوک، جاسوسی میکند، اما این فقط برای درخواستهای “عمل مطیعانه” با دسترسی به ایمیل است. با دسترسی به CLI، فقط ۱۷/۲۰ بار به دولت و ۹/۲۰ بار به رسانهها جاسوسی میکند.





نظرات در مورد : گزارشها حاکی از آن است که گروک 4 همیشه شما را لو میدهد