توبیت
آنتی ویروس پادویش

هشدار جدی متخصصان ایمنی هوش مصنوعی؛ تکنیک استدلال جدید OpenAI در مدل آسترا جنجال‌آفرین شد

هشدار جدی متخصصان ایمنی هوش مصنوعی؛ تکنیک استدلال جدید OpenAI در مدل آسترا جنجال‌آفرین شد

به گزارش بخش اخبار فناوری زوم تک به نقل از تک‌کرانچ (TechCrunch)، اگرچه گفته می‌شود دامنه استفاده مدل آسترا از این راهکار در حال حاضر محدود است، اما پیاده‌سازی و ظهور آن هشدارها و انتقادات گسترده‌ای را از سوی جامعه پژوهشگران ایمنی فناوری هوش مصنوعی به دنبال داشته است. باک شلجریس (Buck Shlegeris)، مدیرعامل مجموعه تحقیقاتی ردوود (Redwood Research)، در واکنش به درز این اطلاعات نوشت: «من عمیقاً از گزارش‌های مربوط به استفاده مدل Astra از تکنیک تکرار مبهم نگران هستم. هنوز مشخص نیست که آیا پایش زنجیره تفکر آسترا نسبت به نسخه‌های قبلی تا چه اندازه سخت‌تر شده است؛ با این وجود، اگر شرکت OpenAI توسعه این رویکرد را بیش از پیش ادامه دهد، این امکان را خواهد داشت که دفعات بازگشت را به میزان چشمگیری افزایش داده و قابلیت نظارت بر زنجیره تفکر هوش مصنوعی را به کلی از بین ببرد.»

کانال بله زوم تکگیفت کارت

بر اساس گزارشی که نشریه تخصصی د اینفورمیشن (The Information) منتشر کرده است، مدل جدید اوپن‌ای‌آی (OpenAI) موسوم به آسترا (Astra) از یک روش استدلالی نوین تحت عنوان عمق بازگشتی (Recurrent Depth) استفاده خواهد کرد که به سیستم امکان می‌دهد خارج از چارچوب تفکر متوالی و گام‌به‌گام معمول در اکثر مدل‌های پیشرفته عمل کند. این شیوه نوین که با نام «تکرار کدر» یا تکرار مبهم (Opaque Recurrence) نیز شناخته می‌شود، پایش و نظارت بر زنجیره تفکر (Chain of Thought – CoT) مدل را فوق‌العاده چالش‌برانگیز خواهد کرد؛ مسئله‌ای که موجب بروز نگرانی‌های عمیق در میان کارشناسان برجسته حوزه ایمنی هوش مصنوعی (AI Safety) شده است.

هشدار فعالان حوزه هوش مصنوعی در مورد خطر رقابت مخرب لابراتوارهای فناوری

زوی ماشوویتز (Zvi Mowshowitz)، از چهره‌های شناخته‌شده و مروجان باسابقه ایمنی هوش مصنوعی، با ورود به این بحث خاطرنشان کرد که شاید وضع مقررات و قوانین الزام‌آور برای متوقف کردن «مسابقه مخرب تا قهقرا» (Race to the bottom) میان آزمایشگاه‌های پیشرو الزامی باشد. ماشوویتز در بیانیه خود تأکید کرد: «به‌کارگیری این روش مانند بازی با آتش است و مرز و تابلوی قرمزی را به خطر می‌اندازد که شرکت‌های OpenAI و آنتروپیک (Anthropic) برای تثبیت آن تلاش کرده بودند؛ مبنی بر اینکه ما با تمام توان می‌کوشیم تا وفاداری به فرآیند حل مسئله و قابلیت نظارت بر زنجیره تفکر را تا هر زمان که مقدور باشد تضمین نماییم. پیاده‌سازی فشرده‌تر و فراگیرتر چنین تکنیک‌هایی، بدون تردید به شفافیت نظارتی لطمه خواهد زد.»

نحوه عملکرد زنجیره تفکر در مقایسه با استدلال بازگشتی و کدر

در روندهای متداول پردازشی، زنجیره تفکر مدل‌های زبانی گام‌های پیاپی و استدلال‌های مرحله‌به‌مرحله‌ای را ثبت می‌کند که سیستم هنگام حل یک مسئله پشت سر می‌گذارد. اگرچه این روند نمایانگر کامل تمامی لایه‌های ذهنی ماشین نیست، اما همچنان ابزاری فوق‌العاده کاربردی برای رصد انحراف، رفتارهای ناهنجار یا ناهماهنگی اهداف مدل به شمار می‌رود. برای نمونه، در پرونده اخیر مرتبط با رفتارهای ناهماهنگ و سرکش برخی از عامل‌های هوشمند (AI Agents) در OpenAI، آرشیو زنجیره تفکر ابزاری تعیین‌کننده برای کشف علل چرایی این تصمیمات بود.

در نقطه مقابل، در سازوکار تکرار مبهم یا استدلال کدر، مدل هوش مصنوعی رویکردی غیرخطی را برمی‌گزیند و ورودی یا دستور دریافتی را چندین نوبت در قالب یک چرخه حلقوی بازپردازش می‌کند. ماحصل این رویکرد، کاهش محسوس ردپاهای قابل‌فهم برای انسان است که در عمل ثبت سوابق سنتی زنجیره تفکر شفاف را بی‌اثر می‌سازد.

پاسخ رسمی دانشمند ارشد OpenAI به ادعای حرکت به سمت زبان‌ های عصبی غیرقابل فهم

نکته مهم این است که بر اساس شواهد موجود، سهم این روش در مدل آسترا محدود گزارش شده است. همچنان انتظار می‌رود زنجیره تفکر مدل خوانا بماند و مدیران اوپن‌ای‌آی هرگونه ادعا مبنی بر گذار سیستم به سوی اصطلاحاً «زبان عصبی» (Neuralese) یا الگوهای نامفهوم داخلی شبکه‌های عصبی را قاطعانه رد کرده‌اند. OpenAI پیش از این نیز از طرح‌های گسترده خود برای استقرار سامانه‌های پیشرفته نظارت بر خط سیر استدلال به عنوان بخشی از استراتژی‌های آینده‌نگرانه حفاظتی خبر داده بود.

یاکوب پاچوکی (Jakub Pachocki)، دانشمند ارشد شرکت OpenAI، با انتشار متنی در شبکه اجتماعی ایکس (توییتر سابق)، تعهد این مرکز به حفظ شفافیت فرآیندهای فکری ماشین را یادآور شد و نوشت: «اوپن‌ای‌آی از بدو راه‌اندازی نخستین مدل‌های مجهز به قابلیت استدلال، همواره در جهت حفظ و ارتقای نظارت بر زنجیره تفکر کوشیده است. این اصل، هدف غایی و هسته مرکزی پروژه‌های تحقیقاتی فعلی ما به شمار می‌رود.»

پیامدهای توسعه استدلال در فضای نهان (Latent Space) و ابراز نگرانی دیپ‌مایند و آنتروپیک

حقیقت این است که همه ساختارهای هوش مصنوعی کمابیش واجد درصدی از استدلال مبهم هستند و کمتر کارشناسی گزارش‌های زنجیره تفکر را آیینه تمام‌نمای نحوه ادراک ماشین می‌داند. با این همه، این پیش‌زمینه‌ها مانع از بین رفتن هراس پیرامون خطرات ناشی از دشوارتر شدن ردیابی و نظارت بر فرآیندهای فکری نخواهد شد؛ به خصوص با توجه به اینکه بهره‌گیری از آن در مدل‌های متنوع رو به فزونی است. در گزارش تکمیلی دیگری، پایگاه The Information فاش کرد که کارشناسان شرکت‌های بزرگ آنتروپیک (Anthropic) و گوگل دیپ‌مایند (Google DeepMind) نیز بررسی این روش و اثرات آن را آغاز کرده‌اند.

رایان گرین‌بلات (Ryan Greenblatt)، دانشمند ارشد Redwood Research، در تحلیلی بر این خبر تصریح کرد که سازوکار استدلال کدر به آسانی می‌تواند بسیار پرسرعت‌تر از زنجیره تفکر سنتی مقیاس‌پذیر شود و در نهایت، تمام جریان تصمیم‌گیری را از کانال‌های قابل مشاهده بیرون ببرد.

گرین‌بلات در این رابطه تأکید داشت: «بزرگ‌ترین دغدغه من این است که امتداد طبیعی این مسیر به توسعه ابعاد استدلال کدر منتهی شود؛ تا جایی که مدل فرآیند تفکر را به طور کامل یا تقریباً کامل در بستر فضای نهان (Latent Space) پیاده‌سازی کند. امیدوارم برای اجتناب از استقرار نگران‌کننده‌ترین معماری‌های پردازشی هنوز زمان باقی مانده باشد و شرکت OpenAI روند پیشبرد این روش را در همین مقطع متوقف نماید.»

 

به این پست امتیاز بدید

نظرات در مورد : هشدار جدی متخصصان ایمنی هوش مصنوعی؛ تکنیک استدلال جدید OpenAI در مدل آسترا جنجال‌آفرین شد

0 دیدگاه

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *