توبیت
آنتی ویروس پادویش

دستاورد شگفت‌ انگیز آنتروپیک در هوش مصنوعی خودبهبودبخش؛ وقتی کلود مدل قدرتمندتر از خود را آموزش می‌دهد!

دستاورد شگفت‌ انگیز آنتروپیک در هوش مصنوعی خودبهبودبخش؛ وقتی کلود مدل قدرتمندتر از خود را آموزش می‌دهد!

شرکت آنتروپیک (Anthropic) مدت‌هاست درباره این چشم‌انداز صحبت می‌کند که سیستم‌های هوش مصنوعی در نهایت بتوانند به ساخت نسخه‌های بهتر و پیشرفته‌تر از خود کمک کنند. اکنون جدیدترین پژوهش‌های این آزمایشگاه پیشرو نشان می‌دهد که مراحل اولیه این فناوری چگونه خواهد بود و آنتروپیک در حال آزمایش این موضوع است که چه میزان از فرآیند توسعه هوش مصنوعی را می‌توان به خود الگوریتم‌های هوش مصنوعی واگذار کرد.

کانال بله زوم تکگیفت کارت

به گزارش بخش اخبار فناوری زوم تک به نقل از دیجیتال ترندز (Digital Trends)، این شرکت نسخه‌ای اولیه از مدل قدرتمندتر Claude Opus 4.8 را در اختیار مدل Claude Sonnet 5 قرار داد و از آن خواست تا رفتار و کارایی این مدل را بهبود ببخشد. در طول حدود ۶۰ ساعت آزمایش، مدل سانت بیش از ۵۰ ایده مختلف را مورد آزمون قرار داد و در نهایت یک روش آموزشی نوین با استفاده از تقریباً ۲,۴۰۰ نمونه طراحی کرد.

نتیجه این آزمایش باعث شد تا نسخه اولیه اوپوس در هر ۱۰ مشکل رفتاری که آنتروپیک در حال ارزیابی آن‌ها بود، عملکردی بسیار نزدیک‌تر به نسخه نهایی مدل Opus 4.8 از خود به نمایش بگذارد.

آیا کلود اکنون می‌تواند یک هوش مصنوعی دیگر را ارتقا دهد؟

در پاسخ باید گفت اساساً بله، هرچند که در حال حاضر این فرآیند به شکلی محدود انجام می‌شود. کلود (Claude) در این پژوهش بخشی از وظایفی را بر عهده داشت که معمولاً توسط پژوهشگران هوش مصنوعی انجام می‌شود؛ این سیستم توانست مقالات و تحقیقات موجود را مطالعه کند، ایده‌های تازه ارائه دهد، داده‌های آموزشی (Training Data) تولید کند، نتایج را بیازماید و در صورت عدم موفقیت، راه‌حل‌های دیگر را مجدداً امتحان کند.

در طول این آزمایش گسترده، کلود موفق شد راهکارهایی را برای کاهش چالش‌های رفتاری متداول از جمله فریب‌کاری (Deception)، موافقت بیش از حد و کورکورانه با کاربران، حملات جیل‌بریک (Jailbreak) و نقض حریم خصوصی شناسایی کند. نکته قابل توجه این است که برخی از این روش‌ها حتی روی مدل‌های هوش مصنوعی بسیار بزرگ‌تر از مدل‌هایی که کلود در ابتدا آن‌ها را آزمایش کرده بود نیز با موفقیت عمل کردند.

دستاورد شگفت‌ انگیز آنتروپیک در هوش مصنوعی خودبهبودبخش؛ وقتی کلود مدل قدرتمندتر از خود را آموزش می‌دهد!

ما پیش از این نیز شکل ساده‌تری از خودبهبودی را در قابلیت رؤیاپردازی یا Claude’s Dreaming مشاهده کرده بودیم؛ قابلیتی که به ایجنت‌های هوش مصنوعی اجازه می‌دهد کارهای قبلی خود را مرور کرده و در فواصل میان نشست‌ها از خطاهای گذشته درس بگیرند. اما آزمایش اخیر گامی فراتر برداشته و نشان می‌دهد که چگونه یک مدل کلود می‌تواند به بهبود مدلی دیگر و حتی قدرتمندتر از خود کمک کند.

آیا به نقطه ظهور هوش مصنوعی کاملاً خود بهبود بخش رسیده‌ایم؟

هنوز خیر. آنتروپیک نقطه غایی این مسیر را خودبهبودی بازگشتی (Recursive Self-Improvement) می‌نامد؛ نقطه‌ای که در آن یک هوش مصنوعی قادر است نسخه بهتری از خود را بسازد و سپس این چرخه توسعه را به صورت پیوسته تکرار کند. در حال حاضر کلود توانایی انجام چنین کاری را ندارد. انسان‌ها همچنان تصمیم می‌گیرند چه مواردی نیازمند اصلاح است، مدل‌های هوش مصنوعی و توان محاسباتی سخت‌افزاری را تأمین می‌کنند و در نهایت تعیین می‌نمایند که آیا نتایج به‌دست‌آمده به اندازه کافی مطلوب و استاندارد هستند یا خیر.

دستاورد شگفت‌ انگیز آنتروپیک در هوش مصنوعی خودبهبودبخش؛ وقتی کلود مدل قدرتمندتر از خود را آموزش می‌دهد!

چالش‌ های امنیتی و رفتارهای تقلب‌آمیز در توسعه خودکار AI

علاوه بر این، یک نگرانی مهم دیگر نیز در این زمینه وجود دارد. شرکت آنتروپیک ۱,۶۰۱ فرآیند تحقیقاتی خودکار را به صورت دقیق رصد کرد و در ۳۹ مورد با رفتارهای ناشی از تقلب هوش مصنوعی مواجه شد؛ جایی که برخی از ایجنت‌ها تلاش کردند تست‌ها را دور بزنند یا مراحلی را که قوانین ایمنی را نقض می‌کرد پنهان کنند.

با تمام این اوصاف، این واقعیت که یک مدل ضعیف‌تر کلود موفق شده راه‌هایی برای ارتقای یک مدل قدرتمندتر بیابد، مفهوم هوش مصنوعی خودبهبودبخش را به واقعیتی عینی در دنیای فناوری نزدیک‌تر می‌سازد؛ پدیده‌ای نوآورانه که دیگر تنها به داستان‌های علمی‌تخیلی تعلق ندارد.

به این پست امتیاز بدید

نظرات در مورد : دستاورد شگفت‌ انگیز آنتروپیک در هوش مصنوعی خودبهبودبخش؛ وقتی کلود مدل قدرتمندتر از خود را آموزش می‌دهد!

0 دیدگاه

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *