توبیت
آنتی ویروس پادویش

رونمایی متا از مدل هوش مصنوعی آفلاین Muse Glimmer؛ اجرای ۳۰ میلیارد پارامتر بدون نیاز به اینترنت روی کارت گرافیک

رونمایی متا از مدل هوش مصنوعی آفلاین Muse Glimmer؛ اجرای ۳۰ میلیارد پارامتر بدون نیاز به اینترنت روی کارت گرافیک

شرکت متا از مدل هوش مصنوعی جدید خود رونمایی کرد و این بار، بزرگ‌ترین خبر مربوط به قدرت پردازشی آن نیست، بلکه درباره آزادی عمل کاربران است. مدل Muse Glimmer که دارای حدود ۳۰ میلیارد پارامتر است، با لایسنس متن‌باز Apache 2.0 عرضه شده؛ بدان معنا که وزن‌های آن در پلتفرم هاگینگ فیس (Hugging Face) به طور کامل برای دانلود، تغییر و توسعه آزاد است و نیازی به دریافت هیچ‌گونه مجوز ندارد. شما می‌توانید این مدل را به سادگی روی کارت گرافیک (GPU) سیستم محلی خود اجرا کنید، بدون اینکه به مزرعه سرور (Server Farm) یا اتصال اینترنتی نیاز داشته باشید.

کانال بله زوم تکگیفت کارت

به گزارش بخش اخبار فناوری زوم تک به نقل از دیجیتال ترندز، آزمایشگاه فوق‌هوش متا (Meta Superintelligence Lab) مدل بزرگ‌تر خود یعنی Muse Spark را آموزش داد تا نسخه‌ای کوچک‌تر و سبک‌تر از خود تربیت کند که به همان سبک فکر می‌کند. مدل Muse Glimmer ورودی‌های متنی و تصویری را می‌پذیرد، اگرچه پاسخ‌های آن فقط به صورت متن است. این مدل هوش مصنوعی از بیش از ۱۰۰ زبان پشتیبانی می‌کند، مکالماتی فراتر از ۱۳۱,۰۰۰ توکن را به خاطر می‌سپارد و اطلاعات آن تا تاریخ ۴ ژانویه ۲۰۲۶ به‌روزرسانی شده است.

به چه مقدار حافظه رم و VRAM برای اجرای مدل Muse Glimmer نیاز دارید؟

در حالت دقت کامل (Full Precision)، مدل Muse Glimmer حدود ۶۴ گیگابایت حافظه ویدئویی (VRAM) مصرف می‌کند؛ مقداری بسیار بیشتر از آن چیزی که در اختیار اکثر کاربران است، به‌ویژه در این دوران که قیمت رم به دلیل جهش هوش مصنوعی افزایش یافته است. متا این چالش را با کوانتایزیشن (Quantization) برطرف کرده است؛ روشی که اعداد مورد استفاده مدل را فشرده می‌کند تا فضای بسیار کمتری اشغال شود. این تکنیک بخش زبانی مدل را به زیر ۲۰ گیگابایت می‌رساند.

رونمایی متا از مدل هوش مصنوعی آفلاین Muse Glimmer؛ اجرای ۳۰ میلیارد پارامتر بدون نیاز به اینترنت روی کارت گرافیک

دو نسخه از این مدل در دسترس است: نسخه K-Quant-Dynamic به ۳۲ گیگابایت VRAM نیاز دارد و تقریباً هیچ افتی در دقت ندارد (تنها ۰.۲ درصد)، در حالی که نسخه K-Quant-17GB با افت دقت بسیار اندک ۱ درصدی در ۲۴ گیگابایت حافظه گرافیکی جای می‌گیرد. به زبان ساده، این یعنی برای اجرای آن به حداقل یک کارت گرافیک NVIDIA RTX 5090، RTX 4090، RTX 3090 یا یک سیستم مک مجهز به تراشه‌های Apple Silicon Max نیاز دارید.

سرعت اجرای مدل جدید متا چگونه است؟ آیا واقعاً سریع عمل می‌کند؟

متا این مدل را با یک شتاب‌دهنده به نام DFlash همراه کرده است که به جای پیش‌بینی توکن‌ها به صورت تک‌تک، چندین توکن را هم‌زمان پیش‌بینی می‌کند. روی کارت گرافیک RTX 5090، این قابلیت سرعت تولید متن را از ۷۴.۹ توکن در ثانیه به ۲۳۳.۴ توکن در ثانیه می‌رساند که بیش از ۳ برابر سریع‌تر است.

در مقایسه با مدل‌های Gemma 4 گوگل و Qwen 3.6 علی‌بابا، مدل Muse Glimmer در برنامه‌ریزی و انجام وظایف چندمرحله‌ای پیشتاز است، اما در زمینه کنترل و اجرای عملیات روی سیستم‌عامل دسکتاپ کمی عقب‌تر قرار می‌گیرد. اگر سخت‌افزار سازگار را در اختیار دارید، می‌توانید همین حالا این مدل هوش مصنوعی را از طریق Hugging Face یا LM Studio دریافت و اجرا کنید.

به این پست امتیاز بدید

نظرات در مورد : رونمایی متا از مدل هوش مصنوعی آفلاین Muse Glimmer؛ اجرای ۳۰ میلیارد پارامتر بدون نیاز به اینترنت روی کارت گرافیک

0 دیدگاه

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *