شرکت متا از مدل هوش مصنوعی جدید خود رونمایی کرد و این بار، بزرگترین خبر مربوط به قدرت پردازشی آن نیست، بلکه درباره آزادی عمل کاربران است. مدل Muse Glimmer که دارای حدود ۳۰ میلیارد پارامتر است، با لایسنس متنباز Apache 2.0 عرضه شده؛ بدان معنا که وزنهای آن در پلتفرم هاگینگ فیس (Hugging Face) به طور کامل برای دانلود، تغییر و توسعه آزاد است و نیازی به دریافت هیچگونه مجوز ندارد. شما میتوانید این مدل را به سادگی روی کارت گرافیک (GPU) سیستم محلی خود اجرا کنید، بدون اینکه به مزرعه سرور (Server Farm) یا اتصال اینترنتی نیاز داشته باشید.
به گزارش بخش اخبار فناوری زوم تک به نقل از دیجیتال ترندز، آزمایشگاه فوقهوش متا (Meta Superintelligence Lab) مدل بزرگتر خود یعنی Muse Spark را آموزش داد تا نسخهای کوچکتر و سبکتر از خود تربیت کند که به همان سبک فکر میکند. مدل Muse Glimmer ورودیهای متنی و تصویری را میپذیرد، اگرچه پاسخهای آن فقط به صورت متن است. این مدل هوش مصنوعی از بیش از ۱۰۰ زبان پشتیبانی میکند، مکالماتی فراتر از ۱۳۱,۰۰۰ توکن را به خاطر میسپارد و اطلاعات آن تا تاریخ ۴ ژانویه ۲۰۲۶ بهروزرسانی شده است.
به چه مقدار حافظه رم و VRAM برای اجرای مدل Muse Glimmer نیاز دارید؟
در حالت دقت کامل (Full Precision)، مدل Muse Glimmer حدود ۶۴ گیگابایت حافظه ویدئویی (VRAM) مصرف میکند؛ مقداری بسیار بیشتر از آن چیزی که در اختیار اکثر کاربران است، بهویژه در این دوران که قیمت رم به دلیل جهش هوش مصنوعی افزایش یافته است. متا این چالش را با کوانتایزیشن (Quantization) برطرف کرده است؛ روشی که اعداد مورد استفاده مدل را فشرده میکند تا فضای بسیار کمتری اشغال شود. این تکنیک بخش زبانی مدل را به زیر ۲۰ گیگابایت میرساند.

دو نسخه از این مدل در دسترس است: نسخه K-Quant-Dynamic به ۳۲ گیگابایت VRAM نیاز دارد و تقریباً هیچ افتی در دقت ندارد (تنها ۰.۲ درصد)، در حالی که نسخه K-Quant-17GB با افت دقت بسیار اندک ۱ درصدی در ۲۴ گیگابایت حافظه گرافیکی جای میگیرد. به زبان ساده، این یعنی برای اجرای آن به حداقل یک کارت گرافیک NVIDIA RTX 5090، RTX 4090، RTX 3090 یا یک سیستم مک مجهز به تراشههای Apple Silicon Max نیاز دارید.
سرعت اجرای مدل جدید متا چگونه است؟ آیا واقعاً سریع عمل میکند؟
متا این مدل را با یک شتابدهنده به نام DFlash همراه کرده است که به جای پیشبینی توکنها به صورت تکتک، چندین توکن را همزمان پیشبینی میکند. روی کارت گرافیک RTX 5090، این قابلیت سرعت تولید متن را از ۷۴.۹ توکن در ثانیه به ۲۳۳.۴ توکن در ثانیه میرساند که بیش از ۳ برابر سریعتر است.
در مقایسه با مدلهای Gemma 4 گوگل و Qwen 3.6 علیبابا، مدل Muse Glimmer در برنامهریزی و انجام وظایف چندمرحلهای پیشتاز است، اما در زمینه کنترل و اجرای عملیات روی سیستمعامل دسکتاپ کمی عقبتر قرار میگیرد. اگر سختافزار سازگار را در اختیار دارید، میتوانید همین حالا این مدل هوش مصنوعی را از طریق Hugging Face یا LM Studio دریافت و اجرا کنید.





نظرات در مورد : رونمایی متا از مدل هوش مصنوعی آفلاین Muse Glimmer؛ اجرای ۳۰ میلیارد پارامتر بدون نیاز به اینترنت روی کارت گرافیک