گوگل با معرفی Project Genie، گام بزرگ دیگری در دنیای هوش مصنوعی برداشته است. این ابزار به کاربران اجازه می دهد تا تنها با استفاده از یک توصیف متنی یا یک تصویر، محیط های مجازی و تعاملی بسازند. با این حال، دسترسی به این قابلیت هیجان انگیز فعلاً محدود به مشترکانی است که هزینه سنگین اشتراک AI Ultra را پرداخت میکنند.
به گزارش بخش اخبار فناوری زوم تک به نقل از Ars Technica، سال گذشته گوگل از Genie 3 رونمایی کرد؛ نسخه به روزرسانی شده از مدل جهانی هوش مصنوعی که با حافظه بلندمدت خیرهکنندهاش، توانایی ساخت جهان های تعاملی از یک دستور ساده را داشت. در آن زمان، این ابزار تنها در اختیار گروه کوچکی از آزمایشکنندگان معتمد بود، اما اکنون تحت عنوان Project Genie بهصورت گستردهتر عرضه شده است.
مدل جهانی چیست و پروژه جینی چگونه کار میکند؟
مدلهای جهانی (World Models) دقیقاً همان چیزی هستند که از نامشان پیداست: هوش مصنوعی که یک محیط پویا را در لحظه تولید میکند. البته این محیطها از نظر فنی جهانهای سهبعدی (3D) نیستند. مدلهایی مانند Genie 3 در واقع ویدیوهایی تولید میکنند که به ورودیهای کنترلی شما پاسخ میدهند و به شما اجازه میدهند در این شبیهسازی بهگونهای کاوش کنید که گویی یک دنیای مجازی واقعی است.
نقطه قوت Genie 3 نسبت به مدلهای قبلی، توانایی آن در به خاطر سپردن جزئیات جهانی است که خلق میکند. اگرچه در این حوزه، “زمان طولانی” به معنای چند دقیقه است، اما همین مقدار هم برای ایجاد یک تجربه تعاملی پایدار، یک پیشرفت بزرگ محسوب میشود.
ساختار فنی؛ از Nano Banana Pro تا Gemini 3
Project Genie در واقع نسخه بهینهسازی شده و تجاری Genie 3 است که به مدلهای جدیدی همچون Nano Banana Pro و Gemini 3 متصل شده است. گوگل تعدادی جهان پیشفرض در این پلتفرم قرار داده، اما جذابیت اصلی آن در قابلیت خلق جهانهای جدید نهفته است. شما میتوانید یک تصویر مرجع ارائه دهید یا صرفاً به هوش مصنوعی بگویید چه محیط و شخصیتی مد نظرتان است.
فرآیند کار به این صورت است که سیستم ابتدا یک تصویر ثابت ایجاد میکند که گوگل آن را World Sketching یا «طراحی اولیه جهان» مینامد. اگر از تصویر ساخته شده توسط Nano Banana Pro راضی نباشید، میتوانید پیش از تبدیل آن به یک دنیای تعاملی توسط جینی، تغییرات لازم را اعمال کنید.
تجربه کاربری و محدودیت های گرافیکی
خروجی نهایی این سیستم، ویدیویی با رزولوشن 720p و نرخ ۲۴ فریم بر ثانیه است. همانطور که شخصیت خود را با کلیدهای WASD حرکت میدهید، Project Genie مسیر پیش رو را تقریباً بهصورت آنی رندر میکند.
- مدت زمان تجربه: هر بار اجرای دستور، ۶۰ ثانیه دنیای تعاملی در اختیار شما قرار میدهد.
- قابلیت ریمیکس: امکان تغییر شخصیتها و استایل بصری در جهانهای از پیش ساخته شده وجود دارد.
- امکان دانلود: ویدیوهای ضبط شده از کاوش شما در این جهانها قابل دانلود است.
محدودیت ها؛ یک پروتوتایپ تحقیقاتی گران قیمت
گوگل تأکید دارد که Project Genie هنوز یک نمونه اولیه تحقیقاتی است. مشابه مدلهای Google Veo یا OpenAI Sora، تولید ویدیو توسط هوش مصنوعی زمانبر است، بنابراین وجود مقداری تاخیر (Input Lag) در کنترل شخصیتها طبیعی است. همچنین ویژگی اضافه کردن عناصر جدید به شبیهسازی در حال اجرا، هنوز در دسترس نیست.
نکته جالب توجه، بحث کپیرایت است. گزارشهای اولیه نشان میدهد که در ابتدا کاربران میتوانستند محیطهایی شبیه به بازیهای نینتندو مانند Super Mario یا Zelda بسازند، اما گوگل به سرعت دسترسی به این کلمات کلیدی را به دلیل حفظ منافع اشخاص ثالث مسدود کرد.
هزینه اشتراک و نحوه دسترسی
در حال حاضر Project Genie تنها از طریق یک وباپلیکیشن اختصاصی در دسترس است و در اپلیکیشن اصلی Gemini ادغام نشده است. دسترسی به این ابزار نیازمند اشتراک AI Ultra با هزینه ماهانه ۲۵۰ دلار است. هزینه بالای پردازش ویدیوهای هوش مصنوعی دلیل اصلی این قیمتگذاری سنگین عنوان شده است، هرچند گوگل قصد دارد در آینده دسترسی به آن را برای کاربران بیشتری فراهم کند.




نظرات در مورد : پروژه Genie گوگل معرفی شد: خلق جهان های تعاملی تنها با یک عکس یا متن ساده