آنتی ویروس پادویش

پروژه Genie گوگل معرفی شد: خلق جهان‌ های تعاملی تنها با یک عکس یا متن ساده

پروژه Genie گوگل معرفی شد: خلق جهان‌های تعاملی تنها با یک عکس یا متن ساده

گوگل با معرفی Project Genie، گام بزرگ دیگری در دنیای هوش مصنوعی برداشته است. این ابزار به کاربران اجازه می‌ دهد تا تنها با استفاده از یک توصیف متنی یا یک تصویر، محیط‌ های مجازی و تعاملی بسازند. با این حال، دسترسی به این قابلیت هیجان‌ انگیز فعلاً محدود به مشترکانی است که هزینه‌ سنگین اشتراک AI Ultra را پرداخت می‌کنند.

کانال بله زوم تکگیفت کارت

به گزارش بخش اخبار فناوری زوم تک به نقل از Ars Technica، سال گذشته گوگل از Genie 3 رونمایی کرد؛ نسخه به‌ روزرسانی شده از مدل جهانی هوش مصنوعی که با حافظه بلندمدت خیره‌کننده‌اش، توانایی ساخت جهان‌ های تعاملی از یک دستور ساده را داشت. در آن زمان، این ابزار تنها در اختیار گروه کوچکی از آزمایش‌کنندگان معتمد بود، اما اکنون تحت عنوان Project Genie به‌صورت گسترده‌تر عرضه شده است.

مدل جهانی چیست و پروژه جینی چگونه کار می‌کند؟

مدل‌های جهانی (World Models) دقیقاً همان چیزی هستند که از نامشان پیداست: هوش مصنوعی که یک محیط پویا را در لحظه تولید می‌کند. البته این محیط‌ها از نظر فنی جهان‌های سه‌بعدی (3D) نیستند. مدل‌هایی مانند Genie 3 در واقع ویدیوهایی تولید می‌کنند که به ورودی‌های کنترلی شما پاسخ می‌دهند و به شما اجازه می‌دهند در این شبیه‌سازی به‌گونه‌ای کاوش کنید که گویی یک دنیای مجازی واقعی است.

نقطه قوت Genie 3 نسبت به مدل‌های قبلی، توانایی آن در به خاطر سپردن جزئیات جهانی است که خلق می‌کند. اگرچه در این حوزه، “زمان طولانی” به معنای چند دقیقه است، اما همین مقدار هم برای ایجاد یک تجربه تعاملی پایدار، یک پیشرفت بزرگ محسوب می‌شود.

ساختار فنی؛ از Nano Banana Pro تا Gemini 3

Project Genie در واقع نسخه بهینه‌سازی شده و تجاری Genie 3 است که به مدل‌های جدیدی همچون Nano Banana Pro و Gemini 3 متصل شده است. گوگل تعدادی جهان پیش‌فرض در این پلتفرم قرار داده، اما جذابیت اصلی آن در قابلیت خلق جهان‌های جدید نهفته است. شما می‌توانید یک تصویر مرجع ارائه دهید یا صرفاً به هوش مصنوعی بگویید چه محیط و شخصیتی مد نظرتان است.

بیشتر بخوانید  شفاف سازی تصاویر با کیفیت پایین ۸ در ۸ پیکسل با الگوریتم جدید گوگل

فرآیند کار به این صورت است که سیستم ابتدا یک تصویر ثابت ایجاد می‌کند که گوگل آن را World Sketching یا «طراحی اولیه جهان» می‌نامد. اگر از تصویر ساخته شده توسط Nano Banana Pro راضی نباشید، می‌توانید پیش از تبدیل آن به یک دنیای تعاملی توسط جینی، تغییرات لازم را اعمال کنید.

تجربه کاربری و محدودیت‌ های گرافیکی

خروجی نهایی این سیستم، ویدیویی با رزولوشن 720p و نرخ ۲۴ فریم بر ثانیه است. همانطور که شخصیت خود را با کلیدهای WASD حرکت می‌دهید، Project Genie مسیر پیش رو را تقریباً به‌صورت آنی رندر می‌کند.

  • مدت زمان تجربه: هر بار اجرای دستور، ۶۰ ثانیه دنیای تعاملی در اختیار شما قرار می‌دهد.
  • قابلیت ریمیکس: امکان تغییر شخصیت‌ها و استایل بصری در جهان‌های از پیش ساخته شده وجود دارد.
  • امکان دانلود: ویدیوهای ضبط شده از کاوش شما در این جهان‌ها قابل دانلود است.

محدودیت‌ ها؛ یک پروتوتایپ تحقیقاتی گران‌ قیمت

گوگل تأکید دارد که Project Genie هنوز یک نمونه اولیه تحقیقاتی است. مشابه مدل‌های Google Veo یا OpenAI Sora، تولید ویدیو توسط هوش مصنوعی زمان‌بر است، بنابراین وجود مقداری تاخیر (Input Lag) در کنترل شخصیت‌ها طبیعی است. همچنین ویژگی اضافه کردن عناصر جدید به شبیه‌سازی در حال اجرا، هنوز در دسترس نیست.

نکته جالب توجه، بحث کپی‌رایت است. گزارش‌های اولیه نشان می‌دهد که در ابتدا کاربران می‌توانستند محیط‌هایی شبیه به بازی‌های نینتندو مانند Super Mario یا Zelda بسازند، اما گوگل به سرعت دسترسی به این کلمات کلیدی را به دلیل حفظ منافع اشخاص ثالث مسدود کرد.

هزینه اشتراک و نحوه دسترسی

در حال حاضر Project Genie تنها از طریق یک وب‌اپلیکیشن اختصاصی در دسترس است و در اپلیکیشن اصلی Gemini ادغام نشده است. دسترسی به این ابزار نیازمند اشتراک AI Ultra با هزینه ماهانه ۲۵۰ دلار است. هزینه بالای پردازش ویدیوهای هوش مصنوعی دلیل اصلی این قیمت‌گذاری سنگین عنوان شده است، هرچند گوگل قصد دارد در آینده دسترسی به آن را برای کاربران بیشتری فراهم کند.

به این پست امتیاز بدید

نظرات در مورد : پروژه Genie گوگل معرفی شد: خلق جهان‌ های تعاملی تنها با یک عکس یا متن ساده

0 دیدگاه

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *