گوگل روز پنجشنبه نسخه «بازطراحی شده» ایجنت تحقیقاتی خود به نام Gemini Deep Research (تحقیقات عمیق جمنای) را که مبتنی بر مدل پایه بسیار پرهیاهو و پیشرفته این شرکت یعنی Gemini 3 Pro است، منتشر کرد.
به گزارش بخش اخبار فناوری زوم تک به نقل از TechCrunch، این ایجنت جدید تنها برای تولید گزارش های تحقیقاتی طراحی نشده است . این ایجنت اکنون به توسعه دهندگان اجازه می دهد تا قابلیت های تحقیقاتی مدل پیشرفته (SOTA) گوگل را در برنامه های خود جایگذاری کنند. این قابلیت از طریق Interactions API جدید گوگل امکان پذیر شده است که برای دادن کنترل بیشتر به توسعه دهندگان در عصر پیش رو، یعنی عصر هوش مصنوعی عاملگرا (Agentic AI) طراحی شده است.
قابلیت های ایجنت جدید گوگل: فراتر از جستجوی ساده
ابزار جدید Gemini Deep Research یک ایجنت مجهز برای ترکیب کوه عظیمی از اطلاعات و مدیریت حجم انبوهی از دادهها (Context Dump) در پرامپت است. گوگل میگوید که مشتریان از این ابزار برای وظایفی از جمله راستیآزمایی دقیق (Due Diligence) تا تحقیقات ایمنی سمیت دارویی استفاده میکنند.
گوگل همچنین اعلام کرده است که به زودی این ایجنت تحقیقات عمیق جدید را در سرویسهای خود، از جمله جستجوی گوگل (Google Search)، گوگل فایننس (Google Finance)، اپلیکیشن جمنای و ابزار محبوب NotebookLM ادغام خواهد کرد. این گام دیگری به سوی آمادهسازی برای دنیایی است که در آن انسانها دیگر چیزی را گوگل نمیکنند، بلکه ایجنتهای هوش مصنوعی آنها این کار را انجام میدهند.
این غول فناوری میگوید که Deep Research از وضعیت مدل Gemini 3 Pro به عنوان «واقعگرایانهترین» مدل خود بهره میبرد که برای به حداقل رساندن توهمات هوش مصنوعی (Hallucinations) در طول وظایف پیچیده آموزش دیده است.
چالش توهمات و بنچمارک های جدید
توهمات هوش مصنوعی (جایی که مدل زبانی بزرگ صرفاً مطالب ساختگی تحویل میدهد) یک مسئله به ویژه حیاتی برای وظایف عاملگرای طولانیمدت و نیازمند استدلال عمیق است؛ جایی که تصمیمات خودکار متعددی در طول دقایق، ساعتها یا بیشتر گرفته میشود. هرچه یک مدل زبانی بزرگ (LLM) مجبور به انتخابهای بیشتری باشد، شانس اینکه حتی یک انتخاب مبتنی بر توهم کل خروجی را بیاعتبار کند، بیشتر میشود.
برای اثبات ادعاهای پیشرفت خود، گوگل یک بنچمارک دیگر نیز ایجاد کرده است (انگار که دنیای هوش مصنوعی به یکی دیگر نیاز داشت). این بنچمارک جدید که نام نهچندان خلاقانه DeepSearchQA را یدک میکشد، برای آزمایش ایجنتها در وظایف پیچیده و چندمرحلهای جستجوی اطلاعات در نظر گرفته شده است. گوگل این بنچمارک را به صورت متنباز (Open Source) ارائه کرده است.
گوگل همچنین Deep Research را بر روی «آخرین امتحان بشریت» (Humanity’s Last Exam)، یک بنچمارک مستقل با نامی بسیار جذابتر که پر از وظایف فوقالعاده تخصصی دانش عمومی است، و همچنین BrowserComp، یک بنچمارک برای وظایف عاملگرا مبتنی بر مرورگر، آزمایش کرد.
همانطور که انتظار میرفت، ایجنت جدید گوگل در بنچمارک خود و همچنین بنچمارک «آخرین امتحان بشریت» از رقبا پیشی گرفت. با این حال، مدل ChatGPT 5 Pro شرکت OpenAI با فاصلهای شگفتانگیز نزدیک بود و در بنچمارک BrowserComp کمی بهتر از گوگل عمل کرد.
رقابت همزمان: ورود GPT-5.2 با اسم رمز Garlic
اما آن مقایسههای بنچمارک تقریباً در همان لحظهای که گوگل آنها را منتشر کرد، منسوخ شدند. زیرا در همان روز، OpenAI مدل بسیار مورد انتظار GPT-5.2 خود را (که با نام رمز Garlic شناخته میشود) عرضه کرد. OpenAI میگوید جدیدترین مدلش در مجموعهای از بنچمارکهای معمول، از جمله بنچمارک اختصاصی خود OpenAI، از رقبایش (به ویژه گوگل) پیشی میگیرد.
شاید یکی از جالبترین بخشهای این اطلاعیه، زمانبندی آن بود. گوگل با دانستن اینکه جهان منتظر انتشار «گارلیک» است، اخبار هوش مصنوعی خود را منتشر کرد.




نظرات در مورد : گوگل عمیق ترین ایجنت تحقیقاتی هوش مصنوعی خود را معرفی کرد؛ درست در روزی که OpenAI مدل GPT-5.2 را منتشر کرد