هوشِکس

گوگل اپلیکیشن Gemini را با ویدئوی هوش‌مصنوعی بلادرنگ، Deep Research و قابلیت‌های جدید به‌روز کرد

گوگل اپلیکیشن Gemini را با ویدئوی هوش‌مصنوعی بلادرنگ، Deep Research و قابلیت‌های جدید به‌روز کرد

گوگل در جریان رویداد Google I/O 2025 چندین به‌روزرسانی برای اپلیکیشن چت‌بات هوش‌مصنوعی خود، Gemini، معرفی کرد که شامل در دسترس قرار گرفتن گسترده‌تر ویژگی‌های چندوجهی، مدل‌های به‌روز شده و یکپارچگی‌های عمیق‌تر با محصولات گوگل است.

از روز سه‌شنبه، قابلیت‌های اشتراک‌گذاری دوربین و صفحه‌نمایش Gemini Live برای تمامی کاربران iOS و اندروید فعال می‌شود. این ویژگی که با قدرت پروژه Astra ارائه شده، به کاربران اجازه می‌دهد مکالمات تقریبا بلادرنگ صوتی را با Gemini داشته باشند و هم‌زمان ویدئوی دوربین یا صفحه‌نمایش گوشی خود را به مدل هوش‌مصنوعی ارسال کنند.

برای مثال، هنگام گشت‌وگذار در شهری جدید، کاربر می‌تواند دوربین گوشی را به سمت یک ساختمان بگیرد و از Gemini Live درباره معماری یا تاریخچه آن پرسش کند و پاسخ‌ها را تقریباً بدون تأخیر دریافت نماید.

گوگل می‌گوید در هفته‌های آینده، Gemini Live را بیش از پیش با دیگر اپ‌های خود یکپارچه خواهد کرد؛ از جمله امکان ارائه مسیر توسط Google Maps، ایجاد رویداد در Google Calendar و ساخت فهرست کارها در Google Tasks.

این مجموعه به‌روزرسانی‌ها بخشی از تلاش‌های گوگل برای رقابت با ChatGPT از OpenAI، سیری اپل و سایر ارائه‌دهندگان دستیار دیجیتالی است. ظهور چت‌بات‌های هوش‌مصنوعی روش جدیدی برای تعامل کاربران با اینترنت و دستگاه‌ها فراهم کرده که فشار زیادی بر کسب‌وکارهای بزرگ فناوری از جمله جستجوی گوگل و Google Assistant وارد آورده است. گوگل در I/O 2025 اعلام کرد که Gemini اکنون ۴۰۰ میلیون کاربر فعال ماهانه دارد و با این به‌روزرسانی‌ها قصد دارد این تعداد را افزایش دهد.

گوگل دو طرح اشتراک جدید معرفی کرد: Google AI Pro (بازنام‌گذاری طرح Gemini Advanced به قیمت ۲۰ دلار در ماه) و Google AI Ultra (طرح ۲۵۰ دلار در ماه که رقیب ChatGPT Pro به شمار می‌رود). طرح Ultra به کاربران محدودیت نرخ بسیار بالا، دسترسی زودهنگام به مدل‌های جدید هوش‌مصنوعی و دسترسی اختصاصی به برخی قابلیت‌ها را می‌دهد.

مشترکان Pro و Ultra در ایالات متحده که زبان Chrome خود را انگلیسی انتخاب کرده‌اند، دسترسی به Gemini را مستقیماً در مرورگر Chrome خواهند داشت. این یکپارچگی به کاربران امکان می‌دهد تا مستقیماً از روی صفحه‌نمایش خود از Gemini بخواهند اطلاعات را خلاصه کند یا به سؤالات مرتبط پاسخ دهد.

گوگل همچنین می‌گوید Deep Research، عامل هوش‌مصنوعی Gemini که گزارش‌های تحقیقاتی جامع تولید می‌کند، به‌روزرسانی شده تا کاربران بتوانند فایل‌های PDF و تصاویر خصوصی خود را آپلود کنند. Deep Research این اسناد خصوصی را با داده‌های عمومی مقایسه و گزارش‌های شخصی‌سازی‌شده‌تری ارائه خواهد داد. به‌زودی انتظار می‌رود امکان یکپارچه‌سازی مستقیم با Drive و Gmail نیز فراهم شود.

برای کاربران رایگان Gemini، مدل تصویرسازی هوش‌مصنوعی Imagen 4 با خروجی متنی بهتر عرضه خواهد شد. همچنین مشترکان طرح ۲۵۰ دلاری AI Ultra به جدیدترین مدل ویدئوی هوش‌مصنوعی گوگل، Veo 3، دسترسی خواهند داشت که صداهای متناظر با صحنه‌های ویدیویی را به‌صورت بومی تولید می‌کند.

مدل پیش‌فرض Gemini نیز به نسخه Gemini 2.5 Flash ارتقا می‌یابد تا پاسخ‌هایی با کیفیت بالاتر و تأخیر کمتر ارائه کند.

به‌منظور پاسخگویی به تعداد روزافزون دانش‌آموزانی که از چت‌بات‌های هوش‌مصنوعی استفاده می‌کنند، گوگل می‌گوید Gemini اکنون کوییزهای شخصی‌سازی‌شده‌ای تولید خواهد کرد که بر حوزه‌هایی متمرکز هستند که کاربران در آن مشکلات بیشتری دارند. در صورت پاسخ اشتباه کاربران، Gemini کوییزها و برنامه‌های عملی اضافی برای تقویت آن حوزه‌ها ارائه می‌دهد.

گوگل اپلیکیشن Gemini را با ویدئوی هوش‌مصنوعی بلادرنگ، Deep Research و قابلیت‌های جدید به‌روز کرد - هوشِکس