mrnobody
۲۶ اردیبهشت ۱۴۰۳

۴ کاری که کاربران گوگل جمینی (Gemini) به زودی می توانند انجام دهند

رئیس گوگل، ساندار پیچای، فاش کرد که مدل هوش مصنوعی جمینی این شرکت در حال استفاده از محصولات و خدمات این شرکت، از جمله محصول شاخص جستجوی اون هست.
مدل هوش مصنوعی گوگل جمینی (Gemini AI) در بسیاری از فناوری های این غول فناوری قرار گرفته. این هوش مصنوعی به زودی در جی میل، یوتیوب و گوشی‌های هوشمند این شرکت ظاهر خواهد شد.
در یک سخنرانی اصلی در کنفرانس توسعه دهندگان I/O 2024 این شرکت در ۱۴ می، ساندار پیچای، مدیرعامل گوگل، بعضی از مکان‌هایی رو که مدل هوش مصنوعی اون ظاهر می‌شه، فاش کرد.
پیچای در سخنرانی ۱۱۰ دقیقه‌ای خود ۱۲۱ بار از هوش مصنوعی یاد کرد که این موضوع در کانون توجه قرار گرفت و جمینی که در دسامبر ۲۰۲۳ راه‌اندازی شد، مورد توجه قرار گرفت.

گوگل در حال استفاده از مدل زبان بزرگ (LLM) در پیشنهادات خود از جمله اندروید، جستجو و جیمیل هست. در اینجا آنچه کاربران گوگل جمینی (Gemini) می‌تونن در آینده انتظار داشته باشند آمده:

تعاملات برنامه برای کاربران گوگل جمینی (Gemini)

Gemini زمینه بیشتری پیدا می‌کنه که می‌تونه با برنامه ها تعامل داشته باشه. در به‌روزرسانی‌های آتی، کاربران گوگل جمینی (Gemini) می‌تونن برای تعامل با برنامه‌ها، مثل کشیدن و رها کردن تصویر تولید شده توسط چت بات هوش مصنوعی در پیام، با Gemini تماس بگیرن.
کاربران یوتیوب همچنین می‌تونن روی «از این ویدیو بپرسید» ضربه بزنن تا اطلاعات خاصی از هوش مصنوعی داخل ویدیو دریافت کنن.

جمینی در جیمیل

پلتفرم ایمیل گوگل، جی میل، هم در حال ادغام هوش مصنوعی هست. کاربران می‌تونن با استفاده از Gemini ایمیل های خودشون رو جستجو، خلاصه و پیش نویس کنن.
دستیار هوش مصنوعی می‌تونه برای کارهای پیچیده‌تر، مثل کمک به پردازش بازپرداخت تجارت الکترونیک با جستجو در صندوق ورودی، یافتن رسید و پر کردن فرم‌های آنلاین، روی ایمیل‌ها اقدام که.

جمینی زنده

جمینی زنده

گوگل همچنین از تجربه جدیدی به نام Gemini Live رونمایی کرد که در اون کاربران می‌تونن چت‌های صوتی عمیقی با هوش مصنوعی در گوشی‌های هوشمند خود داشته باشن.
ربات چت می‌تونه در اواسط پاسخ برای شفاف سازی قطع بشه و در زمان واقعی با الگوهای گفتار کاربران سازگار می‌شه. علاوه بر این، Gemini همچنین می‌تونه محیط فیزیکی اطراف رو از طریق عکس‌ها یا فیلم‌های گرفته شده در دستگاه ببینه و به اون پاسخ بده.

پیشرفت های چندوجهی

گوگل در حال کار بر روی توسعه عوامل هوش مصنوعی هوشمند هست که می‌تونن از طرف کاربر، وظایف پیچیده چند مرحله ای رو تحت نظارت، استدلال، برنامه ریزی و تکمیل کنن. چندوجهی به این معنی هست که هوش مصنوعی می‌تونه فراتر از متن باشه و ورودی‌های تصویر، صدا و تصویر رو مدیریت کنه.
نمونه‌ها و موارد استفاده اولیه شامل خودکار کردن بازگشت خرید و کاوش در یک شهر جدید هست.
از دیگر به‌روزرسانی‌های در دست تولید مدل هوش مصنوعی این شرکت، می‌تونیم به جایگزینی دستیار Google در اندروید با Gemini اشاره کنیم که به طور کامل در سیستم عامل تلفن همراه اون یکپارچه خواهد شد.
ویژگی جدید “Ask Photos” امکان جستجو در کتابخانه عکس رو با استفاده از جستارهای زبان طبیعی ارائه شده توسط Gemini فراهم می‌کنه. می‌تونه زمینه رو درک کنه، اشیا و افراد رو تشخیص بده و خاطرات عکس رو در پاسخ به سؤالات خلاصه کنه.
نقشه‌های گوگل خلاصه‌ای از مکان‌ها و مناطق ایجاد شده توسط هوش مصنوعی رو با استفاده از بینش داده‌های نقشه‌برداری پلتفرم نشون می‌ده.

منبع:
things Google Gemini users will be able to do soon

نظرات شما

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *