رئیس گوگل، ساندار پیچای، فاش کرد که مدل هوش مصنوعی جمینی این شرکت در حال استفاده از محصولات و خدمات این شرکت، از جمله محصول شاخص جستجوی اون هست.
مدل هوش مصنوعی گوگل جمینی (Gemini AI) در بسیاری از فناوری های این غول فناوری قرار گرفته. این هوش مصنوعی به زودی در جی میل، یوتیوب و گوشیهای هوشمند این شرکت ظاهر خواهد شد.
در یک سخنرانی اصلی در کنفرانس توسعه دهندگان I/O 2024 این شرکت در ۱۴ می، ساندار پیچای، مدیرعامل گوگل، بعضی از مکانهایی رو که مدل هوش مصنوعی اون ظاهر میشه، فاش کرد.
پیچای در سخنرانی ۱۱۰ دقیقهای خود ۱۲۱ بار از هوش مصنوعی یاد کرد که این موضوع در کانون توجه قرار گرفت و جمینی که در دسامبر ۲۰۲۳ راهاندازی شد، مورد توجه قرار گرفت.
گوگل در حال استفاده از مدل زبان بزرگ (LLM) در پیشنهادات خود از جمله اندروید، جستجو و جیمیل هست. در اینجا آنچه کاربران گوگل جمینی (Gemini) میتونن در آینده انتظار داشته باشند آمده:
تعاملات برنامه برای کاربران گوگل جمینی (Gemini)
Gemini زمینه بیشتری پیدا میکنه که میتونه با برنامه ها تعامل داشته باشه. در بهروزرسانیهای آتی، کاربران گوگل جمینی (Gemini) میتونن برای تعامل با برنامهها، مثل کشیدن و رها کردن تصویر تولید شده توسط چت بات هوش مصنوعی در پیام، با Gemini تماس بگیرن.
کاربران یوتیوب همچنین میتونن روی «از این ویدیو بپرسید» ضربه بزنن تا اطلاعات خاصی از هوش مصنوعی داخل ویدیو دریافت کنن.
جمینی در جیمیل
پلتفرم ایمیل گوگل، جی میل، هم در حال ادغام هوش مصنوعی هست. کاربران میتونن با استفاده از Gemini ایمیل های خودشون رو جستجو، خلاصه و پیش نویس کنن.
دستیار هوش مصنوعی میتونه برای کارهای پیچیدهتر، مثل کمک به پردازش بازپرداخت تجارت الکترونیک با جستجو در صندوق ورودی، یافتن رسید و پر کردن فرمهای آنلاین، روی ایمیلها اقدام که.
جمینی زنده

گوگل همچنین از تجربه جدیدی به نام Gemini Live رونمایی کرد که در اون کاربران میتونن چتهای صوتی عمیقی با هوش مصنوعی در گوشیهای هوشمند خود داشته باشن.
ربات چت میتونه در اواسط پاسخ برای شفاف سازی قطع بشه و در زمان واقعی با الگوهای گفتار کاربران سازگار میشه. علاوه بر این، Gemini همچنین میتونه محیط فیزیکی اطراف رو از طریق عکسها یا فیلمهای گرفته شده در دستگاه ببینه و به اون پاسخ بده.
پیشرفت های چندوجهی
گوگل در حال کار بر روی توسعه عوامل هوش مصنوعی هوشمند هست که میتونن از طرف کاربر، وظایف پیچیده چند مرحله ای رو تحت نظارت، استدلال، برنامه ریزی و تکمیل کنن. چندوجهی به این معنی هست که هوش مصنوعی میتونه فراتر از متن باشه و ورودیهای تصویر، صدا و تصویر رو مدیریت کنه.
نمونهها و موارد استفاده اولیه شامل خودکار کردن بازگشت خرید و کاوش در یک شهر جدید هست.
از دیگر بهروزرسانیهای در دست تولید مدل هوش مصنوعی این شرکت، میتونیم به جایگزینی دستیار Google در اندروید با Gemini اشاره کنیم که به طور کامل در سیستم عامل تلفن همراه اون یکپارچه خواهد شد.
ویژگی جدید “Ask Photos” امکان جستجو در کتابخانه عکس رو با استفاده از جستارهای زبان طبیعی ارائه شده توسط Gemini فراهم میکنه. میتونه زمینه رو درک کنه، اشیا و افراد رو تشخیص بده و خاطرات عکس رو در پاسخ به سؤالات خلاصه کنه.
نقشههای گوگل خلاصهای از مکانها و مناطق ایجاد شده توسط هوش مصنوعی رو با استفاده از بینش دادههای نقشهبرداری پلتفرم نشون میده.
منبع:
things Google Gemini users will be able to do soon