Google добавляет мультимодальные возможности в свой ориентированный на поиск чат-бот AI Mode, которые позволяют ему «видеть» и отвечать на вопросы по изображениям. При этом компания расширяет доступ к AI Mode для «миллионов» новых пользователей.
Обновление объединяет кастомную версию Gemini AI с фирменной технологией распознавания изображений Google Lens, что позволяет пользователям AI Mode делать фото или загружать изображения и получать «развернутые, содержательные ответы со ссылками» о том, что на них изображено. Обновленный ИИ-режим поиска уже доступен в приложении Google на Android и iOS.
Робби Стайн (Robby Stein), вице-президент Google по продукту поиска, заявил:
AI Mode опирается на наш многолетний опыт в области визуального поиска и поднимает его на новый уровень. Благодаря мультимодальным возможностям Gemini, AI Mode может понимать всю сцену на изображении, включая контекст взаимосвязей между объектами, а также их уникальные материалы, цвета, формы и расположение.
По словам Google, обновление использует технику «расширенного запроса» (fan-out technique), при которой система отправляет несколько запросов по изображению и отдельным объектам, чтобы предоставить «максимально точные и релевантные ответы». Это позволяет, например, распознавать книги на фото, рекомендовать похожие издания с высокими оценками и отвечать на уточняющие вопросы для подбора рекомендаций.
На GIF-анимации показана демонстрация новых возможностей мультимодального поиска изображений в нейросети AI Mode. Теперь AI Mode от Google может «видеть» то, что видите вы, и лучше помогать в поиске.
AI Mode в поиске — это ответ Google на Perplexity и ChatGPT Search: чатоподобный интерфейс, который отвечает на запросы, используя ИИ-обобщения, основанные на данных из индекса поиска Google.
Изначально AI Mode был доступен только подписчикам Google One AI Premium в рамках эксперимента Google Labs. Теперь Google предоставляет доступ к AI Mode «миллионам» новых пользователей Labs в США, а не только платным подписчикам.
Обновления программ, что нового
• Google выпустил Gemini 2.5 Deep Think — ИИ-модель «рассуждений», опередившую OpenAI o3 и Grok 4 в тестах
• Технология Intel XeSS 2 теперь работает на видеокартах AMD и NVIDIA
• OpenAI отключила индексируемые чаты ChatGPT — больше никаких утечек в поиск Google
• Статистика браузеров за июль 2025: Chrome достигает 70%, Edge теряет долю
• Ранний релиз Chrome 139 и обновление безопасности Chrome 138 с устранением уязвимости нулевого дня
• Яндекс Браузер теперь показывает отзывы и рейтинг интернет-магазинов прямо на сайте