Режим AI Google теперь может видеть и искать с изображениями
Google улучшает свой чат-бот AI Mode с новыми мультимодальными возможностями, позволяющими ему "видеть" и отвечать на вопросы об изображениях. Это обновление, которое интегрирует специальную версию Gemini AI с технологией распознавания изображений Google Lens, позволяет пользователям делать или загружать фотографии и получать подробные, информативные ответы с соответствующими ссылками. Развертывание этой функции началось сегодня и доступно через приложение Google на устройствах Android и iOS.
Робби Стейн, вице-президент по продуктам Google Search, объясняет: "AI Mode основывается на нашей многолетней работе в области визуального поиска, но делает шаг вперед. Благодаря мультимодальным возможностям Gemini AI Mode теперь может понимать всю сцену на изображении, включая взаимодействие объектов, их конкретные материалы, цвета, формы и расположение."
Обновление использует "технику веерного распределения", которая отправляет несколько запросов об изображении и его элементах, что приводит к ответам, которые являются одновременно тонкими и контекстно релевантными. Это позволяет AI Mode идентифицировать предметы, такие как книги на изображении, предлагать похожие названия с хорошими отзывами и даже отвечать на дополнительные вопросы для уточнения рекомендаций.

Теперь AI Mode от Google может "видеть" то, что видите вы, чтобы лучше помогать с запросами. GIF: GoogleРазработанный как конкурент Perplexity и ChatGPT Search, AI Mode предлагает опыт, подобный чат-боту, генерируя AI-управляемые сводки из обширного поискового индекса Google. Изначально эксклюзивный для подписчиков Google One AI Premium через Labs в прошлом месяце, AI Mode теперь расширяется до "миллионов других" пользователей Labs в США, выходя за рамки только платных подписчиков AI Premium.
Связанная статья
Google тестирует платформу для игр на основе искусственного интеллекта
Барьеры для создания игр быстро падают, поскольку искусственный интеллект открывает разработку тем, у кого нет опыта в программировании, дизайне или графике. Недавно Google Labs продемонстрировала это с помощью нового эксперимента.В среду эксперимент
Как искусственный интеллект и робототехника меняют нефтедобычу компании bp
Технология «цифрового двойника» позволяет компании bp моделировать эксплуатацию энергетических объектов, выявлять возможности для оптимизации и прогнозировать сбои до их возникновения. Источник: bpРик
Оценка Toyota в $6,4 млрд на робототехнику выводит физический ИИ в фокус
Toyota Motor прогнозирует, что развертывание автоматизации на своих производственных мощностях, в дочерних компаниях и среди ключевых поставщиков может потребовать примерно 400 000 роботов и ежегодных расходов около 1 трлн иен (6,4 млрд долларов США)
Рекомендации по связанным специальным темам
Комментарии (17)
Finalmente! Agora dá pra tirar foto de alguma coisa e o Google me explica o que é? 🤯 Mas, sério... será que vai funcionar direito na minha região? Acho que vou testar com meu gato primeiro, pra ver se ele reconhece a raça kkk. Se funcionar, vai acabar com minhas brigas de família sobre nomes de plantas no jardim.
Этот новый функционал с картинками выглядит круто, но я уже представляю, как это повлияет на приватность. 🤔 Интересно, сколько данных Google теперь сможет собирать через изображения? Технология развивается так быстро, что иногда становится немного страшно.
AI 가 이미지를 '보고' 검색을 한다니, 정말 신기하네요 🔍 구글이 제미니 + 렌즈 기술을 결합한 건데... 나중에 써보면서 어떤 제품 구매할 때 도움이 되면 좋겠어요! 근데 이렇게 사진 업로드를 하면서 개인정보도 같이 수집되는 건 아닐지 조금 걱정스럽기도 하네.
This is wild! Google's AI can now 'see' images? I tried it with a pic of my dog, and it described his goofy grin perfectly. Kinda creepy but super cool! 🐶
Google улучшает свой чат-бот AI Mode с новыми мультимодальными возможностями, позволяющими ему "видеть" и отвечать на вопросы об изображениях. Это обновление, которое интегрирует специальную версию Gemini AI с технологией распознавания изображений Google Lens, позволяет пользователям делать или загружать фотографии и получать подробные, информативные ответы с соответствующими ссылками. Развертывание этой функции началось сегодня и доступно через приложение Google на устройствах Android и iOS.
Робби Стейн, вице-президент по продуктам Google Search, объясняет: "AI Mode основывается на нашей многолетней работе в области визуального поиска, но делает шаг вперед. Благодаря мультимодальным возможностям Gemini AI Mode теперь может понимать всю сцену на изображении, включая взаимодействие объектов, их конкретные материалы, цвета, формы и расположение."
Обновление использует "технику веерного распределения", которая отправляет несколько запросов об изображении и его элементах, что приводит к ответам, которые являются одновременно тонкими и контекстно релевантными. Это позволяет AI Mode идентифицировать предметы, такие как книги на изображении, предлагать похожие названия с хорошими отзывами и даже отвечать на дополнительные вопросы для уточнения рекомендаций.

Разработанный как конкурент Perplexity и ChatGPT Search, AI Mode предлагает опыт, подобный чат-боту, генерируя AI-управляемые сводки из обширного поискового индекса Google. Изначально эксклюзивный для подписчиков Google One AI Premium через Labs в прошлом месяце, AI Mode теперь расширяется до "миллионов других" пользователей Labs в США, выходя за рамки только платных подписчиков AI Premium.
Google тестирует платформу для игр на основе искусственного интеллекта
Барьеры для создания игр быстро падают, поскольку искусственный интеллект открывает разработку тем, у кого нет опыта в программировании, дизайне или графике. Недавно Google Labs продемонстрировала это с помощью нового эксперимента.В среду эксперимент
Как искусственный интеллект и робототехника меняют нефтедобычу компании bp
Технология «цифрового двойника» позволяет компании bp моделировать эксплуатацию энергетических объектов, выявлять возможности для оптимизации и прогнозировать сбои до их возникновения. Источник: bpРик
Оценка Toyota в $6,4 млрд на робототехнику выводит физический ИИ в фокус
Toyota Motor прогнозирует, что развертывание автоматизации на своих производственных мощностях, в дочерних компаниях и среди ключевых поставщиков может потребовать примерно 400 000 роботов и ежегодных расходов около 1 трлн иен (6,4 млрд долларов США)
Finalmente! Agora dá pra tirar foto de alguma coisa e o Google me explica o que é? 🤯 Mas, sério... será que vai funcionar direito na minha região? Acho que vou testar com meu gato primeiro, pra ver se ele reconhece a raça kkk. Se funcionar, vai acabar com minhas brigas de família sobre nomes de plantas no jardim.
Этот новый функционал с картинками выглядит круто, но я уже представляю, как это повлияет на приватность. 🤔 Интересно, сколько данных Google теперь сможет собирать через изображения? Технология развивается так быстро, что иногда становится немного страшно.
AI 가 이미지를 '보고' 검색을 한다니, 정말 신기하네요 🔍 구글이 제미니 + 렌즈 기술을 결합한 건데... 나중에 써보면서 어떤 제품 구매할 때 도움이 되면 좋겠어요! 근데 이렇게 사진 업로드를 하면서 개인정보도 같이 수집되는 건 아닐지 조금 걱정스럽기도 하네.
This is wild! Google's AI can now 'see' images? I tried it with a pic of my dog, and it described his goofy grin perfectly. Kinda creepy but super cool! 🐶





Дом






