Der KI -Modus von Google kann jetzt Bilder sehen und mit Bildern suchen
Google verbessert seinen AI Mode Chatbot mit neuen multimodalen Fähigkeiten, die es ihm ermöglichen, Bilder zu „sehen“ und auf Fragen zu Bildern zu antworten. Dieses Update, das eine angepasste Version von Gemini AI mit Googles Lens-Bildrecognitions-Technologie integriert, erlaubt es Nutzern, Fotos aufzunehmen oder hochzuladen und detaillierte, informative Antworten inklusive relevanter Links zu erhalten. Die Einführung dieser Funktion begann heute und ist über die Google-App auf Android- und iOS-Geräten zugänglich.
Robby Stein, Vizepräsident für Produkte bei Google Search, erklärt: „AI Mode baut auf unserer langjährigen Arbeit im Bereich der visuellen Suche auf, geht aber einen Schritt weiter. Mit den multimodalen Fähigkeiten von Gemini kann AI Mode nun die gesamte Szene innerhalb eines Bildes verstehen, einschließlich der Interaktion von Objekten und ihrer spezifischen Materialien, Farben, Formen und Anordnungen.“
Das Update verwendet eine „Fan-Out-Technik“, die mehrere Anfragen zu dem Bild und seinen Elementen aussendet, was zu Antworten führt, die sowohl nuanciert als auch kontextuell relevant sind. Dies ermöglicht es AI Mode, Objekte wie Bücher in einem Bild zu identifizieren, ähnliche Titel mit guten Bewertungen vorzuschlagen und sogar Folgefragen zu beantworten, um Empfehlungen zu verfeinern.

Nun kann Googles AI Mode „sehen“, was Sie sehen, um besser bei Anfragen zu unterstützen. GIF: GoogleAls Konkurrent zu Perplexity und ChatGPT Search konzipiert, bietet AI Mode eine Chatbot-ähnliche Erfahrung und generiert KI-gestützte Zusammenfassungen aus Googles umfangreichem Suchindex. Ursprünglich war AI Mode letzten Monat exklusiv für Google One AI Premium-Abonnenten über Labs verfügbar, wird nun aber auf „Millionen weitere“ Labs-Nutzer in den USA ausgeweitet, über die zahlenden AI Premium-Abonnenten hinaus.
Verwandter Artikel
Google testet KI-gestützte Gaming-Plattform
Die Barrieren für die Spielentwicklung fallen schnell, da KI die Entwicklung auch für Personen ohne Kenntnisse in Programmierung, Design oder Kunst zugänglich macht. Google Labs hat dies kürzlich mit einem neuen Experiment demonstriert.Am Mittwoch st
Wie KI und Robotik die Ölförderung bei bp verändern
Mithilfe der Digital-Twin-Technologie kann bp den Betrieb von Energieanlagen simulieren, Verbesserungspotenziale identifizieren und Ausfälle vorhersagen, bevor diese auftreten. Bildquelle: bpRicky Bur
Toytas Schätzung von 6,4 Milliarden US-Dollar für Robotik rückt Physical AI in den Fokus
Toyota Motor geht davon aus, dass die flächendeckende Einführung der Automatisierung in ihren Fertigungsstätten, Tochtergesellschaften und wichtigsten Zulieferern ab 2028 etwa 400.000 Roboter und jährliche Ausgaben von rund einer Billion Yen (6,4 Mil
Empfehlungen zu verwandten Spezialthemen
Kommentare (17)
Finalmente! Agora dá pra tirar foto de alguma coisa e o Google me explica o que é? 🤯 Mas, sério... será que vai funcionar direito na minha região? Acho que vou testar com meu gato primeiro, pra ver se ele reconhece a raça kkk. Se funcionar, vai acabar com minhas brigas de família sobre nomes de plantas no jardim.
Этот новый функционал с картинками выглядит круто, но я уже представляю, как это повлияет на приватность. 🤔 Интересно, сколько данных Google теперь сможет собирать через изображения? Технология развивается так быстро, что иногда становится немного страшно.
AI 가 이미지를 '보고' 검색을 한다니, 정말 신기하네요 🔍 구글이 제미니 + 렌즈 기술을 결합한 건데... 나중에 써보면서 어떤 제품 구매할 때 도움이 되면 좋겠어요! 근데 이렇게 사진 업로드를 하면서 개인정보도 같이 수집되는 건 아닐지 조금 걱정스럽기도 하네.
This is wild! Google's AI can now 'see' images? I tried it with a pic of my dog, and it described his goofy grin perfectly. Kinda creepy but super cool! 🐶
Google verbessert seinen AI Mode Chatbot mit neuen multimodalen Fähigkeiten, die es ihm ermöglichen, Bilder zu „sehen“ und auf Fragen zu Bildern zu antworten. Dieses Update, das eine angepasste Version von Gemini AI mit Googles Lens-Bildrecognitions-Technologie integriert, erlaubt es Nutzern, Fotos aufzunehmen oder hochzuladen und detaillierte, informative Antworten inklusive relevanter Links zu erhalten. Die Einführung dieser Funktion begann heute und ist über die Google-App auf Android- und iOS-Geräten zugänglich.
Robby Stein, Vizepräsident für Produkte bei Google Search, erklärt: „AI Mode baut auf unserer langjährigen Arbeit im Bereich der visuellen Suche auf, geht aber einen Schritt weiter. Mit den multimodalen Fähigkeiten von Gemini kann AI Mode nun die gesamte Szene innerhalb eines Bildes verstehen, einschließlich der Interaktion von Objekten und ihrer spezifischen Materialien, Farben, Formen und Anordnungen.“
Das Update verwendet eine „Fan-Out-Technik“, die mehrere Anfragen zu dem Bild und seinen Elementen aussendet, was zu Antworten führt, die sowohl nuanciert als auch kontextuell relevant sind. Dies ermöglicht es AI Mode, Objekte wie Bücher in einem Bild zu identifizieren, ähnliche Titel mit guten Bewertungen vorzuschlagen und sogar Folgefragen zu beantworten, um Empfehlungen zu verfeinern.

Als Konkurrent zu Perplexity und ChatGPT Search konzipiert, bietet AI Mode eine Chatbot-ähnliche Erfahrung und generiert KI-gestützte Zusammenfassungen aus Googles umfangreichem Suchindex. Ursprünglich war AI Mode letzten Monat exklusiv für Google One AI Premium-Abonnenten über Labs verfügbar, wird nun aber auf „Millionen weitere“ Labs-Nutzer in den USA ausgeweitet, über die zahlenden AI Premium-Abonnenten hinaus.
Google testet KI-gestützte Gaming-Plattform
Die Barrieren für die Spielentwicklung fallen schnell, da KI die Entwicklung auch für Personen ohne Kenntnisse in Programmierung, Design oder Kunst zugänglich macht. Google Labs hat dies kürzlich mit einem neuen Experiment demonstriert.Am Mittwoch st
Wie KI und Robotik die Ölförderung bei bp verändern
Mithilfe der Digital-Twin-Technologie kann bp den Betrieb von Energieanlagen simulieren, Verbesserungspotenziale identifizieren und Ausfälle vorhersagen, bevor diese auftreten. Bildquelle: bpRicky Bur
Toytas Schätzung von 6,4 Milliarden US-Dollar für Robotik rückt Physical AI in den Fokus
Toyota Motor geht davon aus, dass die flächendeckende Einführung der Automatisierung in ihren Fertigungsstätten, Tochtergesellschaften und wichtigsten Zulieferern ab 2028 etwa 400.000 Roboter und jährliche Ausgaben von rund einer Billion Yen (6,4 Mil
Finalmente! Agora dá pra tirar foto de alguma coisa e o Google me explica o que é? 🤯 Mas, sério... será que vai funcionar direito na minha região? Acho que vou testar com meu gato primeiro, pra ver se ele reconhece a raça kkk. Se funcionar, vai acabar com minhas brigas de família sobre nomes de plantas no jardim.
Этот новый функционал с картинками выглядит круто, но я уже представляю, как это повлияет на приватность. 🤔 Интересно, сколько данных Google теперь сможет собирать через изображения? Технология развивается так быстро, что иногда становится немного страшно.
AI 가 이미지를 '보고' 검색을 한다니, 정말 신기하네요 🔍 구글이 제미니 + 렌즈 기술을 결합한 건데... 나중에 써보면서 어떤 제품 구매할 때 도움이 되면 좋겠어요! 근데 이렇게 사진 업로드를 하면서 개인정보도 같이 수집되는 건 아닐지 조금 걱정스럽기도 하네.
This is wild! Google's AI can now 'see' images? I tried it with a pic of my dog, and it described his goofy grin perfectly. Kinda creepy but super cool! 🐶





Heim






