Heim
Das neue KI-Modell von DeepMind läuft nativ auf Robotern, um die Leistung zu steigern
Google DeepMind veröffentlicht eine geräteinterne Version seines KI-Modells Gemini Robotics, die ohne Internetverbindung funktioniert. Dieses Vision-Language-Action-Modell (VLA) verfügt über dieselben Fähigkeiten wie das im März vorgestellte, ist aber laut Google jetzt kompakt und effizient genug, um direkt auf einem Roboter zu laufen.
Das Vorzeigemodell von Gemini Robotics ermöglicht es Robotern, verschiedene physische Aufgaben auszuführen, auch solche, für die sie nicht speziell trainiert wurden. Es unterstützt die Generalisierung neuer Szenarien, das Verstehen und Reagieren auf Anweisungen und die Durchführung von Aktivitäten, die eine feinmotorische Kontrolle erfordern.
Laut Carolina Parada, Leiterin der Robotikabteilung bei Google DeepMind, verwendet das ursprüngliche Gemini Robotics-Modell eine hybride Methode, die sowohl auf dem Gerät als auch in der Cloud funktioniert. Mit dem neuen Modell, das nur auf dem Gerät funktioniert, können die Nutzer jedoch auf Offline-Funktionen zugreifen, die fast die gleiche Leistung bieten wie die Flaggschiff-Version.

Der humanoide Bot Apollo von Apptronik gefolgt von Googles ALOHA-System. GIF: GoogleDas On-Device-Modell kann sofort mehrere Aufgaben bewältigen und sich an ungewohnte Situationen "mit nur 50 bis 100 Demonstrationen" anpassen, erklärt Parada. Obwohl Google das Modell zunächst nur auf seinem ALOHA-Roboter trainierte, passte das Unternehmen es erfolgreich an andere Roboterplattformen an, wie den humanoiden Apollo-Roboter von Apptronik und den zweiarmigen Franka FR3-Roboter.
"Das Hybridmodell von Gemini Robotics ist nach wie vor leistungsfähiger, aber wir sind wirklich beeindruckt von der Leistung dieser On-Device-Version", fügt Parada hinzu. "Es kann als Einstiegsmodell oder als ideale Lösung für Umgebungen mit unzuverlässigem Internet betrachtet werden." Es eignet sich auch für Unternehmen mit strengen Sicherheitsprotokollen.
Zusätzlich zu dem neuen Modell stellt Google ein Software Development Kit (SDK) zur Verfügung, mit dem Entwickler es testen und anpassen können - das erste Mal, dass ein solches Toolkit für eine der VLAs von Google DeepMind veröffentlicht wird.
Das On-Device-Modell von Gemini Robotics und das dazugehörige SDK werden zunächst einer ausgewählten Gruppe von vertrauenswürdigen Testern zur Verfügung gestellt, während Google weiterhin mögliche Sicherheitsbedenken prüft und minimiert.
Verwandter Artikel
Google testet den Remy AI Agent für Gemini, da der Fokus auf die Benutzerkontrolle verlagert wird
Laut Business Insider testet Google Remy, einen neuen KI-Personalagenten für Gemini. Dieses Tool soll Aufgaben im Auftrag von Nutzern ausführen und sowohl professionelle Arbeitsabläufe als auch tägliche Routinen optimieren.Derzeit wird Remy in einer
Ollie setzt auf Datenschutz, um das Rennen um den KI-Assistenten zu gewinnen
Um wirklich hilfreich zu sein, muss ein KI-Assistent seinen Nutzer genau verstehen. Ollie, ein für den Alltag konzipierter persönlicher Assistent, basiert auf der Prämisse, dass dies nicht mit der Wei
So wird die „AI LIVE: London“ KI und industrielle Automatisierung beleuchten
Auf dem Gipfel werden Führungskräfte der obersten Ebene aus aller Welt zusammenkommen, um dringende Herausforderungen in globalen Branchen zu erörtern – von KI-getriebenen Umbrüchen bis hin zu wirtsch
Empfehlungen zu verwandten Spezialthemen
Kommentare (1)
That's a huge step forward for robotics! On-device processing is finally catching up, but I'm kinda wondering how expensive the hardware will be - can small startups afford it? 🤔 Also, curious if offline functionality means it's less likely to be updated or influenced remotely, which might be a double-edged sword.
Google DeepMind veröffentlicht eine geräteinterne Version seines KI-Modells Gemini Robotics, die ohne Internetverbindung funktioniert. Dieses Vision-Language-Action-Modell (VLA) verfügt über dieselben Fähigkeiten wie das im März vorgestellte, ist aber laut Google jetzt kompakt und effizient genug, um direkt auf einem Roboter zu laufen.
Das Vorzeigemodell von Gemini Robotics ermöglicht es Robotern, verschiedene physische Aufgaben auszuführen, auch solche, für die sie nicht speziell trainiert wurden. Es unterstützt die Generalisierung neuer Szenarien, das Verstehen und Reagieren auf Anweisungen und die Durchführung von Aktivitäten, die eine feinmotorische Kontrolle erfordern.
Laut Carolina Parada, Leiterin der Robotikabteilung bei Google DeepMind, verwendet das ursprüngliche Gemini Robotics-Modell eine hybride Methode, die sowohl auf dem Gerät als auch in der Cloud funktioniert. Mit dem neuen Modell, das nur auf dem Gerät funktioniert, können die Nutzer jedoch auf Offline-Funktionen zugreifen, die fast die gleiche Leistung bieten wie die Flaggschiff-Version.

Das On-Device-Modell kann sofort mehrere Aufgaben bewältigen und sich an ungewohnte Situationen "mit nur 50 bis 100 Demonstrationen" anpassen, erklärt Parada. Obwohl Google das Modell zunächst nur auf seinem ALOHA-Roboter trainierte, passte das Unternehmen es erfolgreich an andere Roboterplattformen an, wie den humanoiden Apollo-Roboter von Apptronik und den zweiarmigen Franka FR3-Roboter.
"Das Hybridmodell von Gemini Robotics ist nach wie vor leistungsfähiger, aber wir sind wirklich beeindruckt von der Leistung dieser On-Device-Version", fügt Parada hinzu. "Es kann als Einstiegsmodell oder als ideale Lösung für Umgebungen mit unzuverlässigem Internet betrachtet werden." Es eignet sich auch für Unternehmen mit strengen Sicherheitsprotokollen.
Zusätzlich zu dem neuen Modell stellt Google ein Software Development Kit (SDK) zur Verfügung, mit dem Entwickler es testen und anpassen können - das erste Mal, dass ein solches Toolkit für eine der VLAs von Google DeepMind veröffentlicht wird.
Das On-Device-Modell von Gemini Robotics und das dazugehörige SDK werden zunächst einer ausgewählten Gruppe von vertrauenswürdigen Testern zur Verfügung gestellt, während Google weiterhin mögliche Sicherheitsbedenken prüft und minimiert.
Ollie setzt auf Datenschutz, um das Rennen um den KI-Assistenten zu gewinnen
Um wirklich hilfreich zu sein, muss ein KI-Assistent seinen Nutzer genau verstehen. Ollie, ein für den Alltag konzipierter persönlicher Assistent, basiert auf der Prämisse, dass dies nicht mit der Wei
So wird die „AI LIVE: London“ KI und industrielle Automatisierung beleuchten
Auf dem Gipfel werden Führungskräfte der obersten Ebene aus aller Welt zusammenkommen, um dringende Herausforderungen in globalen Branchen zu erörtern – von KI-getriebenen Umbrüchen bis hin zu wirtsch
That's a huge step forward for robotics! On-device processing is finally catching up, but I'm kinda wondering how expensive the hardware will be - can small startups afford it? 🤔 Also, curious if offline functionality means it's less likely to be updated or influenced remotely, which might be a double-edged sword.











