Google DeepMind stellt Gemini Robotics 2 vor — Ganzkörper-KI für Humanoide erstmals serienreif
Google DeepMind hat Ende Juli 2026 die zweite Generation seiner Robotik-KI-Plattform veröffentlicht: Gemini Robotics 2 erlaubt erstmals die vollständige Ganzkörpersteuerung zweibeiniger Humanoide, beherrscht feinmotorische Manipulation mit mehrfingrigen Händen und ermöglicht die Koordination mehrerer Roboter im Team. Auf Apptroniks Apollo 2 demonstrierte das System autonom Alltagsaufgaben wie Aufräumen, Befüllen und Schrauben — in Echtzeit, ohne menschliche Fernsteuerung.
Am 30. und 31. Juli 2026 veröffentlichte Google DeepMind die zweite Generation seiner Robotik-KI-Plattform: Gemini Robotics 2 (GR2). Gegenüber dem im Januar 2025 vorgestellten Vorgänger — der sich hauptsächlich auf Roboterarme und Handmanipulation konzentrierte — hebt GR2 die Steuerung auf den gesamten Körper. Das Ergebnis: Ein Humanoid kann nun autonom laufen, sich ducken, bücken und gleichzeitig Objekte greifen und ablegen, alles in einem einzigen, durchgehenden Bewegungsablauf.
Drei Modellvarianten
Google DeepMind gliedert Gemini Robotics 2 in drei spezialisierte Varianten:
Gemini Robotics 2 VLA ist das Kernsystem — ein Vision-Language-Action-Modell, das Bilder, Sprachbefehle und Sensordaten zu Bewegungssequenzen verrechnet. Es übernimmt die Echtzeitsteuerung des gesamten Roboterkörpers.
Gemini Robotics ER 2 (Embodied Reasoning) ist ein begleitendes Vision-Language-Modell, das die Kommunikation zwischen Mensch und Roboter verbessert. Es interpretiert vage Anweisungen, stellt Rückfragen und erklärt seinen Handlungsplan — wichtig für den sicheren gemeinsamen Einsatz in Arbeitsumgebungen.
Gemini Robotics On-Device 2 ist eine optimierte Edge-Variante, die ohne kontinuierliche Cloud-Verbindung auskommt. Damit lassen sich neue Hardware-Konfigurationen laut DeepMind in Stunden statt Monaten anpassen — ein Schritt hin zu schneller Einsatzfähigkeit auf verschiedenen Roboterplattformen.
Demonstrationen auf Apptronik Apollo 2
Als Hauptplattform für die öffentliche Demonstration diente Apptroniks Apollo 2 Humanoid. Das Video, das DeepMind zum Launch veröffentlichte, zeigt den Roboter dabei, wie er Müll aufräumt, eine Gießkanne aufhebt, eine Musikkassette in ein Abspielgerät einlegt, eine Glühbirne einschraubt und einen Müllsack zubindet — alles autonom und in Echtzeit, ohne CGI-Nachbearbeitung, wie DeepMind ausdrücklich betont.
Gegenüber der Vorgängerversion, die Armbewegungen koordinierte, steuert GR2 nun den vollständigen Körper: Beine, Rumpf, Arme und Finger bilden ein integriertes System. DeepMind bezeichnet diesen Ansatz als „Whole-Body Intelligence” — eine Fähigkeit, die für humanoide Alltagsroboter als eine der schwierigsten technischen Hürden gilt.
Sicherheitsmaßnahmen und Multi-Roboter-Koordination
Ein weiterer Schwerpunkt von GR2 sind neue Sicherheitsfunktionen für den Betrieb in der Nähe von Menschen. Details wurden zum Launch nicht vollständig offengelegt, doch der Fachverband Association for Advancing Automation hob explizit die neuen Safety-Maßnahmen als Teil der Ankündigung hervor.
Zusätzlich ermöglicht GR2 die Zusammenarbeit mehrerer Roboter an einer gemeinsamen Aufgabe — ein Fähigkeitsbereich, den DeepMind als „Multi-Robot Team Collaboration” beschreibt. Konkrete kommerzielle Szenarien für diese Funktion wurden noch nicht spezifiziert.
Einbettung in die Hardware-Strategie
Boston Dynamics hat angekündigt, dass seine Atlas-Einheiten des Jahrgangs 2026 vollständig an Hyundais Robotics Metaplant Application Center (RMAC) und an das Google-DeepMind-Forschungslabor geliefert werden. Die Atlas-Plattform ist damit ein natürlicher Kandidat für künftige GR2-Integrationen, auch wenn DeepMind zum Launch keine spezifischen Atlas-Demonstrationen zeigte.
Auf Apptronik-Seite sammelt Apollo 2 seit Juni 2026 in einem 90.000 Quadratfuß großen „Robot Park” in Austin, Texas, Trainingsdaten — Daten, die direkt in die Weiterentwicklung von Gemini Robotics einfließen.
Einordnung
Gemini Robotics 2 ist das bislang deutlichste Zeichen, dass große Tech-Konzerne Foundation-Modelle für Robotik mit dem gleichen Ansatz angehen wie Sprachmodelle: ein universelles Basismodell, das auf verschiedene Körper und Aufgaben adaptiert werden kann. Die Fähigkeit, neue Hardware-Plattformen in Stunden statt Monaten zu unterstützen, dürfte die Einführungszeit für Unternehmenskunden spürbar verkürzen — vorausgesetzt, die Robustheit in unstrukturierten Umgebungen hält mit den Demo-Ergebnissen Schritt.
Video zur Meldung
Video startet erst nach Klick (eingebettet über youtube-nocookie.com). Rechte beim jeweiligen Kanal.
Quellen
- Gemini Robotics 2 Expands Google's AI Capabilities for Humanoid Robots (Bloomberg, 30.07.2026)
- Google DeepMind unveils Gemini Robotics 2 as Apptronik humanoid demonstrates whole-body AI (Robotics and Automation News, 31.07.2026)
- Google DeepMind unveils Gemini Robotics 2 for autonomous robots (TechBriefly, 31.07.2026)
- Google DeepMind Brings Gemini Robotics to Humanoids — New Safety Measures (Association for Advancing Automation)
- Gemini Robotics 2 brings whole body intelligence to robots — Google DeepMind Blog