Google bringt KI in die reale Welt: Gemini Robotics ER 2 macht Roboter intelligenter
Google DeepMind hat mit Gemini Robotics ER 2 eine neue Generation von künstlicher Intelligenz für Roboter vorgestellt. Anders als klassische Robotersoftware, die Bewegungen direkt steuert, übernimmt das neue Modell vor allem das Denken, Planen und Verstehen. Ziel ist es, Roboter deutlich flexibler zu machen, sodass sie nicht mehr nur einzelne Aufgaben ausführen, sondern komplexe Arbeitsabläufe eigenständig planen und sich an veränderte Situationen anpassen können.
Ein Gehirn für Roboter
Gemini Robotics ER 2 ist ein sogenanntes Embodied-Reasoning-Modell. Es analysiert kontinuierlich Kamerabilder, Sprache und weitere Sensordaten, versteht seine Umgebung und entwickelt daraus einen Aktionsplan. Die eigentlichen Bewegungen werden anschließend von separaten Robotikmodellen ausgeführt. Diese Trennung zwischen Denken und Bewegung soll die Technologie flexibler machen und den Einsatz auf unterschiedlichen Robotertypen ermöglichen.
Komplexe Aufgaben statt einfacher Befehle
Ein wesentlicher Fortschritt besteht darin, dass Roboter nun längere und anspruchsvollere Aufgaben selbstständig bewältigen können. Statt lediglich einzelne Befehle auszuführen, zerlegt Gemini Robotics ER 2 komplexe Arbeitsabläufe in viele kleine Schritte. Erkennt das System während der Ausführung ein Problem oder eine unerwartete Veränderung, kann es den Plan anpassen und die Aufgabe fortsetzen. Dadurch werden erstmals Arbeitsabläufe möglich, die zahlreiche Entscheidungen erfordern und mehrere Minuten dauern.
Mehr Geschicklichkeit im Alltag
Google demonstrierte die neue Technologie unter anderem an humanoiden Robotern, die alltägliche Tätigkeiten ausführen. Dazu gehören das Verknoten eines Müllbeutels, das Einschrauben einer Glühbirne, das Verschließen eines Beutels oder das gezielte Greifen einzelner Gegenstände aus einem Regal. Besonders bemerkenswert ist dabei die verbesserte Feinmotorik, die deutlich präzisere Bewegungen ermöglicht als bisherige Systeme.
Zusammenarbeit mehrerer Roboter
Eine weitere Neuerung ist die Fähigkeit, mehrere Roboter gleichzeitig zu koordinieren. Das KI-Modell kann Aufgaben auf verschiedene Maschinen verteilen und ihre Arbeit aufeinander abstimmen. Dadurch könnten künftig humanoide Roboter, Roboterarme und autonome Transportsysteme gemeinsam Produktions-, Lager- oder Logistikaufgaben übernehmen.
Sicherheit im Fokus
Da Roboter künftig enger mit Menschen zusammenarbeiten sollen, spielt auch das Thema Sicherheit eine zentrale Rolle. Das System erkennt Personen in seiner Umgebung, stoppt Bewegungen bei Kollisionsgefahr und kann unsichere Anweisungen ablehnen oder menschliche Unterstützung anfordern. Ergänzend entwickelt Google neue Verfahren, um das Verhalten autonomer Roboter umfassend auf Sicherheitsrisiken zu testen.
Ein Schritt Richtung universeller Roboter
Mit Gemini Robotics ER 2 verfolgt Google das langfristige Ziel, allgemein einsetzbare Roboter zu entwickeln. Ähnlich wie große Sprachmodelle heute unterschiedlichste Textaufgaben lösen können, sollen zukünftige Robotermodelle verschiedenste physische Aufgaben übernehmen – unabhängig davon, ob sie in Haushalten, Fabriken oder Logistikzentren eingesetzt werden. Dafür arbeitet Google auch an Versionen, die direkt auf dem Roboter laufen und sich schnell an neue Hardware anpassen lassen.





