Googles neues KI-Modell steuert Roboter jeder Form und Größe


Google Deepmind hat mit Gemini Robotics 2 sein bislang fortschrittlichstes Vision-Language-Action-Modell (VLA) vorgestellt. Ein VLA-Modell kombiniert Bilderkennung, Sprachverständnis und Handlungssteuerung, um Roboter besser durch die physische Welt zu navigieren. Es kann Roboter aller Bauarten steuern, von Tischrobotern bis zu humanoiden Ganzkörperrobotern.

Gemini Robotics 2 soll als Intelligenzschicht für die nächste Generation anpassungsfähiger Roboter dienen. Das Modell ermöglicht intelligente Ganzkörpersteuerung, fortgeschrittene Feinmotorik und die Zusammenarbeit mehrerer Roboter. Interessierte können sich über eine Warteliste für einen frühen Zugang anmelden.

Zusätzlich hat Google Deepmind Gemini Robotics ER 2 vorgestellt, ein Modell für “Embodied Reasoning”: die Fähigkeit, die physische Welt zu verstehen und daraus Handlungen abzuleiten. Es fungiert als übergeordnetes Gehirn für Roboter und löst das bisherige Modell 1.6 aus dem April ab. Gemini Robotics ER 2 ist bereits in Google AI Studio verfügbar.

KI-News ohne Hype – von Menschen kuratiert

Mit dem THE‑DECODER‑Abo liest du werbefrei und wirst Teil unserer Community: Diskutiere im Kommentarsystem, erhalte unseren wöchentlichen KI‑Newsletter, 6× im Jahr den “KI Radar”‑Frontier‑Newsletter mit den neuesten Entwicklungen aus der Spitze der KI‑Forschung, bis zu 25 % Rabatt auf KI Pro‑Events und Zugriff auf das komplette Archiv der letzten zehn Jahre.



Source link

Leave a Comment