Neuigkeiten
Neuigkeiten
Speziell für die Roboterindustrie entwickelt! Google stellt zwei neue KI-Modelle vor
2025-03-13 1145

Google DeepMind bringt zwei neue Modelle künstlicher Intelligenz auf den Markt, die Robotern helfen sollen, „ein breiteres Spektrum realer Aufgaben als je zuvor zu erfüllen“. Das erste Modell, genannt Gemini Robotics, ist ein Vision-Language-Action-Modell, das auch ohne vorheriges Training neue Situationen verstehen kann.


Gemini Robotics basiert auf Zwillinge 2.0, die neueste Version von Googles Vorzeigemodell für künstliche Intelligenz. Während einer Pressekonferenz erklärte Carolina Parada, Senior Director und Head of Robotics bei Google DeepMind, dass Gemini Robotics „Geminis Verständnis der multimodalen Welt nutzt und es auf die reale Welt überträgt, indem physische Aktionen als neue Modalität hinzugefügt werden.“

Das neue Modell hat in drei Schlüsselbereichen Fortschritte erzielt, die Google DeepMind für die Entwicklung nützlicher Roboter als entscheidend erachtet: Generalisierung, Interaktivität und GeschicklichkeitNeben der Fähigkeit, neue Szenarien zu verallgemeinern, kann Gemini Robotics besser mit Menschen und der Umwelt interagieren. Er kann auch präzisere physische Aufgaben ausführen, wie zum Beispiel das Falten eines Blattes Papier oder das Entfernen eines Flaschendeckels.

Das neue Gemini Robotics-Modell von Google DeepMind macht Roboter geschickter.

Parada sagte: „In der Vergangenheit haben wir in jedem dieser Bereiche einzeln Fortschritte erzielt, aber jetzt verbessern wir die Leistung in allen drei Bereichen mit einem einzigen Modell erheblich. Dadurch können wir Roboter entwickeln, die leistungsfähiger, reaktionsfähiger und robuster gegenüber Umweltveränderungen sind.“

Google DeepMind stellte auch Gemini Robotics-ER (Embodied Reasoning), das das Unternehmen als fortschrittliches Vision-Language-Modell beschreibt, das in der Lage ist, „unsere komplexe und sich ständig verändernde Welt zu verstehen“.

Wie Parada erklärte, muss man beim Packen einer Lunchbox mit verschiedenen Gegenständen auf dem Tisch vor sich wissen, wo alles ist, wie man die Lunchbox öffnet, wie man die Gegenstände aufhebt und wo man sie hinlegt. Genau für diese Art von Denkprozessen ist Gemini Robotics-ER konzipiert. Es ermöglicht Robotikexperten die Verbindung mit bestehenden Low-Level-Controllern (Systemen zur Steuerung von Roboterbewegungen), um neue Funktionen von Gemini Robotics-ER zu ermöglichen.

image.png

Gemini Robotics kann Roboter auch bei der Ausführung einer Reihe von Aufgaben unterstützen.


Zum Thema Sicherheit erklärte Vikas Sindhwani, Forscher bei Google DeepMind, gegenüber Reportern, das Unternehmen entwickle einen mehrschichtigen Ansatz. Das Gemini Robotics-ER-Modell sei darauf trainiert, die Sicherheit potenzieller Aktionen in bestimmten Szenarien zu beurteilen. Das Unternehmen hat außerdem neue Benchmarks und Frameworks veröffentlicht, um die KI-Branche bei der Weiterentwicklung der Sicherheitsforschung zu unterstützen. Im vergangenen Jahr stellte Google DeepMind die „Robot Constitution“ vor, ein von Isaac Asimov inspiriertes Regelwerk für Roboter.

Google DeepMind arbeitet mit Apptronik zusammen, um die nächste Generation humanoider Roboter zu entwickeln. Darüber hinaus gewährt Google DeepMind „vertrauenswürdigen Testern“ Zugriff auf sein Gemini Robotics-ER-Modell, darunter Agile Robots, Agility Robotics, Boston Dynamics und Enchanted Tools. Parada sagte: „Wir konzentrieren uns stark auf die Entwicklung von Intelligenz, die die physische Welt verstehen und in ihr agieren kann. Wir freuen uns sehr, dies in verschiedenen Ausführungsformen und Anwendungen nutzen zu können.“

whatsapp

Service-Hotline

tel: +86 755 83044319

WhatsApp

Whatsapp:+8618073002950