ニュース
ニュース
ロボット産業向けに特別に設計!Google が 2 つの新しい AI モデルを発表
2025-03-13 1144

Google DeepMindは、ロボットが「これまで以上に幅広い現実世界のタスクを実行」できるように設計された2つの新しい人工知能モデルを発表した。最初のモデルは ジェミニロボティクスは、事前の訓練がなくても新しい状況を理解できる視覚・言語・行動モデルです。


ジェミニロボティクスは ジェミニ2.0は、Google の主力人工知能モデルの最新バージョンです。記者会見で、Google DeepMind のシニア ディレクター兼ロボティクス責任者である Carolina Parada 氏は、Gemini Robotics は「Gemini のマルチモーダル世界に関する理解を活用し、新しいモダリティとして物理的な動作を追加することで、それを現実世界に転送する」と述べました。

新しいモデルは、Google DeepMind が有用なロボットを作成するために重要だと考える 3 つの主要分野で進歩を遂げました。 一般化、インタラクティブ性、器用さジェミニ・ロボティクスは、新しいシナリオを一般化する能力に加え、人や環境とよりうまくやりとりすることができます。また、紙を折ったり、ボトルのキャップを外したりするなど、より正確な物理的作業も実行できます。

Google DeepMind の新しい Gemini Robotics モデルにより、ロボットの器用さが向上します。

パラダ氏は、「これまで、私たちはこれらの各領域で個別に進歩を遂げてきましたが、現在では単一のモデルで3つの領域すべてのパフォーマンスを大幅に向上させています。これにより、環境の変化に対してより有能で、反応性が高く、堅牢なロボットを作成できるようになります」と述べました。

Google DeepMindも導入 ジェミニロボティクス-ER 同社はこれを「複雑で絶えず変化する世界を理解する」能力を持つ高度な視覚言語モデルと説明している。

パラダ氏が説明したように、目の前のテーブルにさまざまな品物を詰めたお弁当箱を作るとき、すべての品物がどこにあるのか、お弁当箱の開け方、品物の取り方、そしてそれらをどこに置くかを知っておく必要があります。これはまさに、Gemini Robotics-ER が処理するように設計された推論です。ロボット工学の専門家が既存の低レベル コントローラー (ロボットの動きを制御するシステム) に接続できるようにし、Gemini Robotics-ER によって強化された新機能を有効にできるようにすることを目指しています。

image.png

Gemini Robotics は、ロボットがさまざまなタスクを実行するのを支援することもできます。


安全性に関して、グーグル・ディープマインド研究員のヴィカス・シンドワニ氏は記者団に対し、同社が「階層化アプローチ」を開発中であり、ジェミニ・ロボティクス-ERモデルは「特定のシナリオで潜在的な行動を実行することが安全かどうかを評価するように訓練されている」と付け加えた。同社はまた、AI業界が安全性研究をさらに進めるのを支援するために、新しいベンチマークとフレームワークも発表した。昨年、グーグル・ディープマインドは、アイザック・アシモフにヒントを得たロボットのルール集「ロボット憲法」を発表した。

Google DeepMind は Apptronik と連携して「次世代のヒューマノイド ロボットの構築」に取り組んでいます。さらに、Google DeepMind は Agile Robots、Agility Robotics、Boston Dynamics、Enchanted Tools などの「信頼できるテスター」に Gemini Robotics-ER モデルへのアクセスを許可しています。Parada 氏は「私たちは、物理的な世界を理解し、その中で行動を起こすことができる知能の構築に重点を置いています。これをさまざまな実施形態やアプリケーションで活用できることを非常に楽しみにしています」と述べています。

whatsapp

サービスホットライン

tel: +86 755 83044319

WhatsApp

Whatsapp:+8618073002950