本サイトの記事や画像は、AIが公的資料や複数の報道を基に事実関係を整理・再構成し制作したものです。[続きを表示]特定の報道内容や表現を再利用・要約することを目的としたものではありません。ただし、誤りや不確定な情報が含まれる可能性がありますので、参考の一助としてご覧いただき、実際の判断は公的資料や各出典元の原文をご確認ください。[私たちの取り組み]
Google DeepMindは2026年7月30日付の公式発表で、歩行と物体操作を組み合わせた全身制御や複数ロボットの協働に対応するAIモデル群「Gemini Robotics 2」を発表した。
足先から指先まで一体的に制御
モデル群には、視覚と言語をモーター制御へ変換する視覚・言語・行動(VLA)モデル「Gemini Robotics 2」、高位の作業計画を担う「Gemini Robotics ER 2」、端末上で動作する「Gemini Robotics On-Device 2」が含まれる。
従来モデルはヒューマノイドの上半身による卓上作業が中心だったが、Gemini Robotics 2は足先から指先までの全身制御へ対象を広げた。Google DeepMindは、歩行、しゃがみ込み、身体を伸ばす動作、物体操作を組み合わせて散らかった部屋を片付ける例を示した。
複数台の協働と端末内での適応
Gemini Robotics ER 2は、数分間にわたる作業の手順を組み立てて進捗を追跡し、異なる種類のロボットが作業を分担する協働機能も備える。ただし、実証された能力があらゆる環境での自律運用を保証するわけではない。
Gemini Robotics On-Device 2はインターネット接続に依存せずロボット上で動作する。新しい双腕ロボットへの追加適応は、通常200例未満のデータと数時間の適応時間で可能としている。Google DeepMindは異なる機体で例を示しているが、この条件を用途横断で保証する成功率は示していない。
8月10日時点で、Gemini Robotics ER 2はGemini APIとGoogle AI Studioでパブリックプレビューとして利用できる。一方、Gemini Robotics 2とGemini Robotics On-Device 2は早期アクセスパートナー向けである。
