グーグル傘下のAI研究機関・Google DeepMindは、次世代ロボットの“頭脳”となる新モデル「Gemini Robotics 2」と、その中核を担う具現化推論モデル「Gemini Robotics ER 2」を発表しました。これにより、ロボットが周囲を観察し、自ら計画を立て、複数工程の作業を柔軟にこなす未来が一気に現実味を帯びてきました。
Gemini Robotics 2とは何か
人間社会に「なじむ」ロボットを目指す新しい頭脳
Gemini Robotics 2は、Google DeepMindが開発したロボット向けのAIレイヤーで、従来の産業用ロボットのように決められた動きだけを繰り返すのではなく、人間の生活空間や職場環境に自律的かつ柔軟に適応できることを目指しています。単に指示された通りに腕を動かすだけでなく、「状況を理解し、自分で考えて行動する」ことに重点が置かれているのが特徴です。
全身制御・高い器用さ・複数ロボット連携を実現
今回の発表では、ロボットの「インテリジェンス(知能レイヤー)」が大きく進化したと説明されています。具体的には、次のような能力が強化されています。
- 脚や胴体、腕などを統合的に制御する「全身制御」
- 細かい物のつかみ分けや繊細な操作を可能にする「高度な器用さ」
- 複数台のロボットが協調して作業を分担する「マルチロボット協調」
これにより、工場での共同作業だけでなく、倉庫でのピッキングと搬送を複数ロボットで分担したり、将来的には家庭内の家事支援など、より現実に近いシナリオでの活用が期待されます。
ロボットはどうやって「考える」のか
高レベルの「脳」にあたるGemini Robotics ER 2
Google DeepMindは、ロボットの思考プロセスを担う中核として、新たに「Gemini Robotics ER 2」を導入しました。ERは「Embodied Reasoning(具現化された推論)」の略で、現実世界に存在する身体を持つロボットが、状況に応じて論理的に判断・計画できるように設計されたモデルです。いわば、ロボットにとっての「高レベルの脳」に相当します。
観察・推論・行動・進捗管理という4つのステップ
Gemini Robotics ER 2は、現実世界の複雑なタスクを次のようなステップに分解して処理します。
- 環境の観察:カメラなどのセンサーを通じて周囲の状況を把握する
- 必要な行動の推論:タスクを完了するためにどのような手順が必要かを計画する
- 実行モデルとの連携:視覚・言語・動作を結びつける「ビジョン・ランゲージ・アクション(VLA)モデル」と協調し、具体的な動きを決定する
- 進捗の追跡:作業が完了するまで途中経過をモニタリングし、必要に応じて計画を修正する
この枠組みによって、ロボットは単純な一回きりの命令ではなく、複数ステップにまたがる長い作業フローでも、自分で状態を確認しながらやり遂げることが可能になります。
失敗からの自己修正と未知の状況への適応
説明によると、Gemini Robotics ER 2を用いたロボットは、あるステップで失敗しても、その場で状況を再評価し、別の方法を試すなど「自己修正」ができるとされています。例えば、物をつかみ損ねた場合でも、その結果を観察してつかみ方を変える、といった挙動が想定されます。
さらに、事前にプログラムされていない「初めて見る状況」に対しても、観察と推論を通じて最適な行動を探ることができるため、固定的な環境に縛られないロボット応用が広がる可能性があります。
期待される活用シーンとインパクト
マルチステップ作業の自動化と現場負担の軽減
Gemini Robotics 2とER 2の組み合わせにより、従来は人間が介入しなければ進行できなかった複雑な作業も、自律的にこなせるようになると期待されています。倉庫でのピッキングから梱包、棚への戻しまでを一連の流れとして任せたり、製造ラインでの検査・組立・搬送を状況に応じて柔軟に切り替える、といった応用が考えられます。
人とロボットの協働やサービス分野への展開
ロボットが自ら環境を理解し、タスクを計画できるようになることで、人間とロボットが同じ空間で協働するシーンも増えていくと見込まれます。例えば、ロボットが人の動きを観察して作業の流れを学び、足りない部分を自動的に補う、あるいは家庭や介護現場で、利用者の状況にあわせて支援内容を変えるといった柔軟なサービスが現実味を帯びてきます。
3つの新モデルによるロボティクス研究の加速
Google DeepMindは、今回の発表でGemini Robotics ER 2を含む「3つの新しいモデル」を紹介すると予告しています。詳細は今後の公表を待つ必要がありますが、異なる用途やロボット形態に対応したモデル群である可能性もあり、研究者・開発者コミュニティにとっては、実世界ロボティクスの実験と検証を加速する基盤となりそうです。
一次情報・参考リンク
まとめ
Google DeepMindのGemini Robotics 2およびGemini Robotics ER 2は、ロボットに「観察し、考え、計画し、やり遂げる」能力を与えることで、実世界での自律動作を大きく前進させる取り組みです。全身制御やマルチロボット協調といった要素と組み合わさることで、産業現場からサービス分野、家庭に至るまで、ロボット活用の幅を広げる可能性があります。今後公開される追加情報や実際のデモンストレーションを通じて、この新しいロボット知能がどこまで実用レベルに近づいているのか注目されます。




