Google DeepMindが「Gemini Robotics 2」を発表、全身制御でロボットの汎用性が向上か
Google DeepMindが、ロボットの全身動作を統合的に制御できるAIモデル群「Gemini Robotics 2」を公開しました。歩行から指先の精密な作業までをカバーし、複数の機体による連携も可能にするとしており、物理的な作業の自動化に新たな可能性を提示しています。
何が起きたのか
7月30日に発表されたこのモデル群は、人型ロボットの足先から指先までを一貫して動かせるのが特徴です。両手を用いた細かな操作や、紐を結ぶといった複雑な動作への対応が報じられています。また、高次の推論を担う「ER 2」や軽量なVLAモデルが含まれるほか、安全性を評価するための新指標「ASIMOV-Agentic」も合わせて公開されました。異なる機体への迅速な適応や、複数のロボットが協力して作業を行う機能も備えているとされています。
なぜ注目されているのか
一般に、AIに物理的な身体を持たせる「身体性AI」の領域では、高度な判断(脳)と精密な動作(体)をどう結びつけるかが課題でした。今回の発表は、推論から実行までを統合的に制御しようとする試みと言えます。これが普及すれば、製造現場や介護、家事支援など、これまで人間にしかできなかった繊細な作業をロボットが担う未来が考えられます。ただし、実用化には環境への適応力や安全性の確保が鍵となるでしょう。
報道を読み比べると
報道各社で注目点が分かれています。GIGAZINEは異なる機体への適応力や共同作業に触れ、ITmedia AI+は内部のモデル構成や安全基準などの技術的側面に注目しています。一方、Impress Watchは「ヒモも縛れる」という具体的な動作を強調しました。全体として、単なる動作の実現だけでなく、安全性や汎用性をどう担保するかが今後の議論の焦点になるとみられます。
この記事に出てくる言葉
- VLAモデル
- 視覚・言語・行動を統合し、画像などの入力から直接ロボットの動作を生成するAIモデルのこと。
- ASIMOV-Agentic
- Googleが公開した、ロボットAIの安全性を客観的に評価するための新しいベンチマーク。
今後の注目点
- 実際の作業現場でどの程度の精度で動作が再現されるか
- 異なるメーカーのロボット間でどこまで共通して利用できるか
よくある質問
Gemini Robotics 2で何ができるようになるのか?
人型ロボットの歩行や姿勢の制御に加え、両手を使った紐結びのような微細な作業や、複数台のロボットによる連携作業が可能になると報じられています。
安全性についてはどのように考えられているのか?
安全性を評価するための新しいベンチマークである「ASIMOV-Agentic」が公開されており、それに基づいた評価が行われるものと考えられます。
💻 ハドウ の取材メモ
この話題を選んだ理由:3つの媒体が同じ出来事を報じていた(注目度スコア 5.101)
GIGAZINEの要約に「2026年7月30日」という記述がありましたが、他の媒体では年表記がなく、未来の日付となっているため、混乱を避けるため本文では「7月30日」という表記に留めています。
参照した報道(3媒体・3本)
この記事は下記の各社が公開している見出し・配信情報をもとに、独自にまとめたものです。記事本文は転載していません。詳細は各社の元記事をご確認ください。
この記事は、各社が公開している見出しと配信情報をAIが読み取り、要点・背景・論点を整理して自動生成したものです。速報性を優先しているため、内容に誤りや古い情報が含まれる場合があります。正確な情報は必ず上記の出典元をご確認ください。医療・投資・法律に関わる判断は専門家にご相談ください。