Googleは本日、Gemini Robotics 1.5とGemini Robotics-ER 1.5の2つのモデルを導入すると発表しました。これらは、ロボットが環境を能動的に理解し、複雑な多段階タスクを一般化して完了させることを支援します。
モデル発表GoogleGemini Robotics 1.5Gemini Robotics-ER 1.5
Google、Gemini Robotics 1.5を発表。推論と行動を分けた2モデルで物理エージェントを実現
具体的には、Gemini Robotics-ER 1.5が「上級の脳」として活動を統制し、Gemini Robotics 1.5が具体的な行動を実行するという構成です。ER 1.5は空間理解や論理的判断に優れ、Google Searchなどのツール呼び出しも可能です。一方、1.5は視覚と言語理解に基づき、指示されたアクションを直接実行します。
両モデルはGeminiファミリーの基盤上にあり、役割ごとに異なるデータセットで微調整されています。組み合わせることで、より長いタスクや多様な環境への汎用性が向上します。
Gemini Robotics-ER 1.5は、具身推論向けに最適化された初の思考モデルとして位置づけられています。ERQAやPoint-Benchを含む15の学術ベンチマークで、類似モデルと比較して最高水準のパフォーマンスを達成したとされています。
利用開始について、Gemini Robotics-ER 1.5は本日Google AI StudioのGemini API経由で開発者向けに提供開始されます。Gemini Robotics 1.5は現在、特定のパートナーのみが利用可能となっています。
出典: Gemini Robotics 1.5 brings AI agents into the physical world(HN 69pt・12コメント)(HN Search (backfill)、2025-09-26)