Google DeepMind、「Gemini Robotics」でAIを現実世界へ
米Google傘下のGoogle DeepMindは3月12日(現地時間)、ロボットが物理的な世界で、より効果的に行動できるよう設計されたAIモデル「Gemini Robotics」を発表した。Gemini 2.0を基盤とし、視覚、言語理解、物理的な動作を統合し、様々なタスクを実行できる。
まだ実験段階で一般には公開していないが、韓国Hyundai Motor Group傘下のBoston Dynamicsなどの企業がテスターとして開発に参加している。
Gemini Roboticsは、現実世界で行動する能力をロボットに与えることを目指す。学習していない未知の状況や物体、複雑な指示、新しい環境にも対応でき、ロボットにインタラクティブ性を持たせる。
DeepMindはまた、「複雑で動的な世界を理解する」ことができる高度な視覚言語モデル「Gemini Robotics-ER」も発表した。こちらもGemini 2.0ベースで、マルチモーダルな推論能力を物理世界に拡張し、特に空間的および時間的な理解を強化することを目的とする。
Gemini Roboticsについては、例えば、メガネケースを開けたり、ヘッドホンのコードを巻く、弁当箱におかずを詰める、折り紙で狐を折るといった動作のデモが紹介されている。
Gemini Robotics-ERでは、空間理解能力を示すデモとして、コーヒーカップを見せられた際に、取っ手をつかむための適切な二本指の把持と安全な接近軌道を直感的に理解できる例が紹介されている。
DeepMindは公式YouTubeチャンネルで、多数のデモ動画を公開した。
DeepMindは、これらの開発では、安全性が重要だとし、Google AIの倫理原則に沿って責任ある開発を進めているとしている。ロボットが物理世界で行動するという性質上、テキストや画像などのデジタル領域のAIモデルとは異なる、特別な安全性の考慮が必要だと強調した。
Copyright © ITmedia, Inc. All Rights Reserved.
関連記事
こんなメディアも見られています
ITmedia AI+に関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
SpecialPR
よく見られているカテゴリー
アクセスランキング
-
1
日立、Anthropicと提携 グループ29万人に「Claude」などAI導入 社会インフラ分野にも展開へ
-
2
生成AIで3Dモデルを自動作成 専門スキル不要でテキストや画像から3D化
-
3
伊藤忠商事や三菱ケミカルなど16社が参画 大手企業の「暗黙知」を活用する新プロジェクト
-
4
「家庭教師のトライ」が学力診断にAI活用 20問解くだけで弱点を推定 生徒と講師の負担減らす
-
5
「最新のAI創薬ラボ」なのに会議室みたい!? 製薬大手がラブコール送る“異色のAI企業”による新拠点とは
-
6
「AIデータセンターの電力需要が急増」はホント? 発電大手Jパワー社長が明かした“報道との温度差”
-
7
みずほFGが実現 2週間かかるAIエージェント開発を最短数日にする仕組みとは?
-
8
「さすがに似すぎ」?──“LOVOTそっくり”と話題のSwitchbot新作ペットロボ、日本でも発売へ GROOVE Xの反応は
-
9
OpenAI、「ChatGPT」に個人向け資産管理機能 金融口座と連携
-
10
“人型ロボ完全国産化”目指すベンチャーから身長約130cmの小型モデル 中国機ベースも、近く国産化ロードマップ発表
SpecialPR
ITmedia AI+ SNS
インフォメーション
注目情報をチェック
ITmedia AI+をフォロー
あなたにおすすめの記事PR