Google、「Gemini 2.0 Flash Thinking」公開 「o1」競合の“思考過程を示す”推論AIモデル
米Googleは12月19日(現地時間)、新たな推論AIモデル「Gemini 2.0 Flash Thinking」を発表し、Experimental(実験)モデルをGoogle AI Studioで公開した。
Gemini 2.0 Flash Thinkingは、回答の一部としてモデルが行う「思考プロセス」、つまり、問題を解決するためにどのような手順で考え、どのような情報を参照したのかを、人間が理解できる形で示すようにトレーニングされた推論モデル。ベースとした「Gemini 2.0 Flash」よりも、より強力な推論機能を備えており、マルチモーダル理解、推論、コーディングに最適という。
Google DeepMindとGoogle Researchのチーフサイエンティスト、ジェフ・ディーン氏はXのポストで、「思考を明示的に示すモデル」と説明した。同氏がシェアしたデモでは、「電子は、x=-0.15nmとx=+0.15nm の壁を持つ1次元の無限ポテンシャル井戸に閉じ込められている。電子が井戸内のエネルギーレベルを変えるときに放出される最も波長の長い4つの光子を見つけよ」という課題に対し、AIが考える過程を示しながら解に到達する様子が示されている。
AI Studioのリードプロダクト、ローガン・キルパトリック氏は、画像を使ったプロンプトの例として、4つのビリヤードの玉の画像に「この中の3つの玉を使って30にするには?」というデモを紹介した。
米OpenAIの推論モデル「o1」と同様に、複雑な課題を与えると数秒間「Thinking」する。
Google AI Studioでの利用には、以下の制限がある。
- 入力トークンの上限は3万2000個
- テキストと画像の入力のみ
- 出力トークの上限は8000個
- テキストのみの出力
- 検索やコード実行などの組み込みツールの使用なし
キルパトリック氏は、「これは、推論の旅の小さな第一歩にすぎない」と語った。
Copyright © ITmedia, Inc. All Rights Reserved.
関連記事
こんなメディアも見られています
ITmedia NEWSに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
SpecialPR
本日の新着記事
アクセスランキング
-
1
生成AI画像はなぜ“キショい”のか 消費者が抱く違和感の正体 広報のプロが解説
-
2
委託業者が無断でAI利用か――ヨルシカ、ライブ映像上映会のチケットサンプル画像が文字化け デザインにも影響
-
3
楽天モバイル、楽天ID未連携なら11月末に自動解約 電話番号も失効
-
4
「違反見つけてもSNSで晒さないで」 ホロライブ、二次創作ガイドライン改訂
-
5
「放射能問題、福島大には触らせたくない」で炎上した学歴系YouTuber、謝罪・動画削除も批判続く
-
6
「pixiv」「note」「ガルちゃん」などが国指定の“大規模プラットフォーム”に 誹謗中傷への迅速対応求める
-
7
Claudeの“見えない透かし”適用開始 Fable 5.1とMythos 5.1が出力する文やコード、画像に付与 日本も対象
-
8
「空いてる号車はこちら」駅の床に投影 東京メトロが実験、シャープの技術採用
-
9
やっぱり完全在宅ワークが一番幸せだった 離職率も最低 米大が7700人の働き方調査
-
10
三井不動産に不正アクセス 社員・社外関係者の情報最大5万5000件漏えいか
ITmedia NEWS SNS
インフォメーション
注目情報をチェック
ITmediaNEWSをフォロー
あなたにおすすめの記事PR