2015年7月27日以前の記事
検索
ニュース

Googleが「Gemini 4 Argon」発表 “10カ月の沈黙”を破り、AI開発競争の首位奪還へ(2/3 ページ)

米Googleは次世代AIモデル「Gemini 4 Argon」を発表した。最上位モデルの更新が10カ月ストップしていた同社だが、出力上限を従来比15倍超に拡大し、競合の半額以下の低価格で巻き返しを図る。ベンチマーク18項目中12項目で単独首位を獲得。一般公開に先立ち、まずは審査済みのサイバー防御機関へ先行配布される。AI開発の最前線で米OpenAIや米Anthropicとの競争が再加速する。

PC用表示 関連情報
Share
Tweet
LINE
Hatena
ExaWizards

「出力15倍・価格は半額」の衝撃 「難問を解き切る深い推論が可能」

 今回の発表文はカヴクチュオール氏の名前で出された。技術面の目玉は、1回の応答で出力できる分量の上限を、従来の6万4000トークンから100万トークンへ引き上げたことだ(トークンはAIが文章を処理する単位)。

 AI専門ニュースサイトの米MarkTechPostによると、Anthropicの「Claude Opus 5.5」やOpenAIの「GPT-6 Astra」の上限は12万8000トークンで、Argonはその約8倍にあたる。Googleは「数十万トークン分の思考を一続きで生み出せる余裕があれば、難問を一度で解き切る深い推論が可能になる」と説明する。

 価格は導入期間中、入力100万トークン当たり2ドル、出力10ドル。期間終了後は4ドルと20ドルに上がるという。導入価格はClaude Opus 5.5の半額、GPT-6 Astraの5分の1に当たる。

ベンチマーク18項目中12項目で首位 弱点は?

 Googleが公表した比較表で、Argonは18のベンチマークのうち12項目で単独首位に立った(MarkTechPost集計)。長時間にわたる実践的なソフト開発を測る「DeepSWE v1.1」では77.9%と過去最高を記録。Opus 5.5の74.2%、GPT-6 Astraの74.1%を上回った。業務自動化ツールの米Zapier(ザピア)が作った業務遂行テスト「AutomationBench」でも51.3%で首位。Opus 5.5は42.5%だった。

 一方で全勝ではない。難度の高いソフト開発を測る「FrontierSWE v2」ではGPT-6 Astraの65.5%に対し55.0%、コマンド操作の能力を測る「Terminal-Bench 4.0」ではOpus 5.5の66.4%に対し、57.4%にとどまった。

 社内では、すでに数千人の社員が使っている。Argonのエージェント群は、データセンター全体の稼働データを分析して、メモリーの無駄を自ら洗い出し、300TiB超を解放した。最終的な削減量は、500TiBから1PiBに達する見込みだという。ハッキングの隙(脆弱性)になりやすい従来の「C/C++」で書かれたプログラムを、安全性の高い現代の言語「Rust」へ書き換える作業も担い、対象は最大80万行を超えるOSの中核部分に及ぶ。

「最強モデル」をサイバー防御へ先行提供

 提供の順番は異例だ。Argonはまず、Googleの審査を通った企業や政府機関のセキュリティ部門が参加する「Fairwind Program」を通じて配布される。Googleはソフトの重大な脆弱性を自律的に発見、検証、修正できるようArgonを訓練している。こうした「サイバー攻撃を防ぐセキュリティ機関」(防御側)や自社の開発チームに対しては、あえてAIの安全制限(ガードレール)を解除した状態で提供する。

 実績も示した。クラウドセキュリティの米Wiz(ウィズ)が公共インフラを無償で守る取り組みでArgonを使ったところ、世界中の病院が使う医療用ソフトに、機微な個人情報が漏れかねない重大な脆弱性を見つけた。従来の最先端モデルが見逃していたものだという。

 最強のモデルをまず防御側に渡すやり方は、Googleだけのものではない。Fairwind ProgramはAnthropicの「Project Glasswing」やOpenAIの「Daybreak」と同様の枠組みだ。3社とも、攻撃にも転用できるほどのサイバー能力を持つモデルを、まず守る側に行き渡らせてから一般に開放する手順を踏んでいる。

© エクサウィザーズ AI新聞

ページトップに戻る