OpenAI、エージェントコーディングモデル「GPT-5.3-Codex」発表 Anthropicの新Opus発表直後に
米OpenAIは2月5日(現地時間)、ソフトウェア開発者向けのエージェント型コーディングツール「GPT-5.3-Codex」をリリースしたと発表した。同社はこのモデルを、これまでで最も有能なエージェント型コーディングモデルと位置付けており、従来モデルよりも推論能力や専門知識が強化されている。この発表は、米Anthropicが高度な推論とコーディング能力を備えた「Claude Opus 4.6」を発表した直後(約15分後)に行われた。
OpenAIは、Codexの役割が劇的に変化したと主張している。これまでCodexは単にコードを記述し、レビューするだけのエージェントだったが、新モデルでは開発者や専門家がコンピュータ上で行うほぼすべての作業を実行できるエージェントへと進化したという。まるで同僚のように、作業中に対話や方向修正を行うことが可能で、コンテキストを失うことなく長時間のタスクを遂行できるとしている。
GPT-5.3-Codexは昨年12月発表の「GPT-5.2-Codex」より速度が25%向上。ベンチマークテストでは、ソフトウェアエンジニアリング能力を測る「SWE-Bench Pro」で56.8%(前モデルは56.4%)、ターミナル操作スキルを測る「Terminal-Bench 2.0」で77.3%(前モデルは64.0%)を記録したほか、コンピュータ操作の「OSWorld-Verified」では64.7%と、前モデルの38.2%から大幅な向上を見せている。サム・アルトマンCEOはXへのポストで、ベンチマークの数値以上に大きな前進を感じられるモデルだと述べている。
このモデルはコーディングだけでなく、ソフトウェアのライフサイクル全体(デバッグ、PRD作成、コピー編集、ユーザーリサーチなど)を支援するように設計されているという。さらに、スライド資料の作成やスプレッドシートでのデータ分析といった専門的な知識労働でも高いパフォーマンスを発揮し、単一の汎用エージェントへの一歩を踏み出したとしている。
安全性については、OpenAIのAIモデルの能力とそれに伴うリスクを評価・分類し、適切な安全対策を講じるための枠組み「Preparedness Framework」で、サイバーセキュリティ関連タスクで初めて「High」の能力を持つと分類されたモデルとしている。サイバー攻撃の自動化に関する決定的な証拠はないものの、予防的なアプローチとして包括的な安全対策を講じており、サイバー防御を加速させるためにAPIクレジットとして1000万ドルの提供を確約している。
GPT-5.3-Codexは、ChatGPTの有料プランユーザー向けに、アプリ、CLI、IDE拡張機能、Webを通じて提供が開始されている。APIアクセスについては現在準備中であり、安全に利用可能になり次第提供される予定だ。
Copyright © ITmedia, Inc. All Rights Reserved.
関連記事
こんなメディアも見られています
ITmedia AI+に関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
SpecialPR
アクセスランキング
-
1
AIと人の共創で進化する「G-SHOCK」 デザイナーが語る製品化の舞台裏
-
2
日本発スタートアップのエッジAIチップがNVIDIA超え、AI処理性能は3.36PFLOPS
-
3
AIを導入しても“組織的には使われない”のはなぜ? 「個人利用」にとどまる理由と脱却策
-
4
「AIトークンコスト増を44%抑制」できる可能性も 高性能モデルの“使い過ぎ”、どう減らす?
-
5
Google、リアルタイムで表情豊かに話すAIアバター「Gemini 3.8 Live with Live Avatar」提供開始 画像1枚で独自アバターも
-
6
「Codex」で1時間にわたる障害→使用量リセットへ
-
7
ハルシネーション排除、最大200倍高速――元OpenAI研究者の新AI「Jev」は何が違うのか
-
8
「1週間の開発タスク」でAIの限界を検証 Googleが「Android Bench 2.0」公開
-
9
ソフトPLCがAIの「道具」に、簡単導入のPLCドラレコカメラも
-
10
「Jev」とは “文章を書かないAI”がなぜ話題に? 元OpenAI研究者が開発、「“スマートなif文”と考えてみて」
SpecialPR
ITmedia AI+ SNS
インフォメーション
注目情報をチェック
ITmedia AI+をフォロー
あなたにおすすめの記事PR