OpenAI、Cerebrasチップ搭載の高速エージェントコーディングツール「GPT-5.3-Codex-Spark」
米OpenAIは2月12日(現地時間)、エージェントコーディングツールの高速版「GPT-5.3-Codex-Spark」をリリースしたと発表した。5日に公開した「GPT-5.3-Codex」の小型版であり、リアルタイムでの対話的なコーディング作業を可能にすることを目的として設計したという。推論処理を高速化し、インタラクティブな編集やロジックの即時反映を実現する環境を提供するとしている。
GPT-5.3-Codex-Spark(以下、Codex-Spark)は、米Cerebrasの専用チップ「Wafer Scale Engine 3」を活用している点が特徴だ。このAIアクセラレータは、1秒当たり1000トークン以上の処理能力を発揮するという。OpenAIは1月、Cerebrasとの提携を発表している。
Cerebrasは公式ブログで、Wafer Scale Engineが最大級のオンチップメモリによって高速推論を実現し、将来的には数千台規模にスケールアウトして1兆規模パラメータのモデルにも対応すると語った。2026年にはこの超高速推論を「最大級のフロンティアモデル」へと広げる考えを示した。
Codex-Sparkは推論速度の向上に加え、エンドツーエンドの応答遅延を低減するためのインフラ最適化も導入した。レイテンシ改善のためにWebSocket接続の持続化やレスポンスストリーミングの再設計なども進め、初期トークン出力までの時間を大幅に短縮したと説明している。こうした低遅延設計は、開発者がモデルとのインタラクションを途切れなく行える点でメリットがあると強調している。
ベンチマークなどは紹介されていないが、公式Xでヘビゲームを作るコーディングのCodexとCodex-Sparkの比較動画を公開している。
Codex-Sparkは研究プレビューとして提供され、当面はChatGPTのProプランの利用者がCodexアプリ、CLI、VS Code拡張機能などで試すことができる。プレビュー期間中は独立したレート制限が適用され、標準的な使用制限とは別に管理される。一部の設計パートナー向けにはAPIでも提供され、今後アクセス範囲の拡大や機能強化が進められる予定だ。プレビュー提供の段階では追加料金は不要だが、利用にはProプランへの加入が前提となる。公式ブログでは、需要に応じてアクセス制御や一時的な待機が発生する可能性も示している。
Copyright © ITmedia, Inc. All Rights Reserved.
関連記事
こんなメディアも見られています
ITmedia AI+に関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
SpecialPR
アクセスランキング
-
1
「Claude Code」の週次制限枠、9月14日に"25%引き上げ" 実質は現状比17%減に
-
2
「AI時代、業務の再設計が必要」 それ、DXの時も言っていましたよね……本当にできる? 日本IBMの答えは
-
3
ビル・ゲイツが語る「AIで開発者はいらなくなる」の先にある話
-
4
【無料】日本語のAI学習サイトをAnthropicが公開 「Claude Code入門」など357のコンテンツが学べる
-
5
AI開発はプロンプトからコンテキスト、ハーネスへと向かう ハーネス成熟度を測る3つのチェックリスト
-
6
AIをよく使う社員だけ5倍に Claude、ChatGPT/Codex、Cursorで企業がAIを本格運用できる時代へ
-
7
AIが生成した“存在しない病名”、研修医の44%が信用 見抜けた医師との差は? 仏大学病院が検証
-
8
“脱Excel”なんて言えない 「システムが出したデータをExcelで検算」がなくならない理由
-
9
パナソニックHDがAI・ロボティクス研究開発本部を新設、CAIOの榊原氏がトップに
-
10
Hugging Face侵害事件、OpenAIとMETRが最終報告書公開──約1200体のAIエージェントが“闇掲示板”で結託し700体が攻撃に参加
SpecialPR
ITmedia AI+ SNS
インフォメーション
注目情報をチェック
ITmedia AI+をフォロー
あなたにおすすめの記事PR