うっかり見逃していたけれど、ちょっと気になる――そんなニュースを週末に“一気読み”する連載。今回は、9月20日週を中心に公開された主なニュースを一気にチェックしましょう!
Anthropicは9月22日、AIモデル「Claude Opus 5.5」を発表した。新たな「Claude 5.5」ファミリーの第1弾で、同日からClaude Platformに加え、Amazon Web Services、Google Cloud、Microsoft Azureでも利用できる。
同社によれば、多くの作業で上位モデルの「Fable 5.1」と同等の性能を持ちながら、一般的なワークロードでの実行コストはOpus 5より40%低いという。API価格は100万トークンあたり入力4ドル、出力20ドルで、Opus 5から20%下がった。キャッシュ読み取りは0.2ドルと、60%安くなっている。
同社が公表したベンチマークでは、エージェント型コーディングを測るTerminal-Bench 4.0で66.4%となり、Fable 5.1(55.8%)やOpenAIのGPT-6 Astra(57.9%)を上回った。一方、業務ワークフローのAutomationBenchと科学研究系のTerminal-Bench-Science 0.1では、GPT-6 Astraの方が高い。
安全面では、自動行動監査で同社の過去最高の結果となり、制約(boundaries)を回避しようとする試みはOpus 5やClaude Mythos 5.1より約85%少なかったとしている。また、thinking(思考)モードをオフにした状態では利用できなくなった。
同社はOpus 5.5を、CEOのダリオ・アモデイ氏がAI開発のペース調整を訴えてから初のリリースと位置付けている。同じ5.5世代の「Claude Sonnet 5.5」「Claude Haiku 5.5」も、今後数週間のうちに提供する予定だ。
OpenAIは9月22日、AIモデル「GPT-6 Sol」と「GPT-6 Luna」を発表した。同月に先行して発表した最上位モデル「GPT-6 Astra」と同様の手法で学習し、Astraの成果を、より高速で安価なモデルに持ち込んだとしている。
API価格は、GPT-5.6世代のプロモーション価格から50%引き下げた。100万トークンあたりで、GPT-6 Solは入力2ドル/出力10ドル(GPT-5.6 Solは4ドル/20ドル)、GPT-6 Lunaは入力0.1ドル/出力0.5ドル(GPT-5.6 Lunaは0.2ドル/1.2ドル)となる。
信頼性の面では、GPT-6 SolのミスがGPT-5.6 Solの約半分になり、Astraに近づいたとうたう。アラインメント評価でも両モデルがGPT-5.6世代から改善し、コーディング作業について誤解を招く主張をする割合が下がったとのことだ。
ベンチマークの比較対象には、主にAnthropicのモデルを挙げており、実務的なソフトウェア開発を測るDeepSWE v1.1では、GPT-6 Solが68.8%で、Claude Fable 5の69.9%と1.1ポイント差だった。1タスクあたりのコストは約80%低いとしている。業務ワークフローのAutomationBenchでは33.2%で、Claude Opus 5(26.9%)を9%のコストに抑えつつ上回ったという。
提供はChatGPT WorkとCodexで同日から始まり、対象はPlus、Pro、Business、Enterprise、Eduの各ユーザーだ。FreeとGoのユーザーも、デスクトップアプリでGPT-6 Lunaを使える。ただし、「Chat」ではまだ利用できない。APIでは「gpt-6-sol」「gpt-6-luna」として提供する。
AndroidとChromeOSが融合した次世代PC「Googlebook」の実機を見てきた ――AI統合で何が変わるのか?
実売3万9800円でノートPCを3画面化! ソースネクストのデュアル拡張ディスプレイ「DGP-DMD1401」を試す
なぜ競技用ゲーミングPCは光らない? HPSC久木留所長とマウス軣社長が語るアスリート支援の未来
ロジクールGの新型マウス「PRO X3 SUPERSTRIKE」や8K対応キーボード「PRO X2 RAPID」を見てきた
QualcommのSnapdragon Xシリーズが「Googlebook」に進出 DellとHPから搭載モデルが登場Copyright © ITmedia, Inc. All Rights Reserved.