Meta、コーディングエージェント「Muse Code」リリース 「Claude Code」や「Codex」に対抗
米Metaは8月5日(現地時間)、ターミナル上で動作するコーディングエージェント「Muse Code」をベータ版として公開した。同時に、コーディング性能を強化した新モデル「Muse Spark 1.2」も発表した。
Muse CodeはmacOSとLinuxに対応し、1行のコマンドでインストールできる。Muse Code自体は無料でインストールでき、課金はAPI経由のトークン従量制となる。標準のMuse Spark 1.2は100万トークン当たり入力1.25ドル、出力4.25ドル(キャッシュ済み入力は0.15ドル)で、1.1と同水準。プロンプトと応答は製品改良には使用しないとしている。これとは別に、入力0.10ドル、出力0.20ドル(同0.002ドル)と10分の1以下に設定した「muse-spark-1.2-contributor」を用意し、こちらは入出力が製品改良に使われる。Metaは今回のリリースを「フロンティアAIに向けた次のステップ」と位置付け、より大規模で高性能なモデルの投入を予告している。
Muse Codeは、大規模なリポジトリ全体にまたがるソフトウェアエンジニアリングのタスクを対象とし、変更の計画立案、コードの記述、結果の検証までを担う。特徴は、シンプルなエージェントループに「非同期バックグラウンドエージェント」を組み合わせた構成だ。これらの専用エージェントはタスクごとに起動するのではなくセッション中は常駐するため、同じ情報を繰り返し集める無駄を削減できるとしている。
エージェント自身が次の手順を進め、主エージェントに報告するタイミングも自ら判断する。同社は、この常駐性により、複雑な多段階タスクでの遅延と人による軌道修正の必要性が減るとしている。実行基盤は、モデル呼び出し、ツール実行、承認、編集のすべてをローカルのイベントログに追記する設計を採る。これを唯一の正しい記録として扱うことで、実行を正確に再現でき、クラッシュ後も中断した地点から正確に再開できるという。
標準スキルとして、人間の承認を伴う実行計画へ落とし込む「/plan」、その計画が破綻しないか検証する「/grill」、指定した目標の達成に向けて作業する「/goal」を備える。
Muse Spark 1.2は、7月に公開した「Muse Spark 1.1」のコーディング特化アップデート。コード生成、複雑なデバッグ、コードベースの理解、開発ワークフロー全体の処理を改善した。コーディングタスクの学習計算量を大幅に増やし、学習環境の多様性も広げたとしている。Muse Codeと組み合わせた際に最大の性能を発揮するよう両者を共同学習させたほか、リポジトリ全体の生成などの長時間タスクを重点的に学習させた。
さらに、1.1に学習用のコーディング環境と指示テンプレートを生成させ、候補となる解答を採点させる自己改善ループも用いている。事例として、GPUカーネルの反復的な最適化を挙げている。米NVIDIAのHopper向けKDA/MLAカーネルを対象に、最大24時間、1000回を超えるツール呼び出しにわたって、記述、コンパイル、プロファイリングを繰り返し、与えられたベースライン実装に対する性能を継続的に改善したという。
米xAIの「Grok 4.5」、米Anthropicの「Claude Opus 5」、米OpenAIの「GPT-5.6 Terra」、米Googleの「Gemini 3.6 Flash」、中国Moonshot AIの「Kimi K3」と比較したベンチマーク結果も紹介した。ターミナル操作を評価する「Terminal-Bench 2.1」で82.9%、実際のリポジトリでの課題解決を測る「DeepSWE 1.1」で59.3%、Metaの社内コードベースから作成した「Meta Internal Coding Bench」で70.6%を記録した。いずれもMuse Spark 1.1(それぞれ76.2%、53.0%、68.3%)を上回るが、Claude Opus 5には3項目とも及ばず、DeepSWE 1.1ではGPT-5.6 Terraも下回っている。一方、MCPサーバとツールの利用能力を測る「MCP Atlas」では首位だった。
Muse Spark 1.2は同日から、Muse Codeと「Meta Model API」で利用できる。Metaはグローバルでのアクセスを拡大したとしている。マーク・ザッカーバーグCEOはXへの投稿で、低コストで始められ、「contributor tier」から利用を開始できると述べている。
ターミナル常駐型のコーディングエージェントは競合各社も投入済みで、Anthropicは「Claude Code」、OpenAIは「Codex」を提供している。Metaの評価資料でも、比較対象として両社の製品に加え、xAIの「Grok Build」、Googleの「Antigravity」、Moonshot AIの「Kimi Code」の名前が挙がっている。
Copyright © ITmedia, Inc. All Rights Reserved.
関連記事
こんなメディアも見られています
ITmedia AI+に関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
SpecialPR
アクセスランキング
-
1
経営「AIでラクして早く帰って」→社員「帰らない」 工数最大9割減のDeNAも悩むAI効率化の壁
-
2
「Jev」とは “文章を書かないAI”がなぜ話題に? 元OpenAI研究者が開発、「“スマートなif文”と考えてみて」
-
3
OpenAIの「AGI到達」宣言に待った! 評価テスト「99.9%」のカラクリと評価団体が反論した真実
-
4
パナソニック・サムスン撤退の裏で「中国勢5割」 独IT見本市「IFA」トップが明かす舞台裏
-
5
経営者は「AI導入」に夢中、現場は「IT環境」に疲弊 ITサポート軽視が招く時間・人件費ロスの実態
-
6
散在する“29万ファイル”をAmazon S3に集約、「AIに聞くだけ」で検索可能に――AWSはどう実現?
-
7
推論領域への野心強めるNVIDIA 韓国新興と協議か
-
8
恐るるに足らず? 中国フィジカルAI主要15社と5大集積地で見る「点と線と面」
-
9
農水省の“クソダサ”ポスター話題 「AIよりよっぽど良い」の声も 担当者に狙いを聞いた
-
10
ローカルLLM利用のクリニックが話題 院長自ら環境を構築 「医療機器より安い」は本当か
SpecialPR
ITmedia AI+ SNS
インフォメーション
注目情報をチェック
ITmedia AI+をフォロー
あなたにおすすめの記事PR