Meta、コーディングエージェント「Muse Code」リリース 「Claude Code」や「Codex」に対抗

 米Metaは8月5日(現地時間)、ターミナル上で動作するコーディングエージェント「Muse Code」をベータ版として公開した。同時に、コーディング性能を強化した新モデル「Muse Spark 1.2」も発表した。

 Muse CodeはmacOSとLinuxに対応し、1行のコマンドでインストールできる。Muse Code自体は無料でインストールでき、課金はAPI経由のトークン従量制となる。標準のMuse Spark 1.2は100万トークン当たり入力1.25ドル、出力4.25ドル(キャッシュ済み入力は0.15ドル)で、1.1と同水準。プロンプトと応答は製品改良には使用しないとしている。これとは別に、入力0.10ドル、出力0.20ドル(同0.002ドル)と10分の1以下に設定した「muse-spark-1.2-contributor」を用意し、こちらは入出力が製品改良に使われる。Metaは今回のリリースを「フロンティアAIに向けた次のステップ」と位置付け、より大規模で高性能なモデルの投入を予告している。

Muse Spark 1.2の料金(画像:Meta)

 Muse Codeは、大規模なリポジトリ全体にまたがるソフトウェアエンジニアリングのタスクを対象とし、変更の計画立案、コードの記述、結果の検証までを担う。特徴は、シンプルなエージェントループに「非同期バックグラウンドエージェント」を組み合わせた構成だ。これらの専用エージェントはタスクごとに起動するのではなくセッション中は常駐するため、同じ情報を繰り返し集める無駄を削減できるとしている。

 エージェント自身が次の手順を進め、主エージェントに報告するタイミングも自ら判断する。同社は、この常駐性により、複雑な多段階タスクでの遅延と人による軌道修正の必要性が減るとしている。実行基盤は、モデル呼び出し、ツール実行、承認、編集のすべてをローカルのイベントログに追記する設計を採る。これを唯一の正しい記録として扱うことで、実行を正確に再現でき、クラッシュ後も中断した地点から正確に再開できるという。

 標準スキルとして、人間の承認を伴う実行計画へ落とし込む「/plan」、その計画が破綻しないか検証する「/grill」、指定した目標の達成に向けて作業する「/goal」を備える。

 Muse Spark 1.2は、7月に公開した「Muse Spark 1.1」のコーディング特化アップデート。コード生成、複雑なデバッグ、コードベースの理解、開発ワークフロー全体の処理を改善した。コーディングタスクの学習計算量を大幅に増やし、学習環境の多様性も広げたとしている。Muse Codeと組み合わせた際に最大の性能を発揮するよう両者を共同学習させたほか、リポジトリ全体の生成などの長時間タスクを重点的に学習させた。

 さらに、1.1に学習用のコーディング環境と指示テンプレートを生成させ、候補となる解答を採点させる自己改善ループも用いている。事例として、GPUカーネルの反復的な最適化を挙げている。米NVIDIAのHopper向けKDA/MLAカーネルを対象に、最大24時間、1000回を超えるツール呼び出しにわたって、記述、コンパイル、プロファイリングを繰り返し、与えられたベースライン実装に対する性能を継続的に改善したという。

 米xAIの「Grok 4.5」、米Anthropicの「Claude Opus 5」、米OpenAIの「GPT-5.6 Terra」、米Googleの「Gemini 3.6 Flash」、中国Moonshot AIの「Kimi K3」と比較したベンチマーク結果も紹介した。ターミナル操作を評価する「Terminal-Bench 2.1」で82.9%、実際のリポジトリでの課題解決を測る「DeepSWE 1.1」で59.3%、Metaの社内コードベースから作成した「Meta Internal Coding Bench」で70.6%を記録した。いずれもMuse Spark 1.1(それぞれ76.2%、53.0%、68.3%)を上回るが、Claude Opus 5には3項目とも及ばず、DeepSWE 1.1ではGPT-5.6 Terraも下回っている。一方、MCPサーバとツールの利用能力を測る「MCP Atlas」では首位だった。

ベンチマーク結果(左から、Terminal-Bench 2.1、DeepSWE 1.1、Meta Internal Coding Bench、MCP Atlas、GDPVal-AA v2。画像:Meta)

 Muse Spark 1.2は同日から、Muse Codeと「Meta Model API」で利用できる。Metaはグローバルでのアクセスを拡大したとしている。マーク・ザッカーバーグCEOはXへの投稿で、低コストで始められ、「contributor tier」から利用を開始できると述べている。

 ターミナル常駐型のコーディングエージェントは競合各社も投入済みで、Anthropicは「Claude Code」、OpenAIは「Codex」を提供している。Metaの評価資料でも、比較対象として両社の製品に加え、xAIの「Grok Build」、Googleの「Antigravity」、Moonshot AIの「Kimi Code」の名前が挙がっている。

印刷する
SNSでシェア
SpecialPR

関連記事

こんなメディアも見られています

ITmedia AI+に関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。

メールマガジンを配信中
メールマガジンを配信中

国内外の業界動向、AIやクラウドなどの最新技術、キャリア情報など今知りたい情報をまとめてお届けします。

いますぐご登録

よく見られているカテゴリー

アクセスランキング

  1. 1
  2. 2
  3. 3
  4. 4
  5. 5
  6. 6
  7. 7
  8. 8
  9. 9
  10. 10

SpecialPR

ITmedia AI+ SNS

X @itm_aiplusをフォロー

インフォメーション

ITmedia AI+をフォロー

あなたにおすすめの記事PR