MythosとGPT-5.6 Solが性能テスト中に暴走 OSSメンテナーに圧力、有害コード実行図る 英政府機関
AIが人間に圧力をかけて有害コード実行を図る――英国政府の研究機関、AIセキュリティ研究所(AISI)は8月4日(現地時間)、AIモデルのサイバー攻撃能力を評価するテスト中に、AIエージェントが人や組織を標的とする想定外の行動を取っていたと発表した。大半は米Anthropicの「Claude Mythos 5」(以下、Mythos 5)、一部は米OpenAIの「GPT-5.6 Sol」(以下、5.6 Sol)によるものだった。
最も深刻な事例では、実在のオープンソースソフトウェア(OSS)プロジェクトに悪意あるコードを混入させて実行させようと、偽アカウントを複数作ってメンテナーに承認を迫った。なお、いずれの攻撃も失敗し被害は確認されていないという。
テストは模擬ネットワーク上でセキュリティ課題を解かせるもの。AIモデルの能力の上限を測るため、インターネット接続を許可し、開発元の悪用防止機能も無効化した状態で実施していた。
7モデルで計122回実行したうち10回で、範囲を逸脱した行動を計19件確認。17件がMythos 5、2件が5.6 Solによるものだった。
AISIは不審な通信の検知から約1時間で封じ込めたと説明。有害なコードの実行を促した事例ではメンテナーが見抜いて承認せず、実害はなかったという。AISIはGitHubと協力して痕跡を削除し、影響を受けたユーザーに通知した。
同機関は今回の事案が起きた原因として以下の4点を挙げている。
- エージェントが目標達成を粘り強く追求したこと
- 設定ミスにより解決不可能なタスクが発生し、AIの「創造的」な挙動を誘発したこと
- インターネットアクセスにより実際の人々を標的にすることを想定していなかったこと
- 危険な挙動を避けるような具体的な指示を与えていなかったこと
AISIは今回の件を「重大な事案」とし、「評価プロトコルとセキュリティアーキテクチャに恒久的な変更が必要である」と判断。評価時のネットワーク制御や監視を強化するとともに、AnthropicやOpenAIと調査を進めている。
Copyright © ITmedia, Inc. All Rights Reserved.
関連記事
こんなメディアも見られています
ITmedia AI+に関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
SpecialPR
アクセスランキング
-
1
「AI、結局使えないじゃん」問題 セールスフォースが431万件対応で導いた正解
-
2
PC操作を録画→「Copilot」で作業を代理可能に Microsoftがアプリを無料公開 主にmacOS向け、Windows対応も
-
3
ワークマン、実は画像生成AIを導入していた 間に合わない商品撮影を代替 アプリ通知開封も1.5倍
-
4
M365 Copilotのための「Teams活用術3選」 北大DX業務推進室が解説
-
5
農水省の“クソダサ”ポスター話題 「AIよりよっぽど良い」の声も 担当者に狙いを聞いた
-
6
Gemini“ヘビーユーザー”が1年で10倍に 「平均年齢高い、IT本業じゃない」首都高が実践したAI活用推進ノウハウ
-
7
エージェント型AIは「過度な期待」のピークへ ガートナー、日本におけるデジタルワークプレースのハイプサイクルを発表
-
8
「私がウダウダしゃべるより聞きやすい」 三菱重工、決算説明に“AIジュリア”起用の本音
-
9
「日本人が海外へ行けない」を打ち破る シンガポール発LCCが仕掛ける“逆張り戦略”
-
10
AIで"存在しない脆弱性"を量産? 「SQLite」の偽CVEが判明 米企業が検証
SpecialPR
ITmedia AI+ SNS
インフォメーション
注目情報をチェック
ITmedia AI+をフォロー
あなたにおすすめの記事PR