OpenAI、「ChatGPT Atlas」のインジェクション対策について説明 「完全に解決されることはまずない」
米OpenAIは12月22日(現地時間)、AI統合型Webブラウザ「ChatGPT Atlas」での「プロンプトインジェクション攻撃」対策について説明した。プロンプトインジェクションは長期的課題で、Web上の詐欺やソーシャルエンジニアリングが巧妙化し続けるのと同様に「完全に解決されることはまずない」としている。
ChatGPT Atlasは、10月に公開された、Webページを閲覧し、クリックやキーストロークなどをユーザーの代わりにブラウザ内で実行する「ブラウザエージェント」を中核とする機能で、同社は「これまでにリリースした中で最も汎用的なエージェント機能の1つ」と位置付けている。
プロンプトインジェクションは、エージェントが処理するコンテンツ内に悪意ある指示を埋め込み、ユーザーの意図ではなく攻撃者の意図に沿って行動を誘導する攻撃だ。OpenAIはその例として、未読メールの要約を依頼した際に、メール本文に仕込まれた指示をエージェントが取り込み、機密情報の転送など意図しない操作につながる可能性を挙げた。エージェントがブラウザ上で多様な操作を実行できること自体が、従来のWebセキュリティとは異なる攻撃面の拡大につながるとしている。
同社は対策として、強化学習で訓練したLLMベースの「自動攻撃者」による自動レッドチーミングを進め、実運用のエージェントに通用し得る新たな攻撃手法を内製で発見し、修正に結び付ける「迅速な対応ループ」を構築しているという。自動攻撃者が候補となる注入指示を提案し、外部シミュレーターで標的エージェントがそれに遭遇した場合の推論と行動のログを得て反復改良する仕組みも説明している。
OpenAIは、こうした取り組みの一環として、Atlasのブラウザエージェントに対し、敵対的学習を施した新しいモデルと周辺の防御策を含むセキュリティ更新を最近提供したとしている。更新の契機は、社内の自動レッドチーミングで見つかった新種のプロンプトインジェクション攻撃だったという。
プロンプトインジェクションは完全に解決されない可能性があると認めつつ、発見から修正までのサイクルを高速化し、現実世界でのリスクを継続的に下げる方針を示した。
ユーザー側での対策としては、必要がなければログアウト状態で使うことや、購入やメール送信などの重要な操作時の確認プロンプトを注意深く確認すること、曖昧で広範な指示を避けて具体的で範囲の狭い依頼にする、といった方法を推奨した。
Copyright © ITmedia, Inc. All Rights Reserved.
関連記事
こんなメディアも見られています
ITmedia NEWSに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
SpecialPR
本日の新着記事
アクセスランキング
-
1
なぜ酒蔵の許諾なしに? 「VTuberコラボ日本酒」騒動、主催者が経緯説明 仲介者による調整で「準備進んでいると認識」
-
2
かっぱ寿司「配布前のコラボグッズ、フリマで買わないで」 プリキュアコラボ発表日に注意喚起
-
3
「食事量は1日1200kcal以下、でも肥満」な人を14日間追跡調査 痩せない理由は……米コロンビア大などの研究
-
4
本物そっくり“AI生成レシート“が経費精算の脅威に マネフォ「自力で見破るのは難しい」 企業はどう備える?
-
5
「菜の花がおかしい」――イラストレーター制作うたうマラソン大会ポスターに指摘相次ぐ 事務局がAI使用明かす【訂正あり】
-
6
「ペンギンを返して」→「3匹全部採用して」 批判殺到のSuica新キャラ、ファンアートが空気を変えた? SNSの声
-
7
幻の「ちいかわ」コラボ第3弾皿、捨てちゃうの? くら寿司に聞いてみた
-
8
「iPhone Duo」純正ケース話題、「面白いけど高い」……1万4800円と2万4800円
-
9
藤井風のリサイタル、公式サイトがインターネット老人会すぎると話題 公民館のチラシみたいだけど東京ドーム開催
-
10
農水省の“クソダサ”ポスター話題 「AIよりよっぽど良い」の声も 担当者に狙いを聞いた
ITmedia NEWS SNS
インフォメーション
注目情報をチェック
ITmediaNEWSをフォロー
あなたにおすすめの記事PR