OpenAI、豪政府サイトへの不正アクセスで謝罪 最先端AI学習の安全指針も公開

 米OpenAIは9月28日(現地時間)、社内で学習・評価中だったAIモデルがオーストラリア政府のWebサイトに権限なくアクセスしていた問題について、「対応を改善すべきだった。申し訳なく思っている」と謝罪した。被害を受けた政府機関への通知が遅れたことも認め、フロンティアAIの学習を実施する前に安全性を体系的に検証する新たな仕組みの導入を進めると発表した。

 この問題は、オーストラリアのアンソニー・アルバニージー首相が24日の記者会見で明らかにしていた。OpenAIから政府への通知は発生から約3カ月後で、首相は「失望した」と述べていた。

 問題は6月、OpenAIが一般公開を予定していない実験モデルを社内で学習・評価していた際に発生した。OpenAIがこの問題を把握したのは、7月に発覚したHugging Faceへの侵害インシデントについての調査中の8月中旬だった。オーストラリア政府への通知は9月10日のことだった。

 OpenAIは「調査完了を待つのではなく、暫定的な調査結果をもっと早く共有し、その後も情報を更新すべきだった」と対応の遅れを認めた。

 OpenAIはHugging Faceのインシデント以降、研究環境からインターネットへの直接アクセスを遮断し、キャッシュしたWebコンテンツ経由にするなどネットワーク制限を強化。監視システムも拡充した。最も高性能なモデルについては、ツール使用を伴う学習と評価を一時停止しており、追加の安全策に確信を持てるまで再開しないとしている。

 さらに同日、フロンティアAIの強化学習を始める前に、安全性に関する構造化された文書を作成する方針を発表した。航空や原子力など安全性が重視される分野で使われる「safety case」(安全性を裏付ける証拠に基づく体系的な論証)を将来的な目標に据える。

(画像:OpenAI)

 具体的には、モデルのアラインメント、サンドボックスなどによる封じ込め、リアルタイム監視の3分野について安全策を検証する。学習環境の不備を突いた不正な報酬獲得を防ぐデータセット検査、サンドボックスからの脱出を想定したレッドチーミング、異常を検出した場合の自動的な学習停止などを挙げている。安全性文書については、複数の上級幹部がレビューし、それぞれが学習の実施を拒否できる仕組みも想定する。

 オーストラリアでは、影響を受けた政府機関への技術支援のほか、AIエージェントによるリスクへの対応策を検討する独立した専門家を交えたタスクフォースを設置する。OpenAIのジェイソン・クォンCSO(最高戦略責任者)は10月6日、シドニーで開かれるオーストラリア議会のAIに関する合同特別委員会に出席し、一連の問題について説明する予定だ。

 OpenAIは翌29日にサンフランシスコで開催した年次開発者会議「DevDay 2026」では、この問題には直接言及しなかった。

印刷する
SNSでシェア
SpecialPR

関連記事

こんなメディアも見られています

ITmedia NEWSに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。

メールマガジンを配信中
メールマガジンを配信中

国内外の業界動向、AIやクラウドなどの最新技術、キャリア情報など今知りたい情報をまとめてお届けします。

いますぐご登録

本日の新着記事

アクセスランキング

  1. 1
  2. 2
  3. 3
  4. 4
  5. 5
  6. 6
  7. 7
  8. 8
  9. 9
  10. 10

ITmedia NEWS SNS

X @itmedia_newsをフォロー

インフォメーション

ITmediaNEWSをフォロー

あなたにおすすめの記事PR