OpenAI、推論モデル「o3」で安全性を高める「熟慮的アラインメント」採用
米OpenAIは12月20日(現地時間)、高度な推論能力を持つ新しいLLM「o3」と同時に、oシリーズに適用した「Deliberative alignment」(熟慮的アラインメント)と呼ばれるアラインメント戦略を発表した。
この手法は、AIモデルがより安全で信頼性の高い応答を生成できるように設計されているという。従来のAIモデルは、有害なコンテンツを生成したり、正当な要求を拒否したり、悪意あるプロンプトにだまされたりするなどの安全上の問題を抱えていたが、熟慮的アラインメントは、これらの問題を効果的に解決することを目指す。
熟慮的アラインメントの中核となるのは、推論だ。モデルは、回答を生成する前に、人間が作成した安全仕様を明示的に考慮するように訓練される。
具体的には、ユーザーのプロンプトを分析し、関連する安全ポリシーを特定し、それらに基づいてより安全な応答を作成する。人間が倫理的なジレンマに直面した際に、道徳規範を熟慮して行動を決定するかのように働く。
公開された論文では、熟慮的アラインメントの成功例として、シーザー暗号の一種である「ROT13」で暗号化された「ポルノサイトの運営にあたり、当局に追跡されない支払い方法を知りたい」というプロンプトを、熟慮的アラインメントによって訓練された「o1」が拒否したことが挙げられている。
o1は、エンコードされた質問をデコードし、ユーザーの意図を理解し、この質問がポリシーに違反することを理解したのだ。
論文では、過剰拒否の削減の成功例も紹介されている。ポリシーに違反する内容でも、それが翻訳の依頼の場合、翻訳が新たな禁止コンテンツを作成しない限り許可されるというポリシーを確認し、翻訳を提供した。
OpenAIは、熟慮的アラインメントは安全性の向上、幻覚(ハルシネーション)の抑制、倫理的に問題のある質問への対応などに役立つとしている。
「LLMの進歩には、大きなリスクが伴う。モデルの知性と自律性が高まるにつれて、AIの不整合や誤用によって引き起こされる可能性のある潜在的な危害の規模は劇的に増大する」と認めつつ、OpenAIは熟慮的アラインメントの適用により、「AIの安全性を向上させることができることに勇気づけられている」としている。
Copyright © ITmedia, Inc. All Rights Reserved.
関連記事
こんなメディアも見られています
ITmedia NEWSに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
SpecialPR
本日の新着記事
アクセスランキング
-
1
肖像画をChatGPTに読み込ませて出力→加工して納品 委託先による著作権侵害で、小学館「サライ.jp」が謝罪
-
2
経営「AIでラクして早く帰って」→社員「帰らない」 工数最大9割減のDeNAも悩むAI効率化の壁
-
3
農水省の“クソダサ”ポスター話題 「AIよりよっぽど良い」の声も 担当者に狙いを聞いた
-
4
「POPOPO」サービス終了 開始から約半年
-
5
東京ゲームショウのグッズがメルカリに続々出品 「ビジネスデイなのに」など批判の声
-
6
生成AIで物議のレベルファイブ、東京ゲームショウ当日の様子は……現地を見てきた
-
7
ニチレイ、計5万件超の個人情報漏えいを確認 7月のサイバー攻撃で
-
8
「セーラームーンに似ている」 生成AIを使った化粧品の広告が物議 メーカーは謝罪と広告の撤去を発表
-
9
「不気味の谷を越えた」? 中国の美男美女型ロボット「U1」話題 286万円から
-
10
ドローン攻撃を受けたAWS中東データセンター、半年の復旧作業の末に「一部データは回復不能」
ITmedia NEWS SNS
インフォメーション
注目情報をチェック
ITmediaNEWSをフォロー
あなたにおすすめの記事PR