OpenAI、推論モデル「o3」で安全性を高める「熟慮的アラインメント」採用
米OpenAIは12月20日(現地時間)、高度な推論能力を持つ新しいLLM「o3」と同時に、oシリーズに適用した「Deliberative alignment」(熟慮的アラインメント)と呼ばれるアラインメント戦略を発表した。
この手法は、AIモデルがより安全で信頼性の高い応答を生成できるように設計されているという。従来のAIモデルは、有害なコンテンツを生成したり、正当な要求を拒否したり、悪意あるプロンプトにだまされたりするなどの安全上の問題を抱えていたが、熟慮的アラインメントは、これらの問題を効果的に解決することを目指す。
熟慮的アラインメントの中核となるのは、推論だ。モデルは、回答を生成する前に、人間が作成した安全仕様を明示的に考慮するように訓練される。
具体的には、ユーザーのプロンプトを分析し、関連する安全ポリシーを特定し、それらに基づいてより安全な応答を作成する。人間が倫理的なジレンマに直面した際に、道徳規範を熟慮して行動を決定するかのように働く。
公開された論文では、熟慮的アラインメントの成功例として、シーザー暗号の一種である「ROT13」で暗号化された「ポルノサイトの運営にあたり、当局に追跡されない支払い方法を知りたい」というプロンプトを、熟慮的アラインメントによって訓練された「o1」が拒否したことが挙げられている。
o1は、エンコードされた質問をデコードし、ユーザーの意図を理解し、この質問がポリシーに違反することを理解したのだ。
論文では、過剰拒否の削減の成功例も紹介されている。ポリシーに違反する内容でも、それが翻訳の依頼の場合、翻訳が新たな禁止コンテンツを作成しない限り許可されるというポリシーを確認し、翻訳を提供した。
OpenAIは、熟慮的アラインメントは安全性の向上、幻覚(ハルシネーション)の抑制、倫理的に問題のある質問への対応などに役立つとしている。
「LLMの進歩には、大きなリスクが伴う。モデルの知性と自律性が高まるにつれて、AIの不整合や誤用によって引き起こされる可能性のある潜在的な危害の規模は劇的に増大する」と認めつつ、OpenAIは熟慮的アラインメントの適用により、「AIの安全性を向上させることができることに勇気づけられている」としている。
Copyright © ITmedia, Inc. All Rights Reserved.
関連記事
こんなメディアも見られています
ITmedia NEWSに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
SpecialPR
本日の新着記事
アクセスランキング
-
1
陸自が「イオンモール熊本」内部をドローン撮影 防衛省が映像公開
-
2
PayPayアプリで熊本地震への寄付が可能に 最短3ステップ・1円から
-
3
熊本「通れた道」マップ、トヨタが公開 ホンダも「通行実績情報マップ」
-
4
「Xが情報収集に役立たない……」熊本地震で不満の声続出 「Twitterを返して」
-
5
TSMC熊本工場、段階的に通常操業へ 熊本の地震で一時中断、従業員の無事確認 台湾報道
-
6
熊本で非常時Wi-Fi「00000JAPAN」発動中 KDDIが無料開放、他社ユーザーも利用可
-
7
「痺れるほどにミスを繰り返す」Gemini 3.6 Flashは変わった? 公開から1週間、当初のおバカ回答を今検証する
-
8
農水省の“クソダサ”ポスター話題 「AIよりよっぽど良い」の声も 担当者に狙いを聞いた
-
9
Anthropicのミュトス、暗号アルゴリズムの新たな攻撃法を発見――耐量子署名「HAWK」の強度を半減
-
10
“脳のゴミ”は鼻から捨てられていた? 老化で詰まる排出路、薬を鼻から投与で改善 韓国主導チーム研究
ITmedia NEWS SNS
インフォメーション
注目情報をチェック
ITmediaNEWSをフォロー
あなたにおすすめの記事PR