Innovative Tech
数回の練習が数千回分の効果にも──物事の上達スピードを決めるのは練習量より「報酬の大きさ」 マウス実験がScience誌掲載
Innovative Tech:
2019年にスタートした本連載「Innovative Tech」は、世界中の幅広い分野から最先端の研究論文を独自視点で厳選、解説する。執筆は研究論文メディア「Seamless」(シームレス)を主宰し、日課として数多くの論文に目を通す山下氏が担当。イラストや漫画は、同メディア所属のアーティスト・おね氏が手掛けている。X:@shiropen2
米ハワード・ヒューズ医学研究所に所属する研究者らがScience誌で発表した論文「Reward magnitude determines reinforcement learning efficiency」は、報酬の大きさが、学習速度の効率を高めることを明らかにした研究報告だ。
マウスを用いた実験において、従来の研究で使われていた標準的な量よりも大きな報酬を与えたところ、ナビゲーションや運動スキル、意思決定といった複雑な課題において、学習スピードが向上することが確認された。
通常であれば何百回、何千回という報酬経験が必要なタスクであっても、特大の報酬を与えられたマウスは、わずか数回の経験で学習を完了させることすらあった。しかも、最終的に到達する上手さは変わらなかった。速く上手くなるだけで、雑になったわけではなかった。
この学習効率の向上には、脳内の線条体におけるドーパミンの働きが深く関わっていた。大きな報酬を得ると、マウスの脳内ではドーパミンがより多く、そして長く持続して放出される。
事実、光遺伝学(オプトジェネティクス)を用いて、人工的にドーパミンの反応を持続させたところ、通常の小さな報酬しか与えていない場合でも、特大の報酬による学習促進効果の多くが再現された。
研究チームは、大きな報酬がもたらす学習の効率化は、単に理解するスピードが上がるからだけではないと分析している。大きな報酬は、前回のセッションからの学習内容をしっかりと引き継ぐ力や、タスクに途中で飽きずに取り組み続ける意欲を強く引き出していた。
Source and Image Credits: Sheng Gong et al. ,Reward magnitude determines reinforcement learning efficiency.Science392,eaeb0813(2026).DOI:10.1126/science.aeb0813
Copyright © ITmedia, Inc. All Rights Reserved.
Innovative Tech
2019年にスタートした本連載「Innovative Tech」は、世界中の幅広い分野から最先端の研究論文を独自視点で厳選、解説している。執筆は研究論文メディア「Seamless」(シームレス)を主宰し、日課として数多くの論文に目を通す山下氏が担当。イラストや漫画は、同メディア所属のアーティスト・おね氏が手掛けている。
この記事の著者
関連記事
こんなメディアも見られています
ITmedia NEWSに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
SpecialPR
本日の新着記事
アクセスランキング
-
1
プールにはおしっこが何リットル混じっている? 人工甘味料を基に計測 カナダチームが2017年に調査
-
2
「脳のゴミ掃除」を薬で活性化、東大と新潟大がマウスで実証 アルツハイマー病の原因を抑制、海馬の萎縮も阻止
-
3
「Backlogの値上げエグすぎ」SNSで悲鳴 ユーザー無制限プラン、月最低1.6万円→3.6万円に
-
4
103年前の関東大震災、どこがどれだけ揺れた? 市区町村別の「詳細震度」マップがXで話題に
-
5
「Twitter」が帰ってきた? 元Twitter法務のスタートアップが新SNS立ち上げ Xとは係争中
-
6
はてな、11億円流出の調査報告書を公開 偽警察、口外禁止、残業・休出200時間超、孤立……ほころびが連鎖
-
7
セブンに「セルフ発送機」 レジ経由せず、約10秒で荷物を発送
-
8
初の“指輪型たまごっち”の秘密、開発者に聞く 「驚きのあるデバイスを」「前面ボタンは飾りです」
-
9
“ドパガキ”がショート動画を止められない理由 fMRIを使って若者の脳活動を分析 中国チームが研究
-
10
中野の2億円腕時計窃盗、犯人はLUUPで逃走か 追跡可否を同社に聞いた
ITmedia NEWS SNS
インフォメーション
注目情報をチェック
ITmediaNEWSをフォロー
あなたにおすすめの記事PR