Innovative Tech
数回の練習が数千回分の効果にも──物事の上達スピードを決めるのは練習量より「報酬の大きさ」 マウス実験がScience誌掲載
Innovative Tech:
2019年にスタートした本連載「Innovative Tech」は、世界中の幅広い分野から最先端の研究論文を独自視点で厳選、解説する。執筆は研究論文メディア「Seamless」(シームレス)を主宰し、日課として数多くの論文に目を通す山下氏が担当。イラストや漫画は、同メディア所属のアーティスト・おね氏が手掛けている。X:@shiropen2
米ハワード・ヒューズ医学研究所に所属する研究者らがScience誌で発表した論文「Reward magnitude determines reinforcement learning efficiency」は、報酬の大きさが、学習速度の効率を高めることを明らかにした研究報告だ。
マウスを用いた実験において、従来の研究で使われていた標準的な量よりも大きな報酬を与えたところ、ナビゲーションや運動スキル、意思決定といった複雑な課題において、学習スピードが向上することが確認された。
通常であれば何百回、何千回という報酬経験が必要なタスクであっても、特大の報酬を与えられたマウスは、わずか数回の経験で学習を完了させることすらあった。しかも、最終的に到達する上手さは変わらなかった。速く上手くなるだけで、雑になったわけではなかった。
この学習効率の向上には、脳内の線条体におけるドーパミンの働きが深く関わっていた。大きな報酬を得ると、マウスの脳内ではドーパミンがより多く、そして長く持続して放出される。
事実、光遺伝学(オプトジェネティクス)を用いて、人工的にドーパミンの反応を持続させたところ、通常の小さな報酬しか与えていない場合でも、特大の報酬による学習促進効果の多くが再現された。
研究チームは、大きな報酬がもたらす学習の効率化は、単に理解するスピードが上がるからだけではないと分析している。大きな報酬は、前回のセッションからの学習内容をしっかりと引き継ぐ力や、タスクに途中で飽きずに取り組み続ける意欲を強く引き出していた。
Source and Image Credits: Sheng Gong et al. ,Reward magnitude determines reinforcement learning efficiency.Science392,eaeb0813(2026).DOI:10.1126/science.aeb0813
Copyright © ITmedia, Inc. All Rights Reserved.
この記事の著者
関連記事
こんなメディアも見られています
ITmedia NEWSに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
SpecialPR
本日の新着記事
アクセスランキング
-
1
メルカリ、梨の転売疑惑に「盗品の出品は確認されず」 誹謗中傷には利用制限も
-
2
Anthropic、「Claude Opus 5」公開 Fable 5に迫る性能を半額で――サイバー安全策は緩和、拒否時は自動フォールバックも
-
3
「iPhone高騰」はこれからも続く? 中国CXMTに近づくApple、メモリ競合へのけん制が不発に終わりそうなワケ【後編】
-
4
「ニューロマンサー」実写ドラマ、Apple TV+で2027年1月配信開始へ
-
5
「こんなのに追われたら……」急斜面もやすやす爆走、中国製の車輪付き四足ロボのデモ動画が話題 最高時速20km超
-
6
検索結果に「詐欺ではありません」と表示させる詐欺手口、警視庁が注意喚起 AI要約も餌食に
-
7
海外の新作バカゲー「電車アタック」にマンガ家が感心した理由 ブッ飛んだ内容と完成度の高さ、そして“日本”
-
8
「めっちゃカメレオン」公式Discord乗っ取り 担当者PCがマルウェア感染、管理者が全員BANに 現在は復旧
-
9
暑さ対策が熱い! 「猛暑対策展」で感じた、転んでもただでは起き上がらない日本人のエネルギー
-
10
スーパーに並んだ「ごちゃごちゃ生成AIポップ」が物議 “看板王”こと、きぬた歯科院長「これはアリ」
ITmedia NEWS SNS
インフォメーション
注目情報をチェック
ITmediaNEWSをフォロー
あなたにおすすめの記事PR