Innovative Tech
数回の練習が数千回分の効果にも──物事の上達スピードを決めるのは練習量より「報酬の大きさ」 マウス実験がScience誌掲載
Innovative Tech:
2019年にスタートした本連載「Innovative Tech」は、世界中の幅広い分野から最先端の研究論文を独自視点で厳選、解説する。執筆は研究論文メディア「Seamless」(シームレス)を主宰し、日課として数多くの論文に目を通す山下氏が担当。イラストや漫画は、同メディア所属のアーティスト・おね氏が手掛けている。X:@shiropen2
米ハワード・ヒューズ医学研究所に所属する研究者らがScience誌で発表した論文「Reward magnitude determines reinforcement learning efficiency」は、報酬の大きさが、学習速度の効率を高めることを明らかにした研究報告だ。
マウスを用いた実験において、従来の研究で使われていた標準的な量よりも大きな報酬を与えたところ、ナビゲーションや運動スキル、意思決定といった複雑な課題において、学習スピードが向上することが確認された。
通常であれば何百回、何千回という報酬経験が必要なタスクであっても、特大の報酬を与えられたマウスは、わずか数回の経験で学習を完了させることすらあった。しかも、最終的に到達する上手さは変わらなかった。速く上手くなるだけで、雑になったわけではなかった。
この学習効率の向上には、脳内の線条体におけるドーパミンの働きが深く関わっていた。大きな報酬を得ると、マウスの脳内ではドーパミンがより多く、そして長く持続して放出される。
事実、光遺伝学(オプトジェネティクス)を用いて、人工的にドーパミンの反応を持続させたところ、通常の小さな報酬しか与えていない場合でも、特大の報酬による学習促進効果の多くが再現された。
研究チームは、大きな報酬がもたらす学習の効率化は、単に理解するスピードが上がるからだけではないと分析している。大きな報酬は、前回のセッションからの学習内容をしっかりと引き継ぐ力や、タスクに途中で飽きずに取り組み続ける意欲を強く引き出していた。
Source and Image Credits: Sheng Gong et al. ,Reward magnitude determines reinforcement learning efficiency.Science392,eaeb0813(2026).DOI:10.1126/science.aeb0813
Copyright © ITmedia, Inc. All Rights Reserved.
Innovative Tech
2019年にスタートした本連載「Innovative Tech」は、世界中の幅広い分野から最先端の研究論文を独自視点で厳選、解説している。執筆は研究論文メディア「Seamless」(シームレス)を主宰し、日課として数多くの論文に目を通す山下氏が担当。イラストや漫画は、同メディア所属のアーティスト・おね氏が手掛けている。
この記事の著者
関連記事
こんなメディアも見られています
ITmedia NEWSに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
SpecialPR
本日の新着記事
アクセスランキング
-
1
なぜ酒蔵の許諾なしに? 「VTuberコラボ日本酒」騒動、主催者が経緯説明 仲介者による調整で「準備進んでいると認識」
-
2
かっぱ寿司「配布前のコラボグッズ、フリマで買わないで」 プリキュアコラボ発表日に注意喚起
-
3
「食事量は1日1200kcal以下、でも肥満」な人を14日間追跡調査 痩せない理由は……米コロンビア大などの研究
-
4
本物そっくり“AI生成レシート“が経費精算の脅威に マネフォ「自力で見破るのは難しい」 企業はどう備える?
-
5
「菜の花がおかしい」――イラストレーター制作うたうマラソン大会ポスターに指摘相次ぐ 事務局がAI使用明かす【訂正あり】
-
6
「ペンギンを返して」→「3匹全部採用して」 批判殺到のSuica新キャラ、ファンアートが空気を変えた? SNSの声
-
7
藤井風のリサイタル、公式サイトがインターネット老人会すぎると話題 公民館のチラシみたいだけど東京ドーム開催
-
8
幻の「ちいかわ」コラボ第3弾皿、捨てちゃうの? くら寿司に聞いてみた
-
9
早すぎる 「めっちゃカメレオン」Switch 2版、即日10万本突破
-
10
デジタル庁に不正アクセス、個人情報24.6万件漏えいか 各府省庁の職員情報など
ITmedia NEWS SNS
インフォメーション
注目情報をチェック
ITmediaNEWSをフォロー
あなたにおすすめの記事PR