MISC

2021年3月4日

非対称学習率による報酬確率分布の弁別性向上

第83回全国大会講演論文集
  • 佐鳥, 玖仁朗
  • ,
  • 吉田, 豊
  • ,
  • 神谷, 匠
  • ,
  • 太田, 宏之
  • ,
  • 高橋, 達二

2021
1
開始ページ
371
終了ページ
372
記述言語
日本語
掲載種別

動物は探索行動の際,良い結果予測に対する悪い結果(負),悪い結果予測に対する良い結果(正)に関して非対称に学習を行うことが示唆されている.この非対称な学習の効用を明らかにするため,バンディットタスクにおける各選択肢の報酬確率密度の分散と平均に差がある場合における,正と負の学習率比と報酬獲得量の関係を調べた.その結果,各選択肢の報酬確率密度の平均が近接しつつも分散が異なる場合,学習率比の増減が平均の差に対する価値評価の差を拡大・縮小させることを見出した.本結果は,複数の報酬確率密度に対する非線形識別関数の導入に向けた検討の土台を提供するものと考えられる.

リンク情報
CiNii Books
http://ci.nii.ac.jp/ncid/AN00349328
CiNii Research
https://cir.nii.ac.jp/crid/1050855522046235136?lang=ja
URL
http://id.nii.ac.jp/1001/00214879/
ID情報
  • CiNii Articles ID : 170000187069
  • CiNii Books ID : AN00349328
  • CiNii Research ID : 1050855522046235136

エクスポート
BibTeX RIS