Hyperbolically-Discounted Reinforcement Learning on Reward-Punishment Framework
Hyperbolically-Discounted Reinforcement Learning on Reward-Punishment Framework
复制标题
奖惩框架上的双曲贴现强化学习
DOI:
--
复制
发表时间:
2019
期刊:
影响因子:
--
通讯作者:
Taisuke Kobayashi
中科院分区:
文献类型:
--
作者:
Kenji Sugimoto;Wataru Imahayashi;and Ryo Arimoto;花田研太;有元遼,今林亘,杉本謙二;有元 遼,今林 亘,杉本 謙二;牧泰宏,今林 亘,杉本 謙二;Taisuke Kobayashi