Intentional Underestimation at Terminal State in Reinforcement Learning
Intentional Underestimation at Terminal State in Reinforcement Learning
复制标题
强化学习中终端状态的故意低估
DOI:
--
复制
发表时间:
2022
期刊:
影响因子:
--
通讯作者:
Taisuke Kobayashi
中科院分区:
文献类型:
--
作者:
東野 光宇太;岡村 直樹;笹山 瑛由;吉田 敬;Taisuke Kobayashi
登录
查看更多内容
DOI:
--
发表时间:
2023
期刊:
影响因子:
--
作者:
Inoue Manabu;Yoshimoto Takeshi;Tanaka Kanta;Koge Junpei;Shiozawa Masayuki;Nishii Tatsuya;Ohta Yasutoshi;Fukuda Tetsuya;Satow Tetsu;Kataoka Hiroharu;Yamagami Hiroshi;Ihara Masafumi;Koga Masatoshi;Mlynash Michael;Albers Gregory W.;Toyoda Kazunori;正木達也・北畠直人・飛塚丈輝・花崎和寿・張 維倫・永岡 隆
通讯作者:
正木達也・北畠直人・飛塚丈輝・花崎和寿・張 維倫・永岡 隆
DOI:
--
发表时间:
2020-07
期刊:
ArXiv
影响因子:
--
作者:
Nino Vieillard;O. Pietquin;M. Geist
通讯作者:
Nino Vieillard;O. Pietquin;M. Geist
影响因子:
4.3
作者:
Tsurumine, Yoshihisa;Cui, Yunduan;Matsubara, Takamitsu
通讯作者:
Matsubara, Takamitsu
影响因子:
4.6
作者:
通讯作者:
--