Nearly Minimax Optimal Reinforcement Learning for Discounted MDPs
Nearly Minimax Optimal Reinforcement Learning for Discounted MDPs
复制标题
贴现 MDP 的近极小极大最优强化学习
DOI:
--
复制
发表时间:
2021
期刊:
影响因子:
--
通讯作者:
Gu, Quanquan
中科院分区:
文献类型:
--
作者:
He, Jiafan;Zhou, Dongruo;Gu, Quanquan
登录
查看更多内容
DOI:
--
发表时间:
2020-04
期刊:
ArXiv
影响因子:
--
作者:
Zihan Zhang;Yuanshuo Zhou;Xiangyang Ji
通讯作者:
Zihan Zhang;Yuanshuo Zhou;Xiangyang Ji
DOI:
--
发表时间:
2020-06
期刊:
ArXiv
影响因子:
--
作者:
Kunhe Yang;Lin F. Yang;S. Du
通讯作者:
Kunhe Yang;Lin F. Yang;S. Du
DOI:
--
发表时间:
2019-01
期刊:
ArXiv
影响因子:
--
作者:
Kefan Dong;Yuanhao Wang;Xiaoyu Chen;Liwei Wang
通讯作者:
Kefan Dong;Yuanhao Wang;Xiaoyu Chen;Liwei Wang
DOI:
--
发表时间:
2020-06
期刊:
--
影响因子:
--
作者:
Dongruo Zhou;Jiafan He;Quanquan Gu
通讯作者:
Dongruo Zhou;Jiafan He;Quanquan Gu
DOI:
--
发表时间:
2012
期刊:
International Conference on Algorithmic Learning Theory
影响因子:
--
作者:
Tor Lattimore;Marcus Hutter
通讯作者:
Marcus Hutter