Nearly Minimax Optimal Reinforcement Learning for Discounted MDPs

Nearly Minimax Optimal Reinforcement Learning for Discounted MDPs
复制标题

贴现 MDP 的近极小极大最优强化学习

DOI:
--
复制
发表时间:
2021
期刊:
Advances in neural information processing systems
影响因子:
--
通讯作者:
Gu, Quanquan
Gu, Quanquan
中科院分区:
--
文献类型:
--
作者:
He, Jiafan;Zhou, Dongruo;Gu, Quanquan

文献摘要

参考文献

被引文献

相似文献

DOI: --
发表时间: 2020-04
期刊: ArXiv
影响因子: --
作者:
Zihan Zhang;Yuanshuo Zhou;Xiangyang Ji
通讯作者: Zihan Zhang;Yuanshuo Zhou;Xiangyang Ji
DOI: --
发表时间: 2020-06
期刊: ArXiv
影响因子: --
作者:
Kunhe Yang;Lin F. Yang;S. Du
通讯作者: Kunhe Yang;Lin F. Yang;S. Du
DOI: --
发表时间: 2019-01
期刊: ArXiv
影响因子: --
作者:
Kefan Dong;Yuanhao Wang;Xiaoyu Chen;Liwei Wang
通讯作者: Kefan Dong;Yuanhao Wang;Xiaoyu Chen;Liwei Wang
DOI: --
发表时间: 2020-06
期刊: --
影响因子: --
作者:
Dongruo Zhou;Jiafan He;Quanquan Gu
通讯作者: Dongruo Zhou;Jiafan He;Quanquan Gu
折扣 MDP 的 PAC 界限
DOI: --
发表时间: 2012
期刊: International Conference on Algorithmic Learning Theory
影响因子: --
作者:
Tor Lattimore;Marcus Hutter
通讯作者: Marcus Hutter