Proximal Reinforcement Learning: Efficient Off-Policy Evaluation in Partially Observed Markov Decision Processes
Proximal Reinforcement Learning: Efficient Off-Policy Evaluation in Partially Observed Markov Decision Processes
复制标题
近端强化学习:部分观察马尔可夫决策过程中的高效离策略评估
DOI:
10.1287/opre.2021.0781
复制
发表时间:
2023
影响因子:
2.7
通讯作者:
Kallus, Nathan
中科院分区:
文献类型:
--
作者:
Bennett, Andrew;Kallus, Nathan
登录
查看更多内容
DOI:
--
发表时间:
2018
期刊:
影响因子:
--
作者:
Wang Miao;E. Tchetgen
通讯作者:
E. Tchetgen
DOI:
--
发表时间:
2020
期刊:
Advances in neural information processing systems
影响因子:
--
作者:
Kallus, Nathan;Zhou, Angela
通讯作者:
Zhou, Angela
DOI:
10.1093/jrsssb/qkad011
发表时间:
2021-04
期刊:
ArXiv
影响因子:
--
作者:
Shuxiao Chen;B. Zhang
通讯作者:
Shuxiao Chen;B. Zhang
影响因子:
6.3
作者:
Chen, Xiaohong;Pouzo, Demian
通讯作者:
Pouzo, Demian
影响因子:
2.7
作者:
Miao W;Geng Z;Tchetgen Tchetgen E
通讯作者:
Tchetgen Tchetgen E