Proximal Reinforcement Learning: Efficient Off-Policy Evaluation in Partially Observed Markov Decision Processes

Proximal Reinforcement Learning: Efficient Off-Policy Evaluation in Partially Observed Markov Decision Processes
复制标题

近端强化学习:部分观察马尔可夫决策过程中的高效离策略评估

DOI:
10.1287/opre.2021.0781
复制
发表时间:
2023
影响因子:
2.7
通讯作者:
Kallus, Nathan
Kallus, Nathan
中科院分区:
管理学3区
文献类型:
--
作者:
Bennett, Andrew;Kallus, Nathan

文献摘要

参考文献

被引文献

相似文献

DOI: --
发表时间: 2018
期刊:
影响因子: --
作者:
Wang Miao;E. Tchetgen
通讯作者: E. Tchetgen
无限视野强化学习中的混杂鲁棒策略评估
DOI: --
发表时间: 2020
期刊: Advances in neural information processing systems
影响因子: --
作者:
Kallus, Nathan;Zhou, Angela
通讯作者: Zhou, Angela
DOI: 10.1093/jrsssb/qkad011
发表时间: 2021-04
期刊: ArXiv
影响因子: --
作者:
Shuxiao Chen;B. Zhang
通讯作者: Shuxiao Chen;B. Zhang
DOI: 10.1016/j.jeconom.2009.02.002
发表时间: 2009-09-01
影响因子: 6.3
作者:
Chen, Xiaohong;Pouzo, Demian
通讯作者: Pouzo, Demian
用未衡量的混杂因素的代理变量识别因果效应。
DOI: 10.1093/biomet/asy038
发表时间: 2018-12
期刊: Biometrika
影响因子: 2.7
作者:
Miao W;Geng Z;Tchetgen Tchetgen E
通讯作者: Tchetgen Tchetgen E