Intrinsically Efficient, Stable, and Bounded Off-Policy Evaluation for Reinforcement Learning
Intrinsically Efficient, Stable, and Bounded Off-Policy Evaluation for Reinforcement Learning
复制标题
本质上高效、稳定且有界的强化学习离策略评估
DOI:
--
复制
发表时间:
2019
期刊:
影响因子:
--
通讯作者:
Uehara, Masatoshi
中科院分区:
文献类型:
--
作者:
Kallus, Nathan;Uehara, Masatoshi
登录
查看更多内容
DOI:
10.1073/pnas.1119407109
发表时间:
2012-05-15
影响因子:
11.1
作者:
Bowsher, Clive G.;Swain, Peter S.
通讯作者:
Swain, Peter S.
DOI:
--
发表时间:
2018
期刊:
Advances in neural information processing systems
影响因子:
--
作者:
Kallus, Nathan
通讯作者:
Kallus, Nathan
DOI:
10.1214/07-sts227b
发表时间:
2007-01-01
期刊:
Statistical science : a review journal of the Institute of Mathematical Statistics
影响因子:
--
作者:
Tsiatis, Anastasios A;Davidian, Marie
通讯作者:
Davidian, Marie
DOI:
--
发表时间:
2019
期刊:
Advances in neural information processing systems
影响因子:
--
作者:
Bennett, Andrew;Kallus, Nathan
通讯作者:
Kallus, Nathan