Intrinsically Efficient, Stable, and Bounded Off-Policy Evaluation for Reinforcement Learning

Intrinsically Efficient, Stable, and Bounded Off-Policy Evaluation for Reinforcement Learning
复制标题

本质上高效、稳定且有界的强化学习离策略评估

DOI:
--
复制
发表时间:
2019
期刊:
Advances in neural information processing systems
影响因子:
--
通讯作者:
Uehara, Masatoshi
Uehara, Masatoshi
中科院分区:
--
文献类型:
--
作者:
Kallus, Nathan;Uehara, Masatoshi

文献摘要

参考文献

被引文献

相似文献

DOI: 10.1073/pnas.1119407109
发表时间: 2012-05-15
影响因子: 11.1
作者:
Bowsher, Clive G.;Swain, Peter S.
通讯作者: Swain, Peter S.
平衡的政策评估和学习
DOI: --
发表时间: 2018
期刊: Advances in neural information processing systems
影响因子: --
作者:
Kallus, Nathan
通讯作者: Kallus, Nathan
DOI: 10.1214/07-sts227b
发表时间: 2007-01-01
期刊: Statistical science : a review journal of the Institute of Mathematical Statistics
影响因子: --
作者:
Tsiatis, Anastasios A;Davidian, Marie
通讯作者: Davidian, Marie
通过最佳平衡进行潜在混杂因素的政策评估
DOI: --
发表时间: 2019
期刊: Advances in neural information processing systems
影响因子: --
作者:
Bennett, Andrew;Kallus, Nathan
通讯作者: Kallus, Nathan