Distributionally Robust Policy Evaluation and Learning in Offline Contextual Bandits
Distributionally Robust Policy Evaluation and Learning in Offline Contextual Bandits
复制标题
离线上下文强盗中的分布式鲁棒策略评估和学习
DOI:
--
复制
发表时间:
2020
期刊:
影响因子:
--
通讯作者:
Blanchet, Jose.
中科院分区:
文献类型:
--
作者:
Si, Nian;Zhang, Fan;Zhou, Zhengyuan;Blanchet, Jose.
登录
查看更多内容
DOI:
--
发表时间:
--
期刊:
影响因子:
--
作者:
通讯作者:
--
DOI:
10.1016/j.orl.2018.01.011
发表时间:
2018-03
期刊:
Oper. Res. Lett.
影响因子:
--
作者:
Chaoyue Zhao;Yongpei Guan
通讯作者:
Chaoyue Zhao;Yongpei Guan
DOI:
--
发表时间:
2019
期刊:
Neural Information Processing Systems
影响因子:
--
作者:
Mert Demirer;Vasilis Syrgkanis;Greg Lewis;V. Chernozhukov
通讯作者:
V. Chernozhukov
DOI:
--
发表时间:
2017
期刊:
arXiv.org
影响因子:
--
作者:
Maria Dimakopoulou;S. Athey;G. Imbens
通讯作者:
G. Imbens
DOI:
10.1016/j.orl.2017.04.003
发表时间:
2016
期刊:
Oper. Res. Lett.
影响因子:
--
作者:
H. Lam;Enlu Zhou
通讯作者:
Enlu Zhou