Distributionally Robust Policy Evaluation and Learning in Offline Contextual Bandits

Distributionally Robust Policy Evaluation and Learning in Offline Contextual Bandits
复制标题

离线上下文强盗中的分布式鲁棒策略评估和学习

DOI:
--
复制
发表时间:
2020
期刊:
Proceedings of Machine Learning Research
影响因子:
--
通讯作者:
Blanchet, Jose.
Blanchet, Jose.
中科院分区:
--
文献类型:
--
作者:
Si, Nian;Zhang, Fan;Zhou, Zhengyuan;Blanchet, Jose.

文献摘要

参考文献

被引文献

相似文献

(1) 制作学校午餐Champuru研究食谱,并将其应用于通过学校午餐进行饮食教育的实践,2013年4月1日《琉球新闻报》发表《冲绳社会面临的长寿崩溃15个挑战》
DOI: --
发表时间: --
期刊:
影响因子: --
作者:
通讯作者: --
DOI: 10.1016/j.orl.2018.01.011
发表时间: 2018-03
期刊: Oper. Res. Lett.
影响因子: --
作者:
Chaoyue Zhao;Yongpei Guan
通讯作者: Chaoyue Zhao;Yongpei Guan
DOI: --
发表时间: 2019
期刊: Neural Information Processing Systems
影响因子: --
作者:
Mert Demirer;Vasilis Syrgkanis;Greg Lewis;V. Chernozhukov
通讯作者: V. Chernozhukov
上下文强盗中的估计注意事项
DOI: --
发表时间: 2017
期刊: arXiv.org
影响因子: --
作者:
Maria Dimakopoulou;S. Athey;G. Imbens
通讯作者: G. Imbens
DOI: 10.1016/j.orl.2017.04.003
发表时间: 2016
期刊: Oper. Res. Lett.
影响因子: --
作者:
H. Lam;Enlu Zhou
通讯作者: Enlu Zhou