Stochastic Multi-Player Bandit Learning from Player-Dependent Feedback

Stochastic Multi-Player Bandit Learning from Player-Dependent Feedback
复制标题

随机多人强盗从玩家相关的反馈中学习

DOI:
--
复制
发表时间:
2020
期刊:
ICML Workshop on Real World Experiment Design and Active Learning
影响因子:
--
通讯作者:
Chaudhuri, K.
Chaudhuri, K.
中科院分区:
--
文献类型:
--
作者:
Wang, Z.;Singh, M.K.;Zhang, C.;Riek, L.D.;Chaudhuri, K.

文献摘要

参考文献

被引文献

相似文献

在线学习附带辅助信息
DOI: 10.1109/milcom.2017.8170860
发表时间: 2017
期刊: MILCOM 2017 - 2017 IEEE Military Communications Conference (MILCOM)
影响因子: --
作者:
Xiao Xu;Sattar Vakili;Qing Zhao;A. Swami
通讯作者: A. Swami
热启动强盗与来自混杂数据的辅助信息
DOI: --
发表时间: 2020
期刊: arXiv.org
影响因子: --
作者:
Nihal Sharma;S. Basu;Karthikeyan Shanmugam;S. Shakkottai
通讯作者: S. Shakkottai
协作汤普森采样
DOI: 10.1007/s11036-019-01453-x
发表时间: 2018
影响因子: 3.8
作者:
Zhenyu Zhu;Liusheng Huang;Hongli Xu
通讯作者: Hongli Xu
历史上的多臂强盗问题
DOI: --
发表时间: 2012
期刊: International Conference on Artificial Intelligence and Statistics
影响因子: --
作者:
Pannagadatta K. Shivaswamy;T. Joachims
通讯作者: T. Joachims
DOI: --
发表时间: 2018
期刊: Machine Learning in Health Care
影响因子: --
作者:
Bryce Woodworth;Francesco Ferrari;Teofilo E. Zosa;L. Riek
通讯作者: L. Riek