Stochastic Multi-Player Bandit Learning from Player-Dependent Feedback
Stochastic Multi-Player Bandit Learning from Player-Dependent Feedback
复制标题
随机多人强盗从玩家相关的反馈中学习
DOI:
--
复制
发表时间:
2020
期刊:
影响因子:
--
通讯作者:
Chaudhuri, K.
中科院分区:
文献类型:
--
作者:
Wang, Z.;Singh, M.K.;Zhang, C.;Riek, L.D.;Chaudhuri, K.
登录
查看更多内容
DOI:
10.1109/milcom.2017.8170860
发表时间:
2017
期刊:
MILCOM 2017 - 2017 IEEE Military Communications Conference (MILCOM)
影响因子:
--
作者:
Xiao Xu;Sattar Vakili;Qing Zhao;A. Swami
通讯作者:
A. Swami
DOI:
--
发表时间:
2020
期刊:
arXiv.org
影响因子:
--
作者:
Nihal Sharma;S. Basu;Karthikeyan Shanmugam;S. Shakkottai
通讯作者:
S. Shakkottai
影响因子:
3.8
作者:
Zhenyu Zhu;Liusheng Huang;Hongli Xu
通讯作者:
Hongli Xu
DOI:
--
发表时间:
2012
期刊:
International Conference on Artificial Intelligence and Statistics
影响因子:
--
作者:
Pannagadatta K. Shivaswamy;T. Joachims
通讯作者:
T. Joachims
DOI:
--
发表时间:
2018
期刊:
Machine Learning in Health Care
影响因子:
--
作者:
Bryce Woodworth;Francesco Ferrari;Teofilo E. Zosa;L. Riek
通讯作者:
L. Riek