Bandit Algorithms Based on Thompson Sampling for Bounded Reward Distributions
Bandit Algorithms Based on Thompson Sampling for Bounded Reward Distributions
复制标题
基于汤普森采样的有界奖励分布的强盗算法
DOI:
--
复制
发表时间:
2019
期刊:
影响因子:
--
通讯作者:
Junya Honda
中科院分区:
文献类型:
--
作者:
Charles Riou;Junya Honda
影响因子:
6
作者:
J. Honda;A. Takemura
通讯作者:
A. Takemura
DOI:
--
发表时间:
1996
期刊:
影响因子:
--
作者:
A. Burnetas;M. Katehakis
通讯作者:
M. Katehakis