Corralling Stochastic Bandit Algorithms

Corralling Stochastic Bandit Algorithms
复制标题

圈养随机强盗算法

DOI:
--
复制
发表时间:
2021
期刊:
Proceedings of Machine Learning Research
影响因子:
--
通讯作者:
Mohri, Mehryar
Mohri, Mehryar
中科院分区:
--
文献类型:
--
作者:
Arora, Raman;Vanislavov, Teodor Marinov;Mohri, Mehryar

文献摘要

参考文献

被引文献

相似文献

DOI: --
发表时间: --
期刊: --
影响因子: --
作者:
通讯作者: --
OSOM:多臂和线性上下文强盗的同时最优算法
DOI: --
发表时间: 2019
期刊: International Conference on Artificial Intelligence and Statistics
影响因子: --
作者:
Niladri S. Chatterji;Vidya Muthukumar;P. Bartlett
通讯作者: P. Bartlett
具有对抗性奖励和强盗反馈的确定性 MDP
DOI: --
发表时间: 2012
期刊: Conference on Uncertainty in Artificial Intelligence
影响因子: --
作者:
R. Arora;O. Dekel;Ambuj Tewari
通讯作者: Ambuj Tewari