Adversarially Robust Multi-Armed Bandit Algorithm with Variance-Dependent Regret Bounds

Adversarially Robust Multi-Armed Bandit Algorithm with Variance-Dependent Regret Bounds
复制标题

具有方差相关遗憾界限的对抗性鲁棒多臂老虎机算法

DOI:
--
复制
发表时间:
2022
期刊:
Proceedings of The 35th Annual Conference on Learning Theory (COLT2022)
影响因子:
--
通讯作者:
Junya Honda
Junya Honda
中科院分区:
--
文献类型:
--
作者:
Shinji Ito;Taira Tsuchiya;Junya Honda

文献摘要

参考文献

被引文献

相似文献

追随线性预测中的领先者和快速率:曲线约束集和其他规律
DOI: --
发表时间: 2016
期刊: ArXiv
影响因子: --
作者:
Ruitong Huang;Tor Lattimore;A. György;Csaba Szepesvari
通讯作者: Csaba Szepesvari
DOI: --
发表时间: 2012-08
期刊: ArXiv
影响因子: --
作者:
A. Rakhlin;Karthik Sridharan
通讯作者: A. Rakhlin;Karthik Sridharan
通过反馈图实现世界上最好的在线学习
DOI: --
发表时间: 2021
期刊: Neural Information Processing Systems
影响因子: --
作者:
Liad Erez;Tomer Koren
通讯作者: Tomer Koren
从最优性到鲁棒性:随机老虎机的自适应重采样策略
DOI: --
发表时间: 2021
期刊: --
影响因子: --
作者:
Dorian Baudry;Patrick Saux;Odalric
通讯作者: Odalric
DOI: --
发表时间: 2011
期刊: --
影响因子: --
作者:
Dorian Baudry;Patrick Saux;Odalric
通讯作者: Odalric