Memory-Constrained No-Regret Learning in Adversarial Multi-Armed Bandits

Memory-Constrained No-Regret Learning in Adversarial Multi-Armed Bandits
复制标题

对抗性多臂强盗中的记忆受限无悔学习

DOI:
10.1109/tsp.2021.3070201
复制
发表时间:
2021
影响因子:
5.4
通讯作者:
Zhao, Qing
Zhao, Qing
中科院分区:
工程技术1区
文献类型:
--
作者:
Xu, Xiao;Zhao, Qing

文献摘要

参考文献

被引文献

相似文献

多臂强盗:网络在线学习的理论与应用
DOI: 10.2200/s00941ed2v01y201907cnt022
发表时间: 2019
期刊: Synthesis Lectures on Communication Networks
影响因子: --
作者:
Qing Zhao
通讯作者: Qing Zhao
多次游戏对抗性强盗问题的最小最大最优算法
DOI: 10.1109/tsp.2019.2928952
发表时间: 2019
影响因子: 5.4
作者:
Nuri Mert Vural;Hakan Gokcesu;Kaan Gokcesu;S. Kozat
通讯作者: S. Kozat
用于不协调频谱访问的对抗性多用户强盗
DOI: 10.1109/icassp.2019.8682263
发表时间: 2019
期刊: Speech and Signal Processing (ICASSP
影响因子: --
作者:
Bande, Meghana;Veeravalli, Venugopal V.
通讯作者: Veeravalli, Venugopal V.
多智能体系统中的分布式无悔学习:挑战和最新发展
DOI: 10.1109/msp.2020.2973963
发表时间: 2020
影响因子: 14.9
作者:
Xu, Xiao;Zhao, Qing
通讯作者: Zhao, Qing