Online Restless Multi-Armed Bandits with Long-Term Fairness Constraints

Online Restless Multi-Armed Bandits with Long-Term Fairness Constraints
复制标题

具有长期公平性约束的在线不安分多臂强盗

DOI:
10.1609/aaai.v38i14.29489
复制
发表时间:
2024
期刊:
Proceedings of the AAAI Conference on Artificial Intelligence
影响因子:
--
通讯作者:
Li, Jian
Li, Jian
中科院分区:
--
文献类型:
--
作者:
Wang, Shufan;Xiong, Guojun;Li, Jian

文献摘要

参考文献

相似文献

基于 Whittle 指数的 Q 学习,用于具有平均奖励的不安强盗
DOI: 10.1016/j.automatica.2022.110186
发表时间: 2020
期刊: ArXiv
影响因子: --
作者:
Konstantin Avrachenkov;V. Borkar
通讯作者: V. Borkar
阻塞性睡眠呼吸暂停治疗依从性的马尔可夫模型
DOI: --
发表时间: 2013
期刊:
影响因子: --
作者:
Yuncheol Kang;V. Prabhu;A. Sawyer;P. Griffin
通讯作者: P. Griffin
DOI: 10.1609/aaai.v35i9.16979
发表时间: 2020-09
期刊: ArXiv
影响因子: --
作者:
K. C. Kalagarla;Rahul Jain;P. Nuzzo
通讯作者: K. C. Kalagarla;Rahul Jain;P. Nuzzo
DOI: --
发表时间: 2021-10
期刊: ArXiv
影响因子: --
作者:
Khaled Nakhleh;Santosh Ganji;Ping-Chun Hsieh;I.-Hong Hou;S. Shakkottai
通讯作者: Khaled Nakhleh;Santosh Ganji;Ping-Chun Hsieh;I.-Hong Hou;S. Shakkottai
针对多动作不安强盗贼的 Q-Learning 拉格朗日策略
DOI: 10.1145/3447548.3467370
发表时间: 2021
期刊: Proceedings of the 27th ACM SIGKDD Conference on Knowledge Discovery & Data Mining
影响因子: --
作者:
J. Killian;Arpita Biswas;Sanket Shah;M. Tambe
通讯作者: M. Tambe