Achieving Sub-linear Regret in Infinite Horizon Average Reward Constrained MDP with Linear Function Approximation
Achieving Sub-linear Regret in Infinite Horizon Average Reward Constrained MDP with Linear Function Approximation
复制标题
利用线性函数逼近实现无限视野平均奖励约束 MDP 中的次线性遗憾
DOI:
--
复制
发表时间:
2023
期刊:
影响因子:
--
通讯作者:
A. Ghosh, X. Zhou
中科院分区:
文献类型:
--
作者:
A. Ghosh, X. Zhou
登录
查看更多内容
DOI:
10.1609/aaai.v36i4.20302
发表时间:
2022-06
期刊:
--
影响因子:
--
作者:
Honghao Wei;Xin Liu;Lei Ying
通讯作者:
Honghao Wei;Xin Liu;Lei Ying
DOI:
10.1609/aaai.v35i9.16979
发表时间:
2020-09
期刊:
ArXiv
影响因子:
--
作者:
K. C. Kalagarla;Rahul Jain;P. Nuzzo
通讯作者:
K. C. Kalagarla;Rahul Jain;P. Nuzzo
DOI:
--
发表时间:
2020-03
期刊:
--
影响因子:
--
作者:
Dongsheng Ding;Xiaohan Wei;Zhuoran Yang;Zhaoran Wang;M. Jovanovi'c
通讯作者:
Dongsheng Ding;Xiaohan Wei;Zhuoran Yang;Zhaoran Wang;M. Jovanovi'c
DOI:
--
发表时间:
2020-07
期刊:
--
影响因子:
--
作者:
Chen-Yu Wei;Mehdi Jafarnia-Jahromi;Haipeng Luo;Rahul Jain
通讯作者:
Chen-Yu Wei;Mehdi Jafarnia-Jahromi;Haipeng Luo;Rahul Jain
DOI:
--
发表时间:
2021
期刊:
AAAI Conference on Artificial Intelligence
影响因子:
--
作者:
Qinbo Bai;A. S. Bedi;Mridul Agarwal;Alec Koppel;V. Aggarwal
通讯作者:
V. Aggarwal