Bayesian Learning of Optimal Policies in Markov Decision Processes with Countably Infinite State-Space

Bayesian Learning of Optimal Policies in Markov Decision Processes with Countably Infinite State-Space
复制标题

可数无限状态空间马尔可夫决策过程中最优策略的贝叶斯学习

DOI:
--
复制
发表时间:
2023
期刊:
Advances in Neural Information Processing Systems 36 (NeurIPS 2023
影响因子:
--
通讯作者:
Vijay Subramanian
Vijay Subramanian
中科院分区:
--
文献类型:
--
作者:
Saghar Adler;Vijay Subramanian

文献摘要

参考文献

被引文献

相似文献

DOI: 10.1214/aoms/1177698426
发表时间: 1968-04
影响因子: --
作者:
L. Fisher;S. Ross
通讯作者: L. Fisher;S. Ross
DOI: --
发表时间: 2021-02
期刊: ArXiv
影响因子: --
作者:
Mehdi Jafarnia-Jahromi;Rahul Jain;A. Nayyar
通讯作者: Mehdi Jafarnia-Jahromi;Rahul Jain;A. Nayyar
单服务器排队系统中基于学习的最优准入控制
DOI: 10.1109/allerton49937.2022.9929406
发表时间: 2022
期刊: and Computing (Allerton
影响因子: --
作者:
Zhang, Yili;Cohen, Asaf;Subramanian, Vijay G.
通讯作者: Subramanian, Vijay G.
DOI: 10.1145/3466772.3467047
发表时间: 2021-06
期刊: Proceedings of the Twenty-second International Symposium on Theory, Algorithmic Foundations, and Protocol Design for Mobile Networks and Mobile Computing
影响因子: --
作者:
Tuhinangshu Choudhury;Gauri Joshi;Weina Wang;S. Shakkottai
通讯作者: Tuhinangshu Choudhury;Gauri Joshi;Weina Wang;S. Shakkottai
DOI: --
发表时间: 2022-09
期刊: --
影响因子: --
作者:
Zixi Yang;R. Srikant;Lei Ying
通讯作者: Zixi Yang;R. Srikant;Lei Ying