Robust Average-Reward Markov Decision Processes

Robust Average-Reward Markov Decision Processes
复制标题

鲁棒平均奖励马尔可夫决策过程

DOI:
10.1609/aaai.v37i12.26775
复制
发表时间:
2023
期刊:
Proceedings of the AAAI Conference on Artificial Intelligence
影响因子:
--
通讯作者:
Zou, Shaofeng
Zou, Shaofeng
中科院分区:
--
文献类型:
--
作者:
Wang, Yue;Velasquez, Alvaro;Atia, George;Prater-Bennette, Ashley;Zou, Shaofeng

文献摘要

参考文献

被引文献

相似文献

DOI: 10.1613/jair.1.12611
发表时间: 2020-12
期刊: J. Artif. Intell. Res.
影响因子: --
作者:
George K. Atia;Andre Beckus;Ismail R. Alkhouri;Alvaro Velasquez
通讯作者: George K. Atia;Andre Beckus;Ismail R. Alkhouri;Alvaro Velasquez
DOI: 10.1287/moor.2016.0779
发表时间: 2016-11-01
影响因子: 1.7
作者:
Lim, Shiau Hong;Xu, Huan;Mannor, Shie
通讯作者: Mannor, Shie
使用生成模型的鲁棒强化学习的样本复杂性
DOI: --
发表时间: 2022
期刊: International Conference on Artificial Intelligence and Statistics (AISTATS
影响因子: --
作者:
Kishan Panaganti, Dileep Kalathil
通讯作者: Kishan Panaganti, Dileep Kalathil
DOI: --
发表时间: 2020-06
期刊: ArXiv
影响因子: --
作者:
C. Ho;Marek Petrik;W. Wiesemann
通讯作者: C. Ho;Marek Petrik;W. Wiesemann
DOI: 10.1137/21m1446484
发表时间: 2021
期刊: SIAM J. Optim.
影响因子: --
作者:
Hamed Rahimian;G. Bayraksan;Tito Homem
通讯作者: Tito Homem