Horizon-Free Learning for Markov Decision Processes and Games: Stochastically Bounded Rewards and Improved Bounds
Horizon-Free Learning for Markov Decision Processes and Games: Stochastically Bounded Rewards and Improved Bounds
复制标题
马尔可夫决策过程和博弈的无地平线学习:随机有界奖励和改进界限
DOI:
--
复制
发表时间:
2023
期刊:
影响因子:
--
通讯作者:
Yang, Lin
中科院分区:
文献类型:
--
作者:
Li, Shengshi;Yang, Lin