Horizon-Free Learning for Markov Decision Processes and Games: Stochastically Bounded Rewards and Improved Bounds

Horizon-Free Learning for Markov Decision Processes and Games: Stochastically Bounded Rewards and Improved Bounds
复制标题

马尔可夫决策过程和博弈的无地平线学习:随机有界奖励和改进界限

DOI:
--
复制
发表时间:
2023
期刊:
Proceedings of Machine Learning Research
影响因子:
--
通讯作者:
Yang, Lin
Yang, Lin
中科院分区:
--
文献类型:
--
作者:
Li, Shengshi;Yang, Lin

文献摘要

相似文献