Towards Minimax Optimal Reinforcement Learning in Factored Markov Decision Processes

Towards Minimax Optimal Reinforcement Learning in Factored Markov Decision Processes
复制标题

因子马尔可夫决策过程中的极小极大最优强化学习

DOI:
--
复制
发表时间:
2020
期刊:
34th Conference on Neural Information Processing Systems (NeurIPS 2020
影响因子:
--
通讯作者:
Sra, Suvrit
Sra, Suvrit
中科院分区:
--
文献类型:
--
作者:
Tian, Yi;Qian, Jian;Sra, Suvrit

文献摘要

参考文献

被引文献

相似文献

DOI: --
发表时间: 2020-04
期刊: ArXiv
影响因子: --
作者:
Zihan Zhang;Yuanshuo Zhou;Xiangyang Ji
通讯作者: Zihan Zhang;Yuanshuo Zhou;Xiangyang Ji
在马尔可夫智能体存在的情况下进行高效多智能体学习的示例
DOI: --
发表时间: 2013
期刊: Studies in Computational Intelligence
影响因子: --
作者:
D. Chakraborty
通讯作者: D. Chakraborty
因式分解 MDP 的最大范数投影
DOI: --
发表时间: 2001
期刊: International Joint Conference on Artificial Intelligence
影响因子: --
作者:
Carlos Guestrin;D. Koller;Ronald E. Parr
通讯作者: Ronald E. Parr
乐观初始化和贪婪导致分解 MDP 中的多项式时间学习
DOI: --
发表时间: 2009
期刊: International Conference on Machine Learning
影响因子: --
作者:
I. Szita;András Lörincz
通讯作者: András Lörincz
因子状态 MDP 中的高效结构学习
DOI: --
发表时间: 2007
期刊: AAAI Conference on Artificial Intelligence
影响因子: --
作者:
Alexander L. Strehl;Carlos Diuk;M. Littman
通讯作者: M. Littman