Provably Efficient Algorithms for Multi-Objective Competitive RL

Provably Efficient Algorithms for Multi-Objective Competitive RL
复制标题

可证明有效的多目标竞争强化学习算法

DOI:
--
复制
发表时间:
2021
期刊:
Proceedings of the 38th International Conference on Machine Learning
影响因子:
--
通讯作者:
Sra, Suvrit
Sra, Suvrit
中科院分区:
--
文献类型:
--
作者:
Yu, Tiancheng;Tian, Yi;Zhang, Jingzhao;Sra, Suvrit

文献摘要

参考文献

被引文献

相似文献

约束马尔可夫决策过程中的学习
DOI: 10.1109/tcns.2022.3203361
发表时间: 2022
影响因子: 4.2
作者:
Singh, Rahul;Gupta, Abhishek;Shroff, Ness
通讯作者: Shroff, Ness
因子马尔可夫决策过程中的极小极大最优强化学习
DOI: --
发表时间: 2020
期刊: 34th Conference on Neural Information Processing Systems (NeurIPS 2020
影响因子: --
作者:
Tian, Yi;Qian, Jian;Sra, Suvrit
通讯作者: Sra, Suvrit
布莱克威尔平易近人和无悔学习是等效的
DOI: --
发表时间: 2010
期刊: Annual Conference Computational Learning Theory
影响因子: --
作者:
Jacob D. Abernethy;P. Bartlett;Elad Hazan
通讯作者: Elad Hazan
DOI: --
发表时间: 2020-03
期刊: --
影响因子: --
作者:
Dongsheng Ding;Xiaohan Wei;Zhuoran Yang;Zhaoran Wang;M. Jovanovi'c
通讯作者: Dongsheng Ding;Xiaohan Wei;Zhuoran Yang;Zhaoran Wang;M. Jovanovi'c
未知游戏中的平易近人性:在线学习遇到多目标优化
DOI: --
发表时间: 2014
期刊: Annual Conference Computational Learning Theory
影响因子: --
作者:
Shie Mannor;Vianney Perchet;Gilles Stoltz
通讯作者: Gilles Stoltz