A Simple Reward-free Approach to Constrained Reinforcement Learning

A Simple Reward-free Approach to Constrained Reinforcement Learning
复制标题

约束强化学习的简单无奖励方法

DOI:
--
复制
发表时间:
2022
期刊:
International Conference on Machine Learning
影响因子:
--
通讯作者:
Sobhan Miryoosefi, Chi Jin
Sobhan Miryoosefi, Chi Jin
中科院分区:
--
文献类型:
--
作者:
Sobhan Miryoosefi, Chi Jin

文献摘要

参考文献

被引文献

相似文献

约束马尔可夫决策过程中的学习
DOI: 10.1109/tcns.2022.3203361
发表时间: 2022
影响因子: 4.2
作者:
Singh, Rahul;Gupta, Abhishek;Shroff, Ness
通讯作者: Shroff, Ness
布莱克威尔平易近人和无悔学习是等效的
DOI: --
发表时间: 2010
期刊: Annual Conference Computational Learning Theory
影响因子: --
作者:
Jacob D. Abernethy;P. Bartlett;Elad Hazan
通讯作者: Elad Hazan
DOI: --
发表时间: 2020-03
期刊: --
影响因子: --
作者:
Dongsheng Ding;Xiaohan Wei;Zhuoran Yang;Zhaoran Wang;M. Jovanovi'c
通讯作者: Dongsheng Ding;Xiaohan Wei;Zhuoran Yang;Zhaoran Wang;M. Jovanovi'c
可证明有效的多目标竞争强化学习算法
DOI: --
发表时间: 2021
期刊: Proceedings of the 38th International Conference on Machine Learning
影响因子: --
作者:
Yu, Tiancheng;Tian, Yi;Zhang, Jingzhao;Sra, Suvrit
通讯作者: Sra, Suvrit