When does return-conditioned supervised learning work for offline reinforcement learning?

When does return-conditioned supervised learning work for offline reinforcement learning?
复制标题

返回条件监督学习何时适用于离线强化学习?

DOI:
--
复制
发表时间:
2022
期刊:
Advances in neural information processing systems
影响因子:
--
通讯作者:
Bruna, Joan
Bruna, Joan
中科院分区:
--
文献类型:
--
作者:
Brandfronbrener, David;Bietti, Alberto;Buckman, Jacob;Laroche, Romain;Bruna, Joan

文献摘要

参考文献

被引文献

相似文献

DOI: --
发表时间: 2021-06
期刊: --
影响因子: --
作者:
Lili Chen;Kevin Lu;A. Rajeswaran;Kimin Lee;Aditya Grover;M. Laskin;P. Abbeel;A. Srinivas;
通讯作者: Lili Chen;Kevin Lu;A. Rajeswaran;Kimin Lee;Aditya Grover;M. Laskin;P. Abbeel;A. Srinivas;
DOI: --
发表时间: 2021-06
期刊: --
影响因子: --
作者:
Tengyang Xie;Ching-An Cheng;Nan Jiang;Paul Mineiro;Alekh Agarwal
通讯作者: Tengyang Xie;Ching-An Cheng;Nan Jiang;Paul Mineiro;Alekh Agarwal
DOI: --
发表时间: 2020-10
期刊: ArXiv
影响因子: --
作者:
Ruosong Wang;Dean Phillips Foster;S. Kakade
通讯作者: Ruosong Wang;Dean Phillips Foster;S. Kakade
颠倒强化学习在具有情景重置的随机环境中可能会出现分歧
DOI: --
发表时间: 2022
期刊: arXiv.org
影响因子: --
作者:
M. Strupl;Francesco Faccio;Dylan R. Ashley;J. Schmidhuber;R. Srivastava
通讯作者: R. Srivastava