Offline Goal-Conditioned Reinforcement Learning via f-Advantage Regression
Offline Goal-Conditioned Reinforcement Learning via f-Advantage Regression
复制标题
通过 f-Advantage 回归进行离线目标条件强化学习
DOI:
--
复制
发表时间:
2022
期刊:
影响因子:
--
通讯作者:
Bastani, Osbert
中科院分区:
文献类型:
--
作者:
Ma, Yecheng Jason;Yan, Jason;Jayaraman, Dinesh;Bastani, Osbert