Offline Goal-Conditioned Reinforcement Learning via f-Advantage Regression

Offline Goal-Conditioned Reinforcement Learning via f-Advantage Regression
复制标题

通过 f-Advantage 回归进行离线目标条件强化学习

DOI:
--
复制
发表时间:
2022
期刊:
Advances in neural information processing systems
影响因子:
--
通讯作者:
Bastani, Osbert
Bastani, Osbert
中科院分区:
--
文献类型:
--
作者:
Ma, Yecheng Jason;Yan, Jason;Jayaraman, Dinesh;Bastani, Osbert

文献摘要

相似文献