On Instance-Dependent Bounds for Offline Reinforcement Learning with Linear Function Approximation
On Instance-Dependent Bounds for Offline Reinforcement Learning with Linear Function Approximation
复制标题
基于线性函数逼近的离线强化学习的实例相关界限
DOI:
--
复制
发表时间:
2023
期刊:
影响因子:
--
通讯作者:
Arora, Raman
中科院分区:
文献类型:
--
作者:
Nguyễn-Tang, Thanh;Yin, Ming;Gupta, Sunil;Venkatesh, Svetha;Arora, Raman
登录
查看更多内容
DOI:
--
发表时间:
2020-06
期刊:
ArXiv
影响因子:
--
作者:
Kunhe Yang;Lin F. Yang;S. Du
通讯作者:
Kunhe Yang;Lin F. Yang;S. Du
DOI:
--
发表时间:
2021-02
期刊:
ArXiv
影响因子:
--
作者:
Ming Yin;Yu Bai;Yu-Xiang Wang
通讯作者:
Ming Yin;Yu Bai;Yu-Xiang Wang
影响因子:
2.5
作者:
Cesa-Bianchi, N;Conconi, A;Gentile, C
通讯作者:
Gentile, C
DOI:
10.48550/arxiv.2205.15512
发表时间:
2022-05
期刊:
ArXiv
影响因子:
--
作者:
Wei Xiong;Han Zhong;Chengshuai Shi;Cong Shen;Liwei Wang;T. Zhang
通讯作者:
Wei Xiong;Han Zhong;Chengshuai Shi;Cong Shen;Liwei Wang;T. Zhang
DOI:
--
发表时间:
2021-06
期刊:
--
影响因子:
--
作者:
Tengyang Xie;Ching-An Cheng;Nan Jiang;Paul Mineiro;Alekh Agarwal
通讯作者:
Tengyang Xie;Ching-An Cheng;Nan Jiang;Paul Mineiro;Alekh Agarwal