On Instance-Dependent Bounds for Offline Reinforcement Learning with Linear Function Approximation

On Instance-Dependent Bounds for Offline Reinforcement Learning with Linear Function Approximation
复制标题

基于线性函数逼近的离线强化学习的实例相关界限

DOI:
--
复制
发表时间:
2023
期刊:
Proceedings of the AAAI Conference on Artificial Intelligence
影响因子:
--
通讯作者:
Arora, Raman
Arora, Raman
中科院分区:
--
文献类型:
--
作者:
Nguyễn-Tang, Thanh;Yin, Ming;Gupta, Sunil;Venkatesh, Svetha;Arora, Raman

文献摘要

参考文献

相似文献

DOI: --
发表时间: 2020-06
期刊: ArXiv
影响因子: --
作者:
Kunhe Yang;Lin F. Yang;S. Du
通讯作者: Kunhe Yang;Lin F. Yang;S. Du
DOI: --
发表时间: 2021-02
期刊: ArXiv
影响因子: --
作者:
Ming Yin;Yu Bai;Yu-Xiang Wang
通讯作者: Ming Yin;Yu Bai;Yu-Xiang Wang
DOI: 10.1109/tit.2004.833339
发表时间: 2004-09-01
影响因子: 2.5
作者:
Cesa-Bianchi, N;Conconi, A;Gentile, C
通讯作者: Gentile, C
DOI: 10.48550/arxiv.2205.15512
发表时间: 2022-05
期刊: ArXiv
影响因子: --
作者:
Wei Xiong;Han Zhong;Chengshuai Shi;Cong Shen;Liwei Wang;T. Zhang
通讯作者: Wei Xiong;Han Zhong;Chengshuai Shi;Cong Shen;Liwei Wang;T. Zhang
DOI: --
发表时间: 2021-06
期刊: --
影响因子: --
作者:
Tengyang Xie;Ching-An Cheng;Nan Jiang;Paul Mineiro;Alekh Agarwal
通讯作者: Tengyang Xie;Ching-An Cheng;Nan Jiang;Paul Mineiro;Alekh Agarwal