The Reward Biased Method: An Optimism based Approach for Reinforcement Learning
The Reward Biased Method: An Optimism based Approach for Reinforcement Learning
复制标题
奖励偏差方法:基于乐观的强化学习方法
DOI:
10.1109/allerton58177.2023.10313396
复制
发表时间:
2023
期刊:
影响因子:
--
通讯作者:
Kumar, P. R.
中科院分区:
文献类型:
--
作者:
Mete, Akshay;Singh, Rahul;Kumar, P. R.
登录
查看更多内容
DOI:
--
发表时间:
--
期刊:
影响因子:
--
作者:
通讯作者:
--
影响因子:
6.4
作者:
Shirani Faradonbeh, Mohamad Kazem;Tewari, Ambuj;Michailidis, George
通讯作者:
Michailidis, George
DOI:
--
发表时间:
2020-11
期刊:
ArXiv
影响因子:
--
作者:
Akshay Mete;Rahul Singh;Xi Liu;P. Kumar
通讯作者:
Akshay Mete;Rahul Singh;Xi Liu;P. Kumar
DOI:
10.1609/aaai.v35i9.16961
发表时间:
2020-10
期刊:
ArXiv
影响因子:
--
作者:
Yu-Heng Hung;Ping-Chun Hsieh;Xi Liu;P. Kumar
通讯作者:
Yu-Heng Hung;Ping-Chun Hsieh;Xi Liu;P. Kumar
DOI:
10.1109/ciss53076.2022.9751189
发表时间:
2022
期刊:
IEEE
影响因子:
--
作者:
Mete, Akshay;Singh, Rahul;Kumar, P. R.
通讯作者:
Kumar, P. R.