Reward Learning With Intractable Normalizing Functions

Reward Learning With Intractable Normalizing Functions
复制标题

用棘手的标准化函数奖励学习

DOI:
10.1109/lra.2023.3320009
复制
发表时间:
2023
影响因子:
5.2
通讯作者:
Losey, Dylan
Losey, Dylan
中科院分区:
计算机科学2区
文献类型:
--
作者:
Hoegerman, Joshua;Losey, Dylan

文献摘要

参考文献

相似文献

风险意识主动逆强化学习
DOI: --
发表时间: 2018
期刊: Conference on Robot Learning
影响因子: --
作者:
Brown, Daniel;Cui, Yuchen;Niekum, Scott
通讯作者: Niekum, Scott
从不同来源的人类反馈中学习奖励函数:最佳地整合演示和偏好
DOI: 10.1177/02783649211041652
发表时间: 2021
期刊: The International Journal of Robotics Research
影响因子: --
作者:
Bıyık, Erdem;Losey, Dylan P.;Palan, Malayandi;Landolfi, Nicholas C.;Shevchuk, Gleb;Sadigh, Dorsa
通讯作者: Sadigh, Dorsa
DOI: 10.1109/icra.2018.8460854
发表时间: 2018-05
期刊: 2018 IEEE International Conference on Robotics and Automation (ICRA)
影响因子: --
作者:
Yuchen Cui;S. Niekum
通讯作者: Yuchen Cui;S. Niekum
DOI: 10.1561/2300000053
发表时间: 2018-03
期刊: ArXiv
影响因子: --
作者:
Takayuki Osa;J. Pajarinen;G. Neumann;J. Bagnell;P. Abbeel;Jan Peters
通讯作者: Takayuki Osa;J. Pajarinen;G. Neumann;J. Bagnell;P. Abbeel;Jan Peters
DOI: 10.1109/tro.2020.2971415
发表时间: 2020-02
影响因子: 7.8
作者:
Andreea Bobu;Andrea V. Bajcsy;J. Fisac;Sampada Deglurkar;A. Dragan
通讯作者: Andreea Bobu;Andrea V. Bajcsy;J. Fisac;Sampada Deglurkar;A. Dragan