Entropy regularized reinforcement learning using large deviation theory

Entropy regularized reinforcement learning using large deviation theory
复制标题

使用大偏差理论的熵正则化强化学习

DOI:
10.1103/physrevresearch.5.023085
复制
发表时间:
2023
影响因子:
4.2
通讯作者:
Kulkarni, Rahul V.
Kulkarni, Rahul V.
中科院分区:
--
文献类型:
--
作者:
Arriojas, Argenis;Adamczyk, Jacob;Tiomkin, Stas;Kulkarni, Rahul V.

文献摘要

参考文献

相似文献

基于物理的图神经网络增强了变分非平衡最优控制的可扩展性。
DOI: --
发表时间: 2022
影响因子: 4.4
作者:
Jiawei Yan;Grant M. Rotskoff
通讯作者: Grant M. Rotskoff
电流偏置的轨迹系综中不存在耗散
DOI: 10.1088/1742-5468/2016/09/093305
发表时间: 2016
期刊: Journal of Statistical Mechanics: Theory and Experiment
影响因子: --
作者:
R. Jack;R. Evans
通讯作者: R. Evans
DOI: 10.1103/physrevlett.92.150601
发表时间: 2004
影响因子: 8.6
作者:
R. Evans
通讯作者: R. Evans
DOI: 10.1088/1742-5468/2015/12/p12001
发表时间: 2015
期刊: Journal of Statistical Mechanics: Theory and Experiment
影响因子: --
作者:
R. Chetrite;H. Touchette
通讯作者: H. Touchette
具有多规范反馈控制的群体动力学方法。
DOI: 10.1103/physreve.93.062123
发表时间: 2016
期刊: Physical review. E
影响因子: --
作者:
T. Nemoto;F. Bouchet;R. Jack;V. Lecomte
通讯作者: V. Lecomte