Toward a Theoretical Foundation of Policy Optimization for Learning Control Policies

Toward a Theoretical Foundation of Policy Optimization for Learning Control Policies
复制标题

为学习控制策略奠定策略优化的理论基础

DOI:
10.1146/annurev-control-042920-020021
复制
发表时间:
2023
期刊:
and Autonomous Systems
影响因子:
--
通讯作者:
Başar, Tamer
Başar, Tamer
中科院分区:
--
文献类型:
--
作者:
Hu, Bin;Zhang, Kaiqing;Li, Na;Mesbahi, Mehran;Fazel, Maryam;Başar, Tamer

文献摘要

参考文献

被引文献

相似文献

离散时间 H2/H-无穷控制中的 LQG 成本界限
DOI: --
发表时间: 1991
期刊:
影响因子: --
作者:
D. Mustafa;D. Bernstein
通讯作者: D. Bernstein
DOI: 10.1007/s10208-021-09499-8
发表时间: 2018-09
影响因子: 3
作者:
K. Balasubramanian;Saeed Ghadimi
通讯作者: K. Balasubramanian;Saeed Ghadimi
DOI: 10.3934/dcdsb.2015.20.2361
发表时间: 2015-08
影响因子: 1.2
作者:
James Anderson;A. Papachristodoulou
通讯作者: James Anderson;A. Papachristodoulou
DOI: --
发表时间: 1994
影响因子: 6.8
作者:
P. Peres;J. Geromel
通讯作者: J. Geromel