Learning Optimal Controllers by Policy Gradient: Global Optimality via Convex Parameterization
Learning Optimal Controllers by Policy Gradient: Global Optimality via Convex Parameterization
复制标题
通过策略梯度学习最优控制器:通过凸参数化实现全局最优
DOI:
10.1109/cdc45484.2021.9682821
复制
发表时间:
2021
期刊:
影响因子:
--
通讯作者:
Fazel, Maryam
中科院分区:
文献类型:
--
作者:
Sun, Yue;Fazel, Maryam