Constrained Reinforcement Learning via Dissipative Saddle Flow Dynamics

Constrained Reinforcement Learning via Dissipative Saddle Flow Dynamics
复制标题

通过耗散鞍流动力学进行约束强化学习

DOI:
10.1109/ieeeconf56349.2022.10052060
复制
发表时间:
2022
期刊:
and Computers
影响因子:
--
通讯作者:
Mallada, Enrique
Mallada, Enrique
中科院分区:
--
文献类型:
--
作者:
Zheng, Tianqi;You, Pengcheng;Mallada, Enrique

文献摘要

参考文献

相似文献

鞍形流动力学:可观测证书和可分离正则化
DOI: 10.23919/acc50511.2021.9483346
发表时间: 2021
期刊: American Control Conference
影响因子: --
作者:
You, Pengcheng;Mallada, Enrique
通讯作者: Mallada, Enrique
具有几乎确定约束的强化学习
DOI: --
发表时间: 2022
期刊: Proceedings of The 4th Annual Learning for Dynamics and Control Conference,
影响因子: --
作者:
Castellano, Agustin;Min, Hancheng;Bazerque, Juan A.;Mallada, Enrique
通讯作者: Mallada, Enrique
基于节点的多路径路由稳定性和双重拥塞控制
DOI: 10.1109/cdc.2008.4739209
发表时间: 2008
期刊: 2008 47th IEEE Conference on Decision and Control
影响因子: --
作者:
Enrique Mallada;F. Paganini
通讯作者: F. Paganini
DOI: --
发表时间: 2021
期刊: AAAI Conference on Artificial Intelligence
影响因子: --
作者:
Qinbo Bai;A. S. Bedi;Mridul Agarwal;Alec Koppel;V. Aggarwal
通讯作者: V. Aggarwal
随机线性规划在近线性(有时是次线性)时间内解决马尔可夫决策问题
DOI: 10.1287/moor.2019.1000
发表时间: 2020
期刊: Math. Oper. Res.
影响因子: --
作者:
Mengdi Wang
通讯作者: Mengdi Wang