Finite-Time Convergence and Sample Complexity of Multi-Agent Actor-Critic Reinforcement Learning with Average Reward

Finite-Time Convergence and Sample Complexity of Multi-Agent Actor-Critic Reinforcement Learning with Average Reward
复制标题

平均奖励的多智能体行为批评强化学习的有限时间收敛和样本复杂度

DOI:
--
复制
发表时间:
2022
期刊:
Proc. ICLR
影响因子:
--
通讯作者:
Liu, J. Lu
Liu, J. Lu
中科院分区:
--
文献类型:
--
作者:
Hairi, F.;Liu, J. Lu

文献摘要

被引文献

相似文献