Finite-Time Convergence and Sample Complexity of Multi-Agent Actor-Critic Reinforcement Learning with Average Reward
Finite-Time Convergence and Sample Complexity of Multi-Agent Actor-Critic Reinforcement Learning with Average Reward
复制标题
平均奖励的多智能体行为批评强化学习的有限时间收敛和样本复杂度
DOI:
--
复制
发表时间:
2022
期刊:
影响因子:
--
通讯作者:
Liu, J. Lu
中科院分区:
文献类型:
--
作者:
Hairi, F.;Liu, J. Lu