Learning MDPs from Features: Predict-Then-Optimize for Sequential Decision Making by Reinforcement Learning
Learning MDPs from Features: Predict-Then-Optimize for Sequential Decision Making by Reinforcement Learning
复制标题
从特征学习 MDP:通过强化学习预测然后优化顺序决策
DOI:
--
复制
发表时间:
2021
期刊:
影响因子:
--
通讯作者:
M. Tambe
中科院分区:
文献类型:
--
作者:
Kai Wang;Sanket Shah;Haipeng Chen;A. Perrault;F. Doshi;M. Tambe