Learning MDPs from Features: Predict-Then-Optimize for Sequential Decision Making by Reinforcement Learning

Learning MDPs from Features: Predict-Then-Optimize for Sequential Decision Making by Reinforcement Learning
复制标题

从特征学习 MDP:通过强化学习预测然后优化顺序决策

DOI:
--
复制
发表时间:
2021
期刊:
Neural Information Processing Systems
影响因子:
--
通讯作者:
M. Tambe
M. Tambe
中科院分区:
--
文献类型:
--
作者:
Kai Wang;Sanket Shah;Haipeng Chen;A. Perrault;F. Doshi;M. Tambe

文献摘要

被引文献

相似文献