DNN-Rule Hybrid Dyna-Q for Sample-Efficient Task-Oriented Dialog Policy Learning

DNN-Rule Hybrid Dyna-Q for Sample-Efficient Task-Oriented Dialog Policy Learning
复制标题

用于样本高效、面向任务的对话策略学习的 DNN-规则混合 Dyna-Q

DOI:
10.23919/apsipaasc55919.2022.9980344
复制
发表时间:
2022
期刊:
Asia-Pacific Signal and Information Processing Association Annual Summit and Conference
影响因子:
--
通讯作者:
Shinozaki Takahiro
Shinozaki Takahiro
中科院分区:
--
文献类型:
--
作者:
Zhang Mingxin;Shinozaki Takahiro

文献摘要

相似文献