Multi-agent Reinforcement Learning for Cooperative Policy with Different Abstraction
Multi-agent Reinforcement Learning for Cooperative Policy with Different Abstraction
批准号:
20K23326
负责人:
Uwano Fumito
金额:
$1.83万
依托单位:
依托单位国家:
日本
项目类别:
Grant-in-Aid for Research Activity Start-up
财政年份:
2020
资助国家:
日本
项目状态:
已结题
起止时间:
2020-09-11 至 2022-03-31
中文摘要
点击翻译按钮获取中文摘要
英文摘要
期刊论文(12)
专著(0)
科研奖励(0)
会议论文
登录
查看更多内容
マルチエージェントシステムにおける協調行動の抽象度と深層強化学習器の関係性の考察
多智能体系统中合作行为抽象层次与深度强化学习关系的思考
DOI:
--
发表时间:
2021
期刊:
影响因子:
--
作者:
[Uwano Fumito, Kitajima Eiki, Takadama Keiki, Fumito Uwano, Fumito Uwano, Fumito Uwano, 上野 史]
通讯作者:
上野 史
動的環境におけるマルチエージェント強化学習―不完全な情報から集団を動かす仕組み―
动态环境中的多智能体强化学习——一种将群体从不完整信息中转移出来的机制——
DOI:
--
发表时间:
2021
期刊:
影响因子:
--
作者:
[Uwano Fumito, Kitajima Eiki, Takadama Keiki, Fumito Uwano, Fumito Uwano, Fumito Uwano, 上野 史, 上野 史]
通讯作者:
上野 史
LSTM-based Abstraction of Hetero Observation and Transition in Non-Communicative Multi-Agent Reinforcement Learning
非通信多智能体强化学习中基于 LSTM 的异质观察和转移抽象
DOI:
--
发表时间:
2022
期刊:
影响因子:
--
作者:
[Uwano Fumito, Kitajima Eiki, Takadama Keiki, Fumito Uwano]
通讯作者:
Fumito Uwano
Policy-oriented Goal Selection in Multi-Agent Reinforcement Learning for Dynamic Environments without Communication
无通信动态环境下多智能体强化学习中的策略导向目标选择
DOI:
--
发表时间:
2022
期刊:
影响因子:
--
作者:
[Uwano Fumito, Kitajima Eiki, Takadama Keiki, Fumito Uwano, Fumito Uwano]
通讯作者:
Fumito Uwano
Sigmoid-based Incorrect Opinion Prevention Algorithm on Multi-Opinion Sharing Model
基于Sigmoid的多意见共享模型错误意见预防算法
DOI:
10.1527/tjsai.36-6_b-kb2
发表时间:
2021
期刊:
Transactions of the Japanese Society for Artificial Intelligence
影响因子:
--
作者:
[Uwano Fumito, Kitajima Eiki, Takadama Keiki]
通讯作者:
Takadama Keiki
共 6 条
Cooperative Strategy Learning and Knowledge Evolution to Adapt to Dynamism in Unknown Cooperation and Environment in Multi-agent System
-
批准号:21KK0206
-
项目类别:Fund for the Promotion of Joint International Research (Fostering Joint International Research (A))
-
资助金额:$4.41万
-
财政年份:2022
-
负责人:Uwano Fumito
-
依托单位:
海外基金