強化学習を用いたサッカーのシューティングロボットの目的行動の獲得
強化学習を用いたサッカーのシューティングロボットの目的行動の獲得
批准号:
06650301
负责人:
浅田 稔
金额:
$1.28万
依托单位:
依托单位国家:
日本
项目类别:
Grant-in-Aid for General Scientific Research (C)
财政年份:
1994
资助国家:
日本
项目状态:
已结题
起止时间:
1994 至 --
中文摘要
ロボティクスや人口知能研究の究極の目的は,変動する環境との相互作用を通して,自ら作業計画を立て,遂行する自律的なエージェントを実現させることである.これまでの典型的な知能ロボットでは,処理の階層化による段階的処理で構成されており,このような直列的な処理系では,外界の変動に対して非常に弱いシステムであることが指摘され,行動規範型のロボットが出現しつつある.これらの行動規範型のロボットは環境変動に対応し,反射的な行動を上手にこなすが,目的行動そのものを獲得し生成する能力に欠けている.本研究では,強化学習を用いて,ロボット自らが,環境との相互作用を通して,目的行動を獲得し生成する能力を実現することを目的として,実際のロボットシステム(サッカーのシューティングロボット)を構築し,強化学習による目的行動獲得能力の解析ならびに評価を行なった.強化学習を実際のロボットシステムに適用する際の問題点として,「学習の高速化」及び「状態空間と行動空間のずれ」が挙げられる.前者に対しては,簡単なタスクからの学習LEM(Learning Easy Missions)を提案し,状態空間の大きさの指数オーダーから線形オーダーに学習時間が低減できることを示した.また,後者に対しては,行動空間を状態空間に合わせて再構成することにより解決した.以上をサッカーロボットが,ボールを発見し,ドリブルして,ゴールにシュートする複雑で動的なタスクに適用した.まず,コンピュータシミュレーションにより,学習の高速化を検証した.また,移動ロボットにカラーTVカメラを搭載した実機を使った実験で学習結果を検証した.ビデオノイズによる多少の画像処理の失敗に拘らず、シュートすることができ,本手法の有効性・ロバスト性を確認できた.
英文摘要
ロボティクスや人口知能研究の究極の目的は,変動する環境との相互作用を通して,自ら作業計画を立て,遂行する自律的なエージェントを実現させることである.これまでの典型的な知能ロボットでは,処理の階層化による段階的処理で構成されており,このような直列的な処理系では,外界の変動に対して非常に弱いシステムであることが指摘され,行動規範型のロボットが出現しつつある.これらの行動規範型のロボットは環境変動に対応し,反射的な行動を上手にこなすが,目的行動そのものを獲得し生成する能力に欠けている.本研究では,強化学習を用いて,ロボット自らが,環境との相互作用を通して,目的行動を獲得し生成する能力を実現することを目的として,実際のロボットシステム(サッカーのシューティングロボット)を構築し,強化学習による目的行動獲得能力の解析ならびに評価を行なった.強化学習を実際のロボットシステムに適用する際の問題点として,「学習の高速化」及び「状態空間と行動空間のずれ」が挙げられる.前者に対しては,簡単なタスクからの学習LEM(Learning Easy Missions)を提案し,状態空間の大きさの指数オーダーから線形オーダーに学習時間が低減できることを示した.また,後者に対しては,行動空間を状態空間に合わせて再構成することにより解決した.以上をサッカーロボットが,ボールを発見し,ドリブルして,ゴールにシュートする複雑で動的なタスクに適用した.まず,コンピュータシミュレーションにより,学習の高速化を検証した.また,移動ロボットにカラーTVカメラを搭載した実機を使った実験で学習結果を検証した.ビデオノイズによる多少の画像処理の失敗に拘らず、シュートすることができ,本手法の有効性・ロバスト性を確認できた.
期刊论文(10)
专著(0)
科研奖励(0)
会议论文
登录
查看更多内容
M.Asada,S.Noda,S.Tawaratsumida,and K.Hosada: "Vision-Based Behavior Acquisition For A Shooting Rubot by Using A Reinforcemeut Learning" Proc.of IAPR/IEEE Workshop on Visual Behaviors. 112-118 (1994)
M.Asada、S.Noda、S.Tawaratsumida 和 K.Hosada:“使用强化学习对射击机器人进行基于视觉的行为获取”Proc.of IAPR/IEEE 视觉行为研讨会。
DOI:
--
发表时间:
期刊:
影响因子:
--
作者:
[]
通讯作者:
M.Asada,E.Uchibe,S.Noda,S.Tawaratsumida and K.Hosoda: "Coordination Of Multiple Behaviors Acquired By Vision-Based Reinforcemeut Leaning" Proc.of IEEE/RSJ/GI International Conference on Intelligent Robots and Systems. 917-924 (1994)
M.Asada、E.Uchibe、S.Noda、S.Tawaratsumida 和 K.Hosoda:“基于视觉的强化学习获得的多种行为的协调”Proc.of IEEE/RSJ/GI 智能机器人和系统国际会议。
DOI:
--
发表时间:
期刊:
影响因子:
--
作者:
[]
通讯作者:
M.Asada,S.Nada,S.Tawaratsumida,and K.Hosoda: "Purposive Behavicr Acquisition On A Real Robot By Vision-Based Reinforcemeut Learning" Proc.of MLC-COLT(Machine Learning Confernce and Computer Learning Theory)Workshop on Robot Learning. 1-9 (1994)
M.Asada、S.Nada、S.Tawaratsumida 和 K.Hosoda:“通过基于视觉的强化学习对真实机器人进行有目的行为获取”Proc.of MLC-COLT(机器学习会议和计算机学习理论)机器人研讨会
DOI:
--
发表时间:
期刊:
影响因子:
--
作者:
[]
通讯作者:
M.Asada,E.Uchibe,S.Noda,S.Tawaratsumida and K.Hosoda: "Vision-Based Reinforcemeut Learning For Cocrdination Of Soccer Playing Behaviors" Proc.of AAAI-94 Workshop on AI,Artificial Life,and Entertainment. 16-21 (1994)
M.Asada、E.Uchibe、S.Noda、S.Tawaratsumida 和 K.Hosoda:“用于协调足球比赛行为的基于视觉的强化学习”Proc.of AAAI-94 人工智能、人工生命和娱乐研讨会。
DOI:
--
发表时间:
期刊:
影响因子:
--
作者:
[]
通讯作者:
浅田,野田,俵積田,細田: "「視覚に基づく強化学習によるロボットの行動獲得」" 日本ロボット学会誌. vol.13,no.1. 68-74 (1995)
Asada、Noda、Tawara Tsukuda、Hosoda:“通过基于视觉的强化学习获取机器人行为”,日本机器人学会杂志,第 13 卷,第 68-74 期(1995 年)。
DOI:
--
发表时间:
期刊:
影响因子:
--
作者:
[]
通讯作者:
養育者との相互作用発達研究のための乳幼児様発声ロボットの製作および検証
-
批准号:24650094
-
项目类别:Grant-in-Aid for Challenging Exploratory Research
-
资助金额:$2.5万
-
财政年份:2012
-
负责人:浅田 稔
-
依托单位:
構成的手法による身体バブリングから社会性獲得にいたる発達過程の理解と構築
-
批准号:22220002
-
项目类别:Grant-in-Aid for Scientific Research (S)
-
资助金额:$97.18万
-
财政年份:2010
-
负责人:浅田 稔
-
依托单位:
多様な構成的手法の融合に基づく言語創発過程の統合的理解
-
批准号:17630001
-
项目类别:Grant-in-Aid for Scientific Research (C)
-
资助金额:$2.11万
-
财政年份:2005
-
负责人:浅田 稔
-
依托单位:
自己と他者の同一性仮説に基づく他者の行動理解のための模倣技能の獲得
-
批准号:13875051
-
项目类别:Grant-in-Aid for Exploratory Research
-
资助金额:$1.34万
-
财政年份:2001
-
负责人:浅田 稔
-
依托单位:
オートポイエ-シス理論の応用によるロボットの自律性の創製に関する研究
-
批准号:08875055
-
项目类别:Grant-in-Aid for Exploratory Research
-
资助金额:$0.96万
-
财政年份:1996
-
负责人:浅田 稔
-
依托单位:
強化学習による移動ロボットのための状態空間の自動構成法に関する研究
-
批准号:08233213
-
项目类别:Grant-in-Aid for Scientific Research on Priority Areas
-
资助金额:$1.15万
-
财政年份:1996
-
负责人:浅田 稔
-
依托单位:
感覚と行動のマッピングに基づく移動ロボットの行動獲得及び統合に関する研究
-
批准号:08235213
-
项目类别:Grant-in-Aid for Scientific Research on Priority Areas
-
资助金额:$1.92万
-
财政年份:1996
-
负责人:浅田 稔
-
依托单位:
感覚と行動のマッピングに基づく移動ロボットの行動獲得及び統合に関する研究
-
批准号:07245214
-
项目类别:Grant-in-Aid for Scientific Research on Priority Areas
-
资助金额:$1.79万
-
财政年份:1995
-
负责人:浅田 稔
-
依托单位:
強化学習による移動ロボットのための状態空間の自動構成法に関する研究
-
批准号:07243214
-
项目类别:Grant-in-Aid for Scientific Research on Priority Areas
-
资助金额:$1.41万
-
财政年份:1995
-
负责人:浅田 稔
-
依托单位:
濃淡情報の定性的な性質と輪郭線情報を統合利用した3次元物体の形状及び姿勢の復元
-
批准号:05650395
-
项目类别:Grant-in-Aid for General Scientific Research (C)
-
资助金额:$1.22万
-
财政年份:1993
-
负责人:浅田 稔
-
依托单位:
センサ情報のシンボリックレベルの記述の融合による移動ロボットの環境理解
-
批准号:01750336
-
项目类别:Grant-in-Aid for Encouragement of Young Scientists (A)
-
资助金额:$0.64万
-
财政年份:1989
-
负责人:浅田 稔
-
依托单位:
階層地図による移動ロボットのセンサ情報の融合と理解
-
批准号:63750355
-
项目类别:Grant-in-Aid for Encouragement of Young Scientists (A)
-
资助金额:$0.51万
-
财政年份:1988
-
负责人:浅田 稔
-
依托单位:
3次元運動記述パラメータによる生体動作の表現法の研究
-
批准号:59750278
-
项目类别:Grant-in-Aid for Encouragement of Young Scientists (A)
-
资助金额:$0.64万
-
财政年份:1984
-
负责人:浅田 稔
-
依托单位:
海外基金