三次元・ダイナミクスを制御可能な画像・動画像生成モデルの教師無し学習による構築
三次元・ダイナミクスを制御可能な画像・動画像生成モデルの教師無し学習による構築
批准号:
21J13214
负责人:
野口 敦裕
金额:
$0.96万
依托单位:
依托单位国家:
日本
项目类别:
Grant-in-Aid for JSPS Fellows
财政年份:
2021
资助国家:
日本
项目状态:
已结题
起止时间:
2021-04-28 至 2023-03-31
中文摘要
点击翻译按钮获取中文摘要
英文摘要
本研究では,三次元形状や姿勢のラベルが付いていない画像や動画像のデータから,映っている物体の三次元形状や物体の構造を推定し,その物体について三次元形状・構造・変形・見た目などの情報を明示的に自由に制御可能な画像・動画像生成モデルを構築する.本年度はまず,物体の骨格構造に関する事前知識を得られるという条件で,アノテーションがついていない二次元画像のみから物体の見た目・三次元形状・姿勢などを三次元的に自在に制御可能な画像生成モデルを教師なしで学習する手法の研究について,昨年度に引き続き取り組んだ.以前提案した多関節物体に特化した三次元表現を,敵対的生成ネットワークと呼ばれる画像生成モデルを用いた教師なし学習により学習する手法を提案した.得られた研究成果はコンピュータビジョン分野のトップ会議であるECCV2022に採択された.また,同様の学習や生成を,従来の手法と比較して効率よく行う新たな手法の考案を行った.次に,動いている関節物体を撮影した単眼動画のみから,関節位置のアノテーションや物体の構造に関する事前知識を一切使用せずに,物体の三次元形状・見た目・動き・パーツの分解・物体の明示的な構造を同時に再構成する手法を提案した.本手法は,物体に関する事前情報を使用しないため,物体の構造によらず学習可能である.また,物体の明示的な構造を推定するため,物体のポーズを自由に変化させながら画像を生成することができる.
期刊论文(10)
专著(0)
科研奖励(0)
会议论文
登录
查看更多内容
DOI:
10.1109/cvpr52688.2022.00366
发表时间:
2021-12
期刊:
2022 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR)
影响因子:
--
作者:
[Atsuhiro Noguchi;Umar Iqbal-;Jonathan Tremblay;T. Harada;Orazio Gallo]
通讯作者:
Atsuhiro Noguchi;Umar Iqbal-;Jonathan Tremblay;T. Harada;Orazio Gallo
NVIDIA(米国)
英伟达(美国)
DOI:
--
发表时间:
期刊:
影响因子:
--
作者:
[]
通讯作者:
Princeton University(米国)
普林斯顿大学(美国)
DOI:
--
发表时间:
期刊:
影响因子:
--
作者:
[]
通讯作者:
DOI:
10.48550/arxiv.2204.08839
发表时间:
2022-04
期刊:
影响因子:
--
作者:
[Atsuhiro Noguchi;Xiao Sun;Stephen Lin;Tatsuya Harada]
通讯作者:
Atsuhiro Noguchi;Xiao Sun;Stephen Lin;Tatsuya Harada
Microsoft Research Asia(中国)
微软亚洲研究院(中国)
DOI:
--
发表时间:
期刊:
影响因子:
--
作者:
[]
通讯作者:
共 6 条
海外基金