ベイズ基準に基づく幾何学的変動に頑健な画像認識モデルの構築
ベイズ基準に基づく幾何学的変動に頑健な画像認識モデルの構築
批准号:
15J08391
负责人:
沢田 慶
金额:
$1.22万
依托单位国家:
日本
项目类别:
Grant-in-Aid for JSPS Fellows
财政年份:
2015
资助国家:
日本
项目状态:
已结题
起止时间:
2015-04-24 至 2017-03-31
中文摘要
点击翻译按钮获取中文摘要
英文摘要
従来の統計モデルに基づく画像認識手法の多くは,モデルの学習のみに注目して研究されてきた.しかし,画像認識用の統計モデルを学習するためには,画像の切り出し,各種正規化,特徴抽出などの事前処理が必要となる.これらの事前処理は,認識対象に強く依存するため,人手による画像の切り出しやヒューリスティックな正規化処理が用いられてきたが,認識対象ごとにヒューリスティックな方法で事前処理を設計することは高いコストを必要とする.本研究では,認識対象の位置や大きさの正規化をモデル化することができる分離型格子隠れマルコフモデル (SL-HMM) や,SL-HMMと因子分析を統合した可変固有画像モデル (HMEM) に注目して,幾何学的変動に頑健なモデルの高精度化を行う.これらのモデルは従来では煩雑であった事前処理とモデルの学習を同時に最適化することができるため,認識対象ごとに事前処理を設計する必要がなく汎用性が高い手法である.本年度は,ベイズ基準の近似計算を行う変分ベイズ法に確定的アニーリングEMアルゴリズムを適用し,HMEMの学習を行った.顔画像認識や手書き数字認識実験により,提案した学習アルゴリズムは,学習データが少量の場合であっても精度の高いHMEMを学習できることを示した. さらに,近年注目を集めているディープラーニングに基づく手法である畳み込みニューラルネットワーク (CNN) と提案法の比較実験を行った.比較実験より,学習データが少量の条件や,認識対象に位置や大きさの変動が多く含まれる条件においては,提案法はCNNより高い認識性能を示すことが確認できた.
期刊论文(0)
专著(0)
科研奖励(0)
会议论文
登录
查看更多内容
統計的パラメトリック音声合成のためのオーディオブックを用いた学習コーパス自動構築
使用有声读物自动构建学习语料库进行统计参数语音合成
DOI:
--
发表时间:
2016
期刊:
影响因子:
--
作者:
[沢田慶, 伊神和輝, 浅井千明, 佐藤雄介, 橋本佳, 大浦圭一郎, 南角吉彦, 徳田恵一]
通讯作者:
徳田恵一
発音情報が未知の言語におけるテキスト音声合成システム構築法の検討
发音信息未知语言的文语音合成系统构建方法研究
DOI:
--
发表时间:
2015
期刊:
影响因子:
--
作者:
[沢田慶, 橋本佳, 大浦圭一郎, 南角吉彦, 徳田 恵一]
通讯作者:
徳田 恵一
画像認識のための混合出力分布を用いた分離型格子HMMにおけるパラメータ共有構造の検討
图像识别中使用混合输出分布的可分离格HMM参数共享结构研究
DOI:
--
发表时间:
2016
期刊:
影响因子:
--
作者:
[酒井和幸, 熊谷大慧, 阿部五月, 渡邉洋輔, 山田直也, 古川英光, 藤本拓, 南絵里菜, 光上義朗, 足立芳史, 助川 正人,沢田 慶,橋本 佳,南角 吉彦,徳田 恵一]
通讯作者:
助川 正人,沢田 慶,橋本 佳,南角 吉彦,徳田 恵一
The NITech text-to-speech system for the Blizzard Challenge 2016
用于 2016 年暴雪挑战赛的 NITech 文本转语音系统
DOI:
--
发表时间:
2016
期刊:
影响因子:
--
作者:
[Kei Sawada, Chiaki Asai, Kei Hashimoto, Keiichiro Oura, and Keiichi Tokuda]
通讯作者:
and Keiichi Tokuda
分離型格子HMMによる特徴量生成を用いた識別モデルに基づく画像認識
基于使用可分离格HMM特征生成的判别模型的图像识别
DOI:
--
发表时间:
2016
期刊:
影响因子:
--
作者:
[K. Ahmed, Y. Watanabe, T. Higashihara, H. Arafune, T. Kamijo, T. Morinaga, T. Sato, M. Makino, M. Kawakami, and H. Furukawa, 都築 良成,沢田 慶,橋本 佳,南角 吉彦,徳田 恵一]
通讯作者:
都築 良成,沢田 慶,橋本 佳,南角 吉彦,徳田 恵一
共 11 条
海外基金