课题基金 / 基金详情

統計的声質変換を用いた無喉頭音声の品質改善

統計的声質変換を用いた無喉頭音声の品質改善
使用统计语音转换提高非喉部语音的质量
批准号:
11J08741
负责人:
土井 啓成
金额:
$0.83万
依托单位国家:
日本
项目类别:
Grant-in-Aid for JSPS Fellows
财政年份:
2011
资助国家:
日本
项目状态:
已结题
起止时间:
2011 至 2012

项目摘要

项目成果

相关文献

中文摘要
翻译
本研究は,事故や病気等で喉頭を摘出した喉頭摘出者が発声する無喉頭音声の品質を,統計的声質変換を用いて改善することにより,喉頭摘出者のQOL (Quality of Life)改善を目的とした.喉頭摘出者は,呼気を利用した発声が行えないため,無喉頭音声と呼ばれる音声を用いて,音声コミュニケーションを行うが,その音質は非常に低く,また,話者の判別がつかない.そこで,本研究では,統計的声質変換を応用し,無喉頭音声の音質と話者性の改善を試みた.統計的声質変換とは,ある話者の声を別の話者の声に変換する技術であり,これを用いて,無喉頭音声を健常者の通常音声に変換することで,その音質を改善する.また,さらに1対多固有声変換を用いることで,話者性の回復も試みた.一対多固有声変換とは,変換先の音声の声質を任意に操作することができる技術である.これを用いることで,喉頭摘出者は,任意の声質で発声することが可能になり,それはすなわち,声質におけるアイデンティティーの確立につながる.本研究では,食道音声,電気音声,微弱電気音声の3つの無喉頭音声に対し,一対多固有声変換による品質改善法を導入し,それらを総合的に評価した.評価の結果,提案法が各種音声の音質を大きく改善し,話者性の回復も見込めることが分かった.また,提案法により生成された変換音声を,詳細に比較したことにより,提案法を用いた際の各無喉頭音声における利点等が明らかになった.この結果は,喉頭摘出者が用いる無喉頭音声を選ぶ際の指標の一つとなり得るものである.さらに,提案法の実用化に向けて,提案法のアプリケーションの作成を試みた.ただし,より使いやすいインターフェース作成のため,より多くの被験者が見込める歌声変換用アプリケーションとして作成し,また,そのあたりをまとめて学会等に発表した.その結果,多くの意見が得られ,使いやすいインターフェースができた.しかしながら,そのインターフェースと提案法をつなぎ合わせるところまでは至れなかった.
英文摘要
本研究は,事故や病気等で喉頭を摘出した喉頭摘出者が発声する無喉頭音声の品質を,統計的声質変換を用いて改善することにより,喉頭摘出者のQOL (Quality of Life)改善を目的とした.喉頭摘出者は,呼気を利用した発声が行えないため,無喉頭音声と呼ばれる音声を用いて,音声コミュニケーションを行うが,その音質は非常に低く,また,話者の判別がつかない.そこで,本研究では,統計的声質変換を応用し,無喉頭音声の音質と話者性の改善を試みた.統計的声質変換とは,ある話者の声を別の話者の声に変換する技術であり,これを用いて,無喉頭音声を健常者の通常音声に変換することで,その音質を改善する.また,さらに1対多固有声変換を用いることで,話者性の回復も試みた.一対多固有声変換とは,変換先の音声の声質を任意に操作することができる技術である.これを用いることで,喉頭摘出者は,任意の声質で発声することが可能になり,それはすなわち,声質におけるアイデンティティーの確立につながる.本研究では,食道音声,電気音声,微弱電気音声の3つの無喉頭音声に対し,一対多固有声変換による品質改善法を導入し,それらを総合的に評価した.評価の結果,提案法が各種音声の音質を大きく改善し,話者性の回復も見込めることが分かった.また,提案法により生成された変換音声を,詳細に比較したことにより,提案法を用いた際の各無喉頭音声における利点等が明らかになった.この結果は,喉頭摘出者が用いる無喉頭音声を選ぶ際の指標の一つとなり得るものである.さらに,提案法の実用化に向けて,提案法のアプリケーションの作成を試みた.ただし,より使いやすいインターフェース作成のため,より多くの被験者が見込める歌声変換用アプリケーションとして作成し,また,そのあたりをまとめて学会等に発表した.その結果,多くの意見が得られ,使いやすいインターフェースができた.しかしながら,そのインターフェースと提案法をつなぎ合わせるところまでは至れなかった.
期刊论文(0)
专著(0)
科研奖励(0)
会议论文
多対多固有声変換に基づく歌声声質変換及び歌声合成を用いた学習データ生成
基于多对多特征语音转换的歌声质量转换和歌声合成的训练数据生成
DOI: --
发表时间: 2012
期刊:
影响因子: --
作者: [S. Harish, K. Ishikawa, E. Einarsson, S. Aikawa, T. Inoue, P. Zhao, M. Watanabe, S. Chiashi, J. Shiomi, S. Maruyama, 土井 啓成]
通讯作者: 土井 啓成
VocaListenerによる学習データ生成を利用した多対多固有声変換に基く歌声声質変換
基于使用 VocaListener 学习数据生成的多对多特征语音转换的歌声音质转换
DOI: --
发表时间: 2012
期刊:
影响因子: --
作者: [S.Chiashi, H.Okabe, T.Inoue, I.Shiomi, T.Sato, S.Kono, M.Terasawa, S.Maruyama, 土井 啓成]
通讯作者: 土井 啓成
DOI: --
发表时间: 2012-12
期刊: Proceedings of The 2012 Asia Pacific Signal and Information Processing Association Annual Summit and Conference
影响因子: --
作者: [Hironori Doi;T. Toda;Tomoyasu Nakano;Masataka Goto;Satoshi Nakamura]
通讯作者: Hironori Doi;T. Toda;Tomoyasu Nakano;Masataka Goto;Satoshi Nakamura
DOI: 10.1109/icassp.2011.5947513
发表时间: 2011-05
期刊: 2011 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)
影响因子: --
作者: [Hironori Doi;Keigo Nakamura;T. Toda;H. Saruwatari;K. Shikano]
通讯作者: Hironori Doi;Keigo Nakamura;T. Toda;H. Saruwatari;K. Shikano