マイクロホンアレーを用いた音環境の認識に関する研究
マイクロホンアレーを用いた音環境の認識に関する研究
批准号:
12780259
负责人:
山田 武志
金额:
$1.15万
依托单位:
依托单位国家:
日本
项目类别:
Grant-in-Aid for Encouragement of Young Scientists (A)
财政年份:
2000
资助国家:
日本
项目状态:
已结题
起止时间:
2000 至 2001
中文摘要
1.個々の音を抽出する技術:マイクロホンアレーによる音源抽出法において,複数の音源の位置を同時に推定し,かつ個々の音源の移動を追尾する機能を実現するために,3次元トレリス法の適用について検討している.3次元トレリス法の性能は,マイクロホンアレーの指向性ビームの鋭さが十分ではなく,他の方向からの音が重畳するような場合,大きく低下してしまう.この問題に対処するための方法としては,複数の環境音が重畳している区間を事前に検出し,あらかじめ重畳を考慮したモデルを用意することが考えられる.本研究では,環境音モデルとHMM合成法を用いて複数の環境音が重畳している区間を検出する方法を提案した.孤立単語,連続単語,文章と環境音が重畳している状況を想定した評価実験を行った結果,環境音が重畳している区間,重畳している環境音の種類とそのSN比を良好に検出できることが分かった.今後,このような重畳区間情報を利用して,3次元トレリス法の性能改善を図る予定である.2.個々の音を認識する技術:HMMにより環境音をモデル化する際,HMMの単位と構造(状態数や状態の接続形態など)について検討する必要がある.まず,92種類の環境音を数種類の構造でモデル化し,認識実験を行った.その結果,環境音によって適した構造は異なっており,認識率に大きな差が生じることが分かった.次に,92種類の環境音を尤度最大化基準に基いてクラスタリングした結果,音響的に似た環境音同士がマージされるものの,クラスタリングの過程で構造を適応的に変化させる必要があることが分かった.そこで,HMMの単位や構造を,同じ基準の下で同時かつ自動的に決定する方法として,逐次状態分割による隠れマルコフ網の自動生成法を適用し,評価実験によりその有効性を確認した.今後,自動的に環境音を収録し,環境音のモデルを逐次的に更新する手法について検討する予定である.
英文摘要
1.個々の音を抽出する技術:マイクロホンアレーによる音源抽出法において,複数の音源の位置を同時に推定し,かつ個々の音源の移動を追尾する機能を実現するために,3次元トレリス法の適用について検討している.3次元トレリス法の性能は,マイクロホンアレーの指向性ビームの鋭さが十分ではなく,他の方向からの音が重畳するような場合,大きく低下してしまう.この問題に対処するための方法としては,複数の環境音が重畳している区間を事前に検出し,あらかじめ重畳を考慮したモデルを用意することが考えられる.本研究では,環境音モデルとHMM合成法を用いて複数の環境音が重畳している区間を検出する方法を提案した.孤立単語,連続単語,文章と環境音が重畳している状況を想定した評価実験を行った結果,環境音が重畳している区間,重畳している環境音の種類とそのSN比を良好に検出できることが分かった.今後,このような重畳区間情報を利用して,3次元トレリス法の性能改善を図る予定である.2.個々の音を認識する技術:HMMにより環境音をモデル化する際,HMMの単位と構造(状態数や状態の接続形態など)について検討する必要がある.まず,92種類の環境音を数種類の構造でモデル化し,認識実験を行った.その結果,環境音によって適した構造は異なっており,認識率に大きな差が生じることが分かった.次に,92種類の環境音を尤度最大化基準に基いてクラスタリングした結果,音響的に似た環境音同士がマージされるものの,クラスタリングの過程で構造を適応的に変化させる必要があることが分かった.そこで,HMMの単位や構造を,同じ基準の下で同時かつ自動的に決定する方法として,逐次状態分割による隠れマルコフ網の自動生成法を適用し,評価実験によりその有効性を確認した.今後,自動的に環境音を収録し,環境音のモデルを逐次的に更新する手法について検討する予定である.
期刊论文(18)
专著(0)
科研奖励(0)
会议论文
登录
查看更多内容
渡部生聖: "環境音モデルとHMM合成による音声区間検出法の文章発話への適用"電子情報通信学会研究技術報告, SP2001-88. 25-30 (2001)
Isei Watabe:“使用环境声音模型和 HMM 合成的语音区间检测方法在书面话语中的应用”IEICE 研究技术报告,SP2001-88 (2001)。
DOI:
--
发表时间:
期刊:
影响因子:
--
作者:
[]
通讯作者:
Takeshi Yamada: "Voice activity detection using non-speech models and HMM composition"Proc. Workshop on Hands-free Speech Communication. 131-134 (2001)
Takeshi Yamada:“使用非语音模型和 HMM 组合进行语音活动检测”Proc。
DOI:
--
发表时间:
期刊:
影响因子:
--
作者:
[]
通讯作者:
渡部生聖: "環境音モデルとHMM合成による音声区間検出法"日本音響学会講演論文集. 発表予定. (2001)
Kiyoshi Watanabe:“使用环境声音模型和 HMM 合成的语音间隔检测方法”,日本声学学会会议记录(2001 年)。
DOI:
--
发表时间:
期刊:
影响因子:
--
作者:
[]
通讯作者:
渡部生聖: "環境音モデルとHMM合成による音声区間検出法"日本音響学会講演論文集. 109-110 (2001)
Kiyoshi Watanabe:“使用环境声音模型和 HMM 合成的语音间隔检测方法”日本声学学会会议记录 109-110(2001)。
DOI:
--
发表时间:
期刊:
影响因子:
--
作者:
[]
通讯作者:
Takeshi Yamada: "Voice activity detection using non-speech models and HMM composition"Proc.Workshop on Hands-free Speech Communication. 発表予定. (2001)
Takeshi Yamada:“使用非语音模型和 HMM 组合进行语音活动检测”Proc.免提语音通信研讨会(2001 年)。
DOI:
--
发表时间:
期刊:
影响因子:
--
作者:
[]
通讯作者:
共 9 条
空間アテンション機構に基づく新しい音響シーン識別手法の確立
-
批准号:20K11880
-
项目类别:Grant-in-Aid for Scientific Research (C)
-
资助金额:$2.58万
-
财政年份:2020
-
负责人:山田 武志
-
依托单位:
海外基金