マルチモーダル音声認識・合成によるインターフェースの構築
マルチモーダル音声認識・合成によるインターフェースの構築
批准号:
10780226
负责人:
徳田 恵一
金额:
$1.47万
依托单位国家:
日本
项目类别:
Grant-in-Aid for Encouragement of Young Scientists (A)
财政年份:
1998
资助国家:
日本
项目状态:
已结题
起止时间:
1998 至 1999
中文摘要
点击翻译按钮获取中文摘要
英文摘要
人間が関わるコミュニケーションにおいては、視覚と聴覚情報の担う役割が非常に大きい。このため,人間に優しいヒューマンインターフェースを実現する上で,視覚・聴覚を融合したマルチモーダルインターフェースの開発が重要な課題となっている。このようなマルチモーダルインターフェースの一つとして,音声と唇動画像による「バイモーダル音声認識」と,任意の文字テキストから自然な音声と唇の動きを同時に生成する「バイモーダル音声合成」を,「バイモーダル音声入出力システム」として統一された枠組の中で実現することを目指し,以下のような研究を行った.・唇画像データベースの作成:音節または音素を単位とするHMM作成のために必要な唇画像を音声と同期して収録した。また,同期収録音声に基づいてラベル付けを行った。・唇動画像による音声認識唇のためのHMMの学習法について検討し,新たに提案した位置の正規化学習が効果的であることを示した.・唇動画像の生成については,輪郭モデルを用いるものと,画像ベースのものとを並行して,検討した.いずれにおいても,これまでに提案したHMMからのパラメータ生成アルゴリズムを用いることにより,良好な唇動画像を生成できることを確かめた.・以上の成果に基づいて,「入力音声に同期した唇動画像を生成するシステム」,「テキストから,音声と唇動画像を同時に生成するシステム」などを構築し,それらの有用性を示した.
期刊论文(35)
专著(0)
科研奖励(0)
会议论文
登录
查看更多内容
Oscar Vanegas: "Intensity/Iocation normalization for automatice lipreading" Proc. International Conference on Signal Processing. vol.2. 920-923 (1998)
Oscar Vanegas:“自动唇读的强度/位置标准化”Proc。
DOI:
--
发表时间:
期刊:
影响因子:
--
作者:
[]
通讯作者:
K,Tokuda: "Speech parameter generation algorithms for HMM-based speech synthesis"Proceedings of International Conference on Acoustics,Speech,and Signal Processing. (採録決定済). (2000)
K,Tokuda:“基于 HMM 的语音合成的语音参数生成算法”国际声学、语音和信号处理会议论文集(已接受)。
DOI:
--
发表时间:
期刊:
影响因子:
--
作者:
[]
通讯作者:
O.Vanegas: "Location normalization of HMM-based lip reading : Experiments for the M2VTS Database"IEEE International Conference on Image Processing. (1999)
O.Vanegas:“基于 HMM 唇读的位置标准化:M2VTS 数据库的实验”IEEE 国际图像处理会议。
DOI:
--
发表时间:
期刊:
影响因子:
--
作者:
[]
通讯作者:
Masatsune Tamura: "Visual speech synthesis based on parameter generation from HMM:speech-driven and text-and-speech-driven approach" Proc. International Conference of Auditory-Visual Speech Proccssing. 219-224 (1998)
Masatsune Tamura:“基于 HMM 参数生成的视觉语音合成:语音驱动和文本和语音驱动方法”Proc。
DOI:
--
发表时间:
期刊:
影响因子:
--
作者:
[]
通讯作者:
T.Yoshimura: "Simultaneous modeling of spectrum,pitch and duration in HMM-based speech synthesis"Proceedings of European Conference on Speech Communication and Technology. (1999)
T.Yoshimura:“基于 HMM 的语音合成中频谱、音调和持续时间的同步建模”欧洲语音通信与技术会议论文集。
DOI:
--
发表时间:
期刊:
影响因子:
--
作者:
[]
通讯作者:
共 27 条
深層学習に基づいた新世代音声・オーディオ信号生成に関する研究
-
批准号:23K24870
-
项目类别:Grant-in-Aid for Scientific Research (B)
-
资助金额:$3.33万
-
财政年份:2024
-
负责人:徳田 恵一
-
依托单位:
Next-generation audio and speech processing architectures based on deep learning
-
批准号:22H03614
-
项目类别:Grant-in-Aid for Scientific Research (B)
-
资助金额:$11.07万
-
财政年份:2022
-
负责人:徳田 恵一
-
依托单位:
t分布仮定に基づくロバストスペクトル推定
-
批准号:97F00343
-
项目类别:Grant-in-Aid for JSPS Fellows
-
资助金额:$0.77万
-
财政年份:1998
-
负责人:徳田 恵一
-
依托单位:
隠れマルコフモデルを用いた認識ボコーダー極低ビットレート音声符号化-
-
批准号:08780333
-
项目类别:Grant-in-Aid for Encouragement of Young Scientists (A)
-
资助金额:$0.64万
-
财政年份:1996
-
负责人:徳田 恵一
-
依托单位:
隠れマルコフモデルを用いた音声の規則合成-喜怒哀楽の表現を目指して-
-
批准号:07858043
-
项目类别:Grant-in-Aid for Encouragement of Young Scientists (A)
-
资助金额:$0.58万
-
财政年份:1995
-
负责人:徳田 恵一
-
依托单位:
音声データ圧縮・蓄積システムの高品質・低ビットレート化に関する研究
-
批准号:06750373
-
项目类别:Grant-in-Aid for Encouragement of Young Scientists (A)
-
资助金额:$0.58万
-
财政年份:1994
-
负责人:徳田 恵一
-
依托单位:
適応メルケプストラム分析法に基づく音声の高能率符号化法に関する研究
-
批准号:04750270
-
项目类别:Grant-in-Aid for Encouragement of Young Scientists (A)
-
资助金额:$0.51万
-
财政年份:1992
-
负责人:徳田 恵一
-
依托单位: