课题基金 / 基金详情

複数センサの融合による発声動作からの発話内容の推定と発声補助デバイスへの応用

複数センサの融合による発声動作からの発話内容の推定と発声補助デバイスへの応用
通过融合多个传感器并应用于语音辅助设备来估计声音运动的语音内容
批准号:
21K11941
负责人:
大田 健紘
金额:
$2.58万
依托单位国家:
日本
项目类别:
Grant-in-Aid for Scientific Research (C)
财政年份:
2021
资助国家:
日本
项目状态:
已结题
起止时间:
2021-04-01 至 2024-03-31

项目摘要

项目成果

相似基金

相关文献

中文摘要
翻译
点击翻译按钮获取中文摘要
英文摘要
本研究では、音声を発することなく口の動きをもとに発話内容を推定する技術(以降、無発声音声認識)について検討する。本研究では、声帯を除去するなど発声が困難となった人の発話を補助することや、既存の音声認識を補助することを目的としている。令和3年度には、正面以外の様々な方向を向いた状態での無発声音声認識や複数のセンサーを利用した無発声音声認識を実現する手法を検討した。そして、令和4年度は、「無発声音声認識を実用的なものとするために、文章での認識の可能性について検討すること」を目的として研究を行った。令和3年度に構築した無発声音声認識システムは単語単位での認識であったため、令和4年度は連続音声認識でも用いられている深層ニューラルネットワークを導入し、音素単位での無発声音声認識の性能を明らかにする。令和4年度の成果は以下の通りである。連続音声認識でも用いられている深層ニューラルネットワークとしてDeepSpeech2を採用した。ただし、無発声音声認識に適用するにあたり、層の数を追加・削除することでより認識精度の高いネットワークを検討した。さらに、深層ニューラルネットワークの学習及び認識精度の評価に用いる話者数を増やし、学習データの話者と評価データの話者が異なる条件での評価も行った。その結果、未知の話者であっても約30%の誤差率が実現できた。ただし、認識結果の詳細を確認したところ、単語ごとに認識率に偏りがあったため、学習に用いた音素に偏りがあると考えられる。
期刊论文(0)
专著(0)
科研奖励(0)
会议论文
DOI: --
发表时间: 2022
期刊:
影响因子: --
作者: [草本雅也, 大田健紘]
通讯作者: 大田健紘
深層学習に顔の3次元モデルを用いた無発声単語認識に関する研究
使用 3D 面部模型进行深度学习的潜言词识别研究
DOI: --
发表时间: 2022
期刊:
影响因子: --
作者: [和田竜二, 大田健紘]
通讯作者: 大田健紘
機械読唇における三次元モデルを用いたデータ拡張が認識精度に与える影響
使用 3D 模型进行数据增强对机器唇读识别精度的影响
DOI: --
发表时间: 2023
期刊:
影响因子: --
作者: [木村一馬, 大田健紘]
通讯作者: 大田健紘
国内基金
海外基金
人类语言学习的神经机制:婴儿音素学习关键期的脑功能影像追踪研究
  • 批准号:
    32100867
  • 项目类别:
    青年科学基金项目(C类)
  • 资助金额:
    30.0万元
  • 批准年份:
    2021
  • 负责人:
    郁曦
  • 依托单位:
汉语神经分析系统模型与行为研究
  • 批准号:
    61373065
  • 项目类别:
    面上项目
  • 资助金额:
    76.0万元
  • 批准年份:
    2013
  • 负责人:
    张少白
  • 依托单位:
具有多音素过渡与韵律特征的电子喉元音/辅音异位等效嗓音源合成理论方法与应用实验研究
  • 批准号:
    11274250
  • 项目类别:
    面上项目
  • 资助金额:
    85.0万元
  • 批准年份:
    2012
  • 负责人:
    万明习
  • 依托单位:
藏语音素拼读法文语转换技术研究
  • 批准号:
    61262051
  • 项目类别:
    地区科学基金项目
  • 资助金额:
    45.0万元
  • 批准年份:
    2012
  • 负责人:
    才让卓玛
  • 依托单位: