课题基金 / 基金详情

音節セグメントの同定に基づく音声の超極低ビット符号化合成方式の研究

音節セグメントの同定に基づく音声の超極低ビット符号化合成方式の研究
基于音节段识别的语音超低比特编码合成方法研究
批准号:
62550243
负责人:
中川 聖一
金额:
$1.28万
依托单位国家:
日本
项目类别:
Grant-in-Aid for General Scientific Research (C)
财政年份:
1987
资助国家:
日本
项目状态:
已结题
起止时间:
1987 至 --

项目摘要

项目成果

中川 聖一的其他基金

相关文献

中文摘要
翻译
音声の極低ビット符号化・合成方式として, ベクトル量子化手法をセグメント単位に拡張したセグメント量子化(マトリックス量子化)法が提案され, 150〜200bit/Sの極低ビット符号化で, 明瞭度の優れた合成音が得られている. しかし, これらの手法は従来からの符号化の範ちゅう内のもので, パターン(音声特徴パラメータ・ベクトル)の統計的分布の偏りは(VQ手法を通して)利用しているが, 情報源の内容は積極的には利用されていない. 更に低符号化を実現するには言語に依存した符号化法を導入する必要があった.本研究では, 情報源の内容まで立ち入った音声の超極低ビット符号化法, いわゆる知的符号化・認識符号化(認識ボ.コーダ)に関して新しい方式を提案した.まず初めに, 入力音波を音声分析し, 10msごとにPARCOR係数, ピッチ周波数, パワーを抽出する. これらの特徴パラメータの時系列とあらかじめ作成されている約500個の音節標準パターン(同様な特徴パラメータ時系列)と照合し, 最適な音節系列に変換する. 音節符号化のために9ビット, ピッチ, パワー, 継続時間長はそれぞれ7レベル, 5レベル, 3レベルで表現し, 合計105通り(7ビット)で表現する.合成時には, これらの符号化手続きの逆手順で達成する. つまり, 対応する音節標準パターンの原波形をピッチ, パワー, 継続時間長に従って線形に補間しながら接続し, 合成する.次に, 音節単位への符号化精度を上げるために, HMMをベイズ識別法とを用いたセグメンテーションアルゴリズムを提案した. その結果, ヒューソスティックな継続時間制御を使用して, 音節の繰り返しになっているデータのみの場合95%以上, 音節データに撥音, 長母音, 二重母音を加えた場合93%以上のセグメンテーション率が得られた.
英文摘要
音声の極低ビット符号化・合成方式として, ベクトル量子化手法をセグメント単位に拡張したセグメント量子化(マトリックス量子化)法が提案され, 150〜200bit/Sの極低ビット符号化で, 明瞭度の優れた合成音が得られている. しかし, これらの手法は従来からの符号化の範ちゅう内のもので, パターン(音声特徴パラメータ・ベクトル)の統計的分布の偏りは(VQ手法を通して)利用しているが, 情報源の内容は積極的には利用されていない. 更に低符号化を実現するには言語に依存した符号化法を導入する必要があった.本研究では, 情報源の内容まで立ち入った音声の超極低ビット符号化法, いわゆる知的符号化・認識符号化(認識ボ.コーダ)に関して新しい方式を提案した.まず初めに, 入力音波を音声分析し, 10msごとにPARCOR係数, ピッチ周波数, パワーを抽出する. これらの特徴パラメータの時系列とあらかじめ作成されている約500個の音節標準パターン(同様な特徴パラメータ時系列)と照合し, 最適な音節系列に変換する. 音節符号化のために9ビット, ピッチ, パワー, 継続時間長はそれぞれ7レベル, 5レベル, 3レベルで表現し, 合計105通り(7ビット)で表現する.合成時には, これらの符号化手続きの逆手順で達成する. つまり, 対応する音節標準パターンの原波形をピッチ, パワー, 継続時間長に従って線形に補間しながら接続し, 合成する.次に, 音節単位への符号化精度を上げるために, HMMをベイズ識別法とを用いたセグメンテーションアルゴリズムを提案した. その結果, ヒューソスティックな継続時間制御を使用して, 音節の繰り返しになっているデータのみの場合95%以上, 音節データに撥音, 長母音, 二重母音を加えた場合93%以上のセグメンテーション率が得られた.
期刊论文(3)
专著(0)
科研奖励(0)
会议论文
中川聖一: "確率モデルによる音声認識" 電子情報通信学会, (1988)
Seiichi Nakakawa:“使用概率模型进行语音识别”IEICE,(1988)
DOI: --
发表时间:
期刊:
影响因子: --
作者: []
通讯作者:
橋本泰秀, 中川聖一: 電子情報通信学会, 音声技術報告. SP87-99. 13-18 (1987)
Yasuhide Hashimoto,Seiichi Nakakawa:电子、信息和通信工程师协会,语音技术报告 SP87-18 (1987)。
DOI: --
发表时间:
期刊:
影响因子: --
作者: []
通讯作者:
中川聖一, 安本太一: 日本音響学会, 講演論文集(春季). 1-1-10. 135-136 (1988)
Seiichi Nakakawa、Taichi Yasumoto:日本声学学会,会议记录(春季)1-1-136(1988 年)。
DOI: --
发表时间:
期刊:
影响因子: --
作者: []
通讯作者:
実世界環境下における遠隔発話の音声認識と話者認識およびインデックス化に関する研究
  • 批准号:
    19650040
  • 项目类别:
    Grant-in-Aid for Challenging Exploratory Research
  • 资助金额:
    $2.05万
  • 财政年份:
    2007
  • 负责人:
    中川 聖一
  • 依托单位:
セマンティックディジタルアーカイブのための音声・映像・言語の統合的処理
  • 批准号:
    15630003
  • 项目类别:
    Grant-in-Aid for Scientific Research (C)
  • 资助金额:
    $2.18万
  • 财政年份:
    2003
  • 负责人:
    中川 聖一
  • 依托单位:
音声言語処理技術と学習者モデルを用いた語学学習システムの研究
  • 批准号:
    12040104
  • 项目类别:
    Grant-in-Aid for Scientific Research on Priority Areas
  • 资助金额:
    $58.56万
  • 财政年份:
    2000
  • 负责人:
    中川 聖一
  • 依托单位:
外国語コミュニケーション能力の総合的な養成研究
  • 批准号:
    12040103
  • 项目类别:
    Grant-in-Aid for Scientific Research on Priority Areas
  • 资助金额:
    $1.86万
  • 财政年份:
    2000
  • 负责人:
    中川 聖一
  • 依托单位: