课题基金 / 基金详情

音声・画像の視聴覚情報のシンボル記述化による自然言語文法の帰納的学習法の研究

音声・画像の視聴覚情報のシンボル記述化による自然言語文法の帰納的学習法の研究
利用音频、图像等视听信息的符号描述进行自然语言语法归纳学习方法研究
批准号:
01550284
负责人:
中川 聖一
金额:
$1.28万
依托单位国家:
日本
项目类别:
Grant-in-Aid for General Scientific Research (C)
财政年份:
1989
资助国家:
日本
项目状态:
已结题
起止时间:
1989 至 --

项目摘要

项目成果

中川 聖一的其他基金

相关文献

中文摘要
翻译
本研究の目的は、音声と画像の視聴覚情報を用いて、我々の日常言語の文法を学習・獲得するモデルを計算機上で実現することである。そのために二つの音声間や画像間の差異や一致を検出するアルゴリズム、音声や画像をシンボルで記述するアルゴリズム、シンボル記述化された音声と画像の対応づけアルゴリズム、これらの対応づけ集合から文法を推論するアルゴリズム等の開発が必要である。まず二つの音声間の差異や一致の検出においては、従来の音声認識アルゴリズムを拡張して、線形時間で実行できるアルゴリズムを開発した。この手法は音声がパタ-ン表現であってもシンボル表現であっても適用できる汎用性のあるアルゴリズムである。次に音声パタ-ンをシンボル系列に変換するアルゴリズムを開発した。基本的には1つのシンボルに対応する音素と隠れマルコフモデルで表現し、この連結モデルと音声パタ-ンを照合するもので本研究ではマルコフモデルの精密化を図った。これにより、ていねいに発声された音声に対して、約95%の精度で正しくシンボル系列に変換できた。また、入力線画の理解において既に学習されている“概念"との一致・差異を検出するアルゴリズム、および任意の二つの画像の一致差異を検出するアルゴリズムについて検討した。これらのアルゴリズムは、シンボル記述された同士間の類似度の最大値選択または、類似度の整列問題となり高速化手法が望まれる。このため、自己相以型計算機上でデ-タ数Nに対して、O(N)整列問題を解く並列アルゴリズム、階層型計算機上ではO(log^2N)で選択問題を解く並列アルゴリズムを提案し、有効性を確かめた。以上のように、本研究の目的に必要な基本アルゴリズムの開発ができた。今後は、これらの基本アルゴリズムの統合により、音声と画像のつき合わせによる同一概念の獲得と文法の学習をすすめて行きたい。
英文摘要
本研究の目的は、音声と画像の視聴覚情報を用いて、我々の日常言語の文法を学習・獲得するモデルを計算機上で実現することである。そのために二つの音声間や画像間の差異や一致を検出するアルゴリズム、音声や画像をシンボルで記述するアルゴリズム、シンボル記述化された音声と画像の対応づけアルゴリズム、これらの対応づけ集合から文法を推論するアルゴリズム等の開発が必要である。まず二つの音声間の差異や一致の検出においては、従来の音声認識アルゴリズムを拡張して、線形時間で実行できるアルゴリズムを開発した。この手法は音声がパタ-ン表現であってもシンボル表現であっても適用できる汎用性のあるアルゴリズムである。次に音声パタ-ンをシンボル系列に変換するアルゴリズムを開発した。基本的には1つのシンボルに対応する音素と隠れマルコフモデルで表現し、この連結モデルと音声パタ-ンを照合するもので本研究ではマルコフモデルの精密化を図った。これにより、ていねいに発声された音声に対して、約95%の精度で正しくシンボル系列に変換できた。また、入力線画の理解において既に学習されている“概念"との一致・差異を検出するアルゴリズム、および任意の二つの画像の一致差異を検出するアルゴリズムについて検討した。これらのアルゴリズムは、シンボル記述された同士間の類似度の最大値選択または、類似度の整列問題となり高速化手法が望まれる。このため、自己相以型計算機上でデ-タ数Nに対して、O(N)整列問題を解く並列アルゴリズム、階層型計算機上ではO(log^2N)で選択問題を解く並列アルゴリズムを提案し、有効性を確かめた。以上のように、本研究の目的に必要な基本アルゴリズムの開発ができた。今後は、これらの基本アルゴリズムの統合により、音声と画像のつき合わせによる同一概念の獲得と文法の学習をすすめて行きたい。
期刊论文(4)
专著(0)
科研奖励(0)
会议论文
Seiichi Nakagawa: "Speaker independent continuousーSpeech reccegnition by yhonemeーbased word spotting and timeーsynchronous contextーfree parsing" Computer Speech & Language. 3. 277-299 (1989)
Seiichi Nakakawa:“独立于说话人的连续语音识别——基于 yhoneme 的单词识别和时间同步上下文无关解析”《计算机语音与语言》,3. 277-299 (1989)。
DOI: --
发表时间:
期刊:
影响因子: --
作者: []
通讯作者:
菅谷光啓: "自己相似型ネットワ-ク計算機FINー1上での並列アルゴリズム" 電子情報通信学会コンピュ-タシステム技術報告. 89ー88. 25-32 (1990)
Mitsuhiro Sugaya:“自相似网络计算机 FIN-1 上的并行算法”IEICE 计算机系统技术报告 89-88 (1990)。
DOI: --
发表时间:
期刊:
影响因子: --
作者: []
通讯作者:
中川聖一: "連続出力分布型HMMによる日本語音韻認識" 日本音響学会誌.
Seiichi Nakakawa:“使用连续输出分布型 HMM 的日语语音识别”日本声学学会杂志。
DOI: --
发表时间:
期刊:
影响因子: --
作者: []
通讯作者:
前場隆史: "階層型計算機モデル上の並列選択アルゴリズム" 電子情報通信学会コンピュ-タシステム技術報告. 89ー87. 17-24 (1990)
Takashi Maeba:“分层计算机模型上的并行选择算法”IEICE 计算机系统技术报告 89-87 (1990)。
DOI: --
发表时间:
期刊:
影响因子: --
作者: []
通讯作者:
実世界環境下における遠隔発話の音声認識と話者認識およびインデックス化に関する研究
  • 批准号:
    19650040
  • 项目类别:
    Grant-in-Aid for Challenging Exploratory Research
  • 资助金额:
    $2.05万
  • 财政年份:
    2007
  • 负责人:
    中川 聖一
  • 依托单位:
セマンティックディジタルアーカイブのための音声・映像・言語の統合的処理
  • 批准号:
    15630003
  • 项目类别:
    Grant-in-Aid for Scientific Research (C)
  • 资助金额:
    $2.18万
  • 财政年份:
    2003
  • 负责人:
    中川 聖一
  • 依托单位:
音声言語処理技術と学習者モデルを用いた語学学習システムの研究
  • 批准号:
    12040104
  • 项目类别:
    Grant-in-Aid for Scientific Research on Priority Areas
  • 资助金额:
    $58.56万
  • 财政年份:
    2000
  • 负责人:
    中川 聖一
  • 依托单位:
外国語コミュニケーション能力の総合的な養成研究
  • 批准号:
    12040103
  • 项目类别:
    Grant-in-Aid for Scientific Research on Priority Areas
  • 资助金额:
    $1.86万
  • 财政年份:
    2000
  • 负责人:
    中川 聖一
  • 依托单位: