日本語音声認識のための統計的言語モデルとそのタスク適応に関する研究
日本語音声認識のための統計的言語モデルとそのタスク適応に関する研究
批准号:
09780307
负责人:
伊藤 彰則
金额:
$1.28万
依托单位:
依托单位国家:
日本
项目类别:
Grant-in-Aid for Encouragement of Young Scientists (A)
财政年份:
1997
资助国家:
日本
项目状态:
已结题
起止时间:
1997 至 1998
中文摘要
点击翻译按钮获取中文摘要
英文摘要
今年度の研究では,「日本語連続音声認識のための形態素解析によらない統計的言語モデル」の研究を行った.この研究は2つのサブテーマから成っている.一つは統計的に選ばれた文字列を単位とした言語モデルの作成であり,もう一つは統計的手法に基づく漢字かな混じり文への読みの付与である.文字列を単位とした言語モデルの作成においては,提案法の評価実験として,さまざまな文字列への分割方法の比較実験,および学習テキストと評価テキストのタスクと規模を変えた実験を行った.その結果,頻度による文字列の抽出と左最長一致法による解析の組み合わせにおいて,もっとも大きいパ-プレキシティ低減効果(最大9.3%)が見られた.また,コーパスによる性能差を見るために,3種類の対話コーパスと,書き言葉であるEDRコーパスを用いた比較実験を行った.その結果,単一タスクであるATR会話コーパスにおけるパ-プレキシティ低減率がもっとも大きかった.これは,学習テキストのみから統計量の推定と分割単位の双方を決定するためであり,本手法の適用限界を示すものと言うことができる.統計的な手法を用いた読みの付与では,EDRコーパスを用いて,N-gramモデルを応用した読み付与システムを作成し評価した.その結果,当該文字の前後1文字を用いてモデルを作成した場合が最も高性能であることが明らかとなった.システムの最高性能として96.27%の読み付与精度が得られた.
期刊论文(2)
专著(0)
科研奖励(0)
会议论文
伊藤彰則, 好田正紀: "かな・漢字文字列の連鎖統計による言語モデル" 電子情報通信学会論文誌. J79-D-II・No12. 2062-2069 (1996)
Akinori Ito、Masanori Koda:“基于假名和汉字字符串链统计的语言模型”,电子、信息和通信工程师学会汇刊 J79-D-II,第 12 期。2062-2069 (1996)。
DOI:
--
发表时间:
期刊:
影响因子:
--
作者:
[]
通讯作者:
オンライン授業支援のためのバーチャル・クラスメートの開発
-
批准号:23K20725
-
项目类别:Grant-in-Aid for Scientific Research (B)
-
资助金额:$2.83万
-
财政年份:2024
-
负责人:伊藤 彰則
-
依托单位:
Development of a virtual classmate for assistance of online course
-
批准号:21H00895
-
项目类别:Grant-in-Aid for Scientific Research (B)
-
资助金额:$8.9万
-
财政年份:2021
-
负责人:伊藤 彰則
-
依托单位:
連想的手法を用いた自由発話文音声の認識
-
批准号:06780297
-
项目类别:Grant-in-Aid for Encouragement of Young Scientists (A)
-
资助金额:$0.58万
-
财政年份:1994
-
负责人:伊藤 彰則
-
依托单位:
統計と連想に基づく連続音声認識に関する研究
-
批准号:05780277
-
项目类别:Grant-in-Aid for Encouragement of Young Scientists (A)
-
资助金额:$0.58万
-
财政年份:1993
-
负责人:伊藤 彰則
-
依托单位:
機能語予測CYK法を用いた連続音声認識システムに関する研究
-
批准号:04750295
-
项目类别:Grant-in-Aid for Encouragement of Young Scientists (A)
-
资助金额:$0.58万
-
财政年份:1992
-
负责人:伊藤 彰則
-
依托单位:
海外基金