Designing and Managing a Multi-modal Corpus of English Classes to Empower English Teachers
Designing and Managing a Multi-modal Corpus of English Classes to Empower English Teachers
批准号:
19K00873
负责人:
片桐 徳昭
金额:
$2.75万
依托单位国家:
日本
项目类别:
Grant-in-Aid for Scientific Research (C)
财政年份:
2019
资助国家:
日本
项目状态:
已结题
起止时间:
2019-04-01 至 2024-03-31
中文摘要
点击翻译按钮获取中文摘要
英文摘要
2022年度は、新型肺炎感染症が未だ終息せず、教室でのデータ収集がほとんど見込めない状況が継続した。よって、手持ちのデータや少ないながらも入手できる教室データを利用し、ビデオコーパスの主要な部分を占めるソフトウェア開発を行った。Microsoft Office 上で展開するビデオ処理に関するクローズドキャプション(cc)機能を利用して、アップロードしたビデオからスランスクリプトが生成される機能を活用したテキスト(Vide Text Tracks = VTT)を抽出し、そこからタイムコードや書き起こしを抽出するソフトウェア(Version 1)を開発した。その後、ビデオに付与したチャプチー情報を付与するようにソフトウェアをアップデートした(Verson 2)。以下が、手順の詳細となる。1) 授業(プレゼンテーション等も含め)ビデオをMicrosoft Office のOne drive上にアップロードする。録画の際は、話者の音声を明瞭にするため、bluetoothタイプのマイクを利用する。2) Microsoft Office 上で英語英語の書き起こしをする。この時en.US.vttという英語の書き起こしをしたテキストファイルが生成されるので、これをダウンロードする。3) 手順2)で同じビデオで日本語の書き起こしをする。この時jpse.vttという日本語のファイルが生成される。4) 開発したソフトウエア上に 2)と3) のファイルを入力する。2)の英語と3)の日本語のファイルが合体して一つのトランスクリプトファイルとなる。元のビデオを視聴しながら、合体したファイルの不要な部分を削除する。ここまでの作業により、従来は、人の耳と手作業でで行っていた、音声書き起こし作業の時間が大幅に短縮され、音声コーパスの作成が相対的により容易となる。
期刊论文(3)
专著(0)
科研奖励(0)
会议论文
Newcastle University,(英国)
纽卡斯尔大学(英国)
DOI:
--
发表时间:
期刊:
影响因子:
--
作者:
[]
通讯作者:
自動音声認識を利用したbilingual speech-to-textシステム構築と授業分析への応用
-
批准号:24K04125
-
项目类别:Grant-in-Aid for Scientific Research (C)
-
资助金额:$2.75万
-
财政年份:2024
-
负责人:片桐 徳昭
-
依托单位:
海外基金