Developing Corpus of Japanese-English Singular Sentence Textual Entailment
Developing Corpus of Japanese-English Singular Sentence Textual Entailment
复制标题
日英单句文本蕴涵语料库开发
DOI:
10.1109/icaicta.2016.7803130
复制
发表时间:
2016
期刊:
影响因子:
--
通讯作者:
Hitoshi Isahara
中科院分区:
文献类型:
--
作者:
Daiki Hayakawa;Masatoshi Tsuchiya;Hitoshi Isahara
There is an increasing interest against cross lingual textual entailment (CLTE), which is one of the important tasks to improve cross lingual information reliablity, in recent years. This paper describes our ongoing project to develope a Japanese-English CLTE corpus consisting of many singular sentence pairs which are labeled as either entailed or unentailed. This paper proposes (1) using a bilingual parallel corpus as a source of CLTE singular sentence pairs and (2) using the hierachical document structure of the source parallel corpus to select appropriate sentence pairs among vast possible ones. The experiment against Japanese-English Bilingual Corpus of Wikipedia's Kyoto Articles shows that our proposing method is more promising to construct a CLTE corpus than a random sampling method.