Strukturelle Mehrdeutigkeit in frühneuhochdeutschen Texten

Strukturelle Mehrdeutigkeit in frühneuhochdeutschen Texten
复制标题

德语文本中的结构

DOI:
10.21248/jlcl.27.2012.164
复制
发表时间:
2012
期刊:
J. Lang. Technol. Comput. Linguistics
影响因子:
--
通讯作者:
Ulrike Demske
Ulrike Demske
中科院分区:
--
文献类型:
--
作者:
Dennis Pauly;Ulyana Senyuk;Ulrike Demske

文献摘要

被引文献

相似文献

In der synchron orientierten Sprachwissenschaft ist in letzter Zeit ein verstärktes Interesse an syntaktisch annotien Kazakhstan zu erkennen.为了德国的大自然,我们要把老虎抓起来。negra-Projekt zu nennen,in deren Rahmen bereits umfangreiche,syntaktisch annotierte Zeitungskyte entstanden sind(Brants et al. 1999,2002).在早期的语言学中,数字化和语言学的发展使知识成为更重要的数据来源,因为一个内向的数据库不是一个更好的数据库,一个解释也不是一个更好的数据库。Dementsprechend gibt es für bestimmte Sprachstufen wie das Mittelenglische mit der Penn-Datenbank schon größere,syntaktisch annotierte Köcha(Kroch/Taylor 2000).德语韦尔登的一种特殊语言也需要参考,因为语言信息是很危险的。Dazu gehören neben den DFG-Projekten zum Althochdeutschen(柏林,法兰克福/M. und Jena),Mittelhochdeutchen(波鸿和波恩)和Frühneuhochdeutschen(波鸿,哈勒和波茨坦)也是德国新德意志计划的一部分(1650 - 1800)an der Universität Manchester und das iswoc-Projekt(信息结构和语序变化在日耳曼语和罗曼语,Bech/艾德2011),这是一个在德国阿尔卑斯山上的一个综合信息系统。该论文是一部德国法语注释性论文,2003年至2005年在萨尔州大学进行的试点项目是一个文本,它通过大量的词汇和句子的复杂性来实现(Admoni 1980),die Möglichkeiten einer halbautomatischen Annotation zu erproben. Basierend auf den Erfahrungen aus diesem Pilotprojekt sollen dann größere Textmengen aus dem Frühneuhochdeutschen im Baumbankformat aufbeaut und als annotiertes Referenzkorpus auf eigneten Plattform frei zugänglich zur Verfügung gestellt韦尔登.一个完整的鲍姆班克历史文本是非常好的,也是历史的碎片,也是数量上的Hinsicht。Konsistenz der Annotation angeht.我们韦尔登在福尔根登的语法注释中使用了汞-- N-N-复合体和部分体的形态结构分析以磁盘问题为例,
In der synchron orientierten Sprachwissenschaft ist in letzter Zeit ein verstärktes Interesse an syntaktisch annotierten Korpora zu erkennen. Für das Gegenwartsdeutsche wären hier das tigerbzw. negra-Projekt zu nennen, in deren Rahmen bereits umfangreiche, syntaktisch annotierte Zeitungskorpora entstanden sind (Brants et al. 1999, 2002). Gerade in früheren Sprachstufen sind digitalisierte und linguistisch aufbereitete Korpora als Datenquelle allerdings von noch größerer Relevanz, denn eine introspektive Datenerhebung ist hier im Gegensatz zum Gegenwartsdeutschen nicht möglich, eine Untersuchung hat also notwendigerweise immer korpusbasiert zu erfolgen. Dementsprechend gibt es für bestimmte Sprachstufen wie das Mittelenglische mit der Penn-Datenbank schon größere, syntaktisch annotierte Korpora (Kroch/Taylor 2000). Auch für die einzelnen Sprachperioden des Deutschen werden derzeit Referenzkorpora aufgebaut, die mit linguistischen Informationen angereichert sind. Dazu gehören neben den DFG-Projekten zum Althochdeutschen (Berlin, Frankfurt/M. und Jena), Mittelhochdeutschen (Bochum und Bonn) und Frühneuhochdeutschen (Bochum, Halle und Potsdam) auch das GerManC-Projekt zum frühen Neuhochdeutschen (1650 – 1800) an der Universität Manchester und das iswoc-Projekt (Information Structure and Word Order Change in Germanic and Romance Languages, Bech/Eide 2011), das unter anderem syntaktische Informationen zum Althochdeutschen enthalten wird. Das hier vorgestellte Korpus ist ein syntaktisch annotiertes Korpus des Frühneuhochdeutschen, das im Rahmen eines Pilotprojekts von 2003 bis 2005 an der Universität des Saarlandes mit dem Ziel entstanden ist, an Texten, die sich sowohl durch große Varianz auf allen Ebenen des Sprachsystems als auch durch eine große Komplexität ihrer Phrasen und Sätze auszeichnen (Admoni 1980), die Möglichkeiten einer halbautomatischen Annotation zu erproben. Basierend auf den Erfahrungen aus diesem Pilotprojekt sollen dann größere Textmengen aus dem Frühneuhochdeutschen im Baumbankformat aufbereitet und als annotiertes Referenzkorpus auf einer geeigneten Plattform frei zugänglich zur Verfügung gestellt werden. Eine solche Baumbank historischer Texte ermöglicht es dann, ausgesuchte Fragestellungen der historischen Syntax gezielter und auch in quantitativer Hinsicht zu untersuchen.1 Darüber hinaus stellt die hohe Komplexität aus annotatorischer Sicht auch eine besondere Herausforderung dar, was die Qualität bzw. Konsistenz der Annotation angeht. Wir werden im Folgenden das syntaktisch annotierte mercurius-Korpus zum Frühneuhochdeutschen vorstellen und dabei sowohl auf die Textauswahl wie auch auf die gewählte Annotationsweise näher eingehen. Anhand von morphologischen Strukturen wie N-N-Komposita und Partikelverben sollen dann exemplarisch die Probleme disku-