Inhaltsbasierte Suche von Textdokumenten in großen verteilten Systemen - Search for text documents in large distributed systems
Inhaltsbasierte Suche von Textdokumenten in großen verteilten Systemen - Search for text documents in large distributed systems
批准号:
5419460
负责人:
Privatdozent Dr. Thomas Boehme
金额:
$0.0万
依托单位国家:
德国
项目类别:
Research Grants
财政年份:
2004
资助国家:
德国
项目状态:
已结题
起止时间:
2003-12-31 至 2008-12-31
中文摘要
点击翻译按钮获取中文摘要
英文摘要
Das World Wide Web (WWW) stellt den größten elektronisch verfügbaren Informationsbestand dar. Das sehr große Volumen und die extrem hohe Dynamik dieses Datenbestandes, wie auch die unterschiedliche Qualität der im WWW verfügbaren Daten werfen vielfältige neue Probleme bei der Informationssuche auf. Diese Herausforderung kann durch zentrale Suchmaschinen (wie etwa Google und Altavista) und Web Directories (wie etwa Yahoo) nur teilweise bewältigt werden. Der hauptsächliche Nachteil dieser zentralen Systeme liegt in der gewaltigen Größe der von ihnen verwalteten Datenbestände und der daraus resultierenden mangelnden Flexibilität. Daneben sind in den letzten Jahren vollkommen dezentral organisierte Peer-to-Peer (P2P) Systeme für die Suche und den Austausch von speziellen Informationen (z.B. Daten im mp3-Format) entwickelt worden. Der Vorteil dieser Systeme liegt in der hohen Flexibilität mit der sie sich den wechselnden Informationsbedürfnissen ihrer Nutzer anpassen. Dem entgegen stehen ernste Probleme hinsichtlich ihrer Skalierbarkeit. In dem geplanten Projekt sollen Verfahren entwickelt werden, welche es für die Suche nach Textdokumenten ermöglichen, die Vorteile der beiden Ansätze miteinander zu kombinieren und gleichzeitig deren Nachteile weitestgehend vermeiden. Als Ausgangspunkt dient dabei die Überlegung, dass der Erfolg einer Informationssuche zu einem gewissen Teil immer auch auf dem in der sozialen Struktur einer Gesellschaft implizit gespeicherten Wissen beruht. Vereinfachend ausgedrückt, ist es oftmals hinreichend zu wissen, wer Kenntnisse über einen fraglichen Gegenstand besitzt, um die gewünschte Information zu lokalisieren. Dieser Vorgang soll im Unterschied zu ontologiebasierten Ansätzen des Semantic Web durch den Einsatz von Text Mining Methoden zur automatischen semantischen Analyse von natürlichsprachlichen Texten in P2P Systemen nachempfunden werden. Die Schaffung der Grundlagen für solche Systeme, die prototypische Implementierung eines entsprechenden P2P Systems, mit dem Textdokumente unter Verwendung semantischer Kriterien gesucht werden, sowie dessen Evaluierung bilden den Gegenstand des beantragten Projektes.
期刊论文(2)
专著(0)
科研奖励(0)
会议论文
DOI:
10.1109/icons.2007.49
发表时间:
2007-04
期刊:
Second International Conference on Systems (ICONS'07)
影响因子:
--
作者:
[M. Rojas;H. Unger;H. Coltzauhauke]
通讯作者:
M. Rojas;H. Unger;H. Coltzauhauke
DOI:
10.1007/978-3-540-78646-7_64
发表时间:
2008
期刊:
影响因子:
--
作者:
[Witschel, Heinrich, Teresniak]
通讯作者:
Teresniak
Inhaltsbasierte Suche von Textdokumenten in großen verteilten Systemen - Search for text documents in large distributed systems
-
批准号:5419466
-
项目类别:Research Grants
-
资助金额:$0.0万
-
财政年份:2004
-
负责人:Privatdozent Dr. Thomas Boehme
-
依托单位:
海外基金