-
349
pages
-
German
-
Documents
-
2009
Description
Tracking domain knowledge based on segmented textual sources DISSERTATION Zur Erlangung des akademischen Grades doctor rerum politicarum (Doktor der Wirtschaftswissenschaft) eingereicht an der Wirtschaftswissenschaftlichen Fakultät der Humboldt-Universität zu Berlin von Dipl.-Kfm. Tobias Kalledat (geb. am 29.02.1972 in Berlin) Präsident der Humboldt-Universität zu Berlin: Prof. Dr. Dr. h.c. Christoph Markschies Dekan der Wirtschaftswissenschaftlichen Fakultät: Prof. Oliver Günther, Ph.D. Gutachter: 1. PD Dr. Bernd Viehweger 2. Prof. Dr. Myra Spiliopoulou 3. Prof. Dr. Anke Lüdeling Tag des Kolloquiums: 10.02.2009Zusammenfassung Text Data Mining (TDM) entwickelte sich innerhalb der vergangenen Jahre zu einem etablierten Forschungsfeld. Es bedient sich eines Kanons von Metho-den aus mehreren Disziplinen, mit dem Ziel neues Wissen durch die Anwen-dung von Data Mining Prozessschritten aus Textkorpora verschiedener Art zu generieren. Dieser Prozess besteht im Wesentlichen aus den Schritten Da-tenauswahl, Datenvorverarbeitung, Transformation, Data Mining und Auswer-tung/Interpretation. Während bei angewandten Data Mining Vorhaben der höchste zeitliche Aufwand in die ersten zwei vorverarbeitenden Phasen in-vestiert wird, besteht ein Mangel an Forschung über den Einfluss unter-schiedlicher Qualitätsniveaus der Vorverarbeitung auf die Qualität des gene-rierten Wissens sowie quantitative Indikatoren für “gut vorverarbeitete” Korpora.
-
Publié par
-
Publié le
01 janvier 2009
-
Langue
German
-
Poids de l'ouvrage
10 Mo