Der vorliegende Artikel gibt einen ¨ Uberblick ¨ uber die Suche in einem fehlerannotierten Lernerkorpus. “Fehlerannotiert” bedeutet, dass die Fehler der Fremdsprachenlerner im Korpus annotiert sind. Das Falko-Korpus verf¨ ugt ¨ uber eine nicht-hierarchisch strukturierte multi-layer‐Architektur, die um beliebige Annotationsebenen erweiterbar ist. Neben den von den Lernern gemachten sprachlichen Fehlern sind im Korpus syntaktische Strukturen annotiert. Wir zeigen auf, welche Problematik die Suche in solch tief annotierten Daten mit sich bringt und wie im Falko-Korpus damit verfahren wird. In einer technischen Darstellung wird der derzeitige Entwicklungsstand bez¨ uglich der Suche im Korpus skizziert, und es werden geplante Wachstumsschritte vorgestellt.
The performance of search engines crucially depends on their ability to capture the meaning of a query most likely intended by the user. We study the problem of mapping a search engine query to those nodes of a given subject taxonomy that characterize its most likely meanings. We describe the architecture of a classification system that uses a web directory to identify the subject context that the query terms are frequently used in. Based on its performance on the classification of 800,000 example queries recorded from MSN search, the system received the Runner-Up Award for Query Categorization Performance of the KDD Cup 2005.