
Im Rahmen von *Digital-Humanities*-Forschung sprachliche Muster in Textkorpora suchen
Korpora, d.h. Sammlungen sprachlicher Daten (Texte oder Gespräche) sind grundlegend in der *Digital-Humanities*-Forschung. Dabei ist eine häufige Aufgabe für Linguist\*innen, sprachliche Muster in Korpora zu finden:
- Welche Formen des Verbs *sein* kommen in einem Text vor?
- Stehen häufig Artikel vor Numeralia?
- Was ist die durchschnittliche Länge einer DP/NP in einem modernen deutschen Text, evtl. im Vergleich mit dem modernen Niederländischen?
- Welche Phrasentypen kommen in philosophischen Texten als Akkusativobjekt vor?
- Welche Wörter können im modernen gesprochenen Englisch Hesitation anzeigen?
Abhängig von der Art der Verarbeitung und Annotation (z.B. Lemmatisierung) sind solche Fragen mehr oder minder schwierig zu beantworten, da die entsprechenden Daten zu finden und zu zählen schwieriger oder einfacher sein kann. Dieser Kurs soll grundlegende Fertigkeiten für die Suche in Korpora vermitteln:
- Suchen nach einzelnen Wortformen,
- Suchen mithilfe von Platzhaltersymbolen oder Distanzoperatoren,
- reguläre Ausdrücke, die dazu dienen, ähnliche Wortformen zu suchen,
- Suchen nach syntaktischen oder semantischen Konfigurationen in entsprechender hierarchischer Annotation.
Sie werden verschiedene Abfragesprachen kennenlernen, die zur Suche in Korpora verwendet werden.
Der Kurs wird sich hauptsächlich mit Textkorpora beschäftigen, aber da Korpora gesprochener/gebärdeter Sprache oder multimodale Korpora oft auf Ebene der Transkription und Annotationen durchsucht werden, sollte er auch Forscher\*innen nützlich sein, die sich mit solchen Daten befassen.
2022
2021
2020
2019
- Home
- Schedule
- Workshops
- Lectures (public)
- Projects (public)
- Poster Session (public)
- Panel (public)
- Teasers (public)
- Cultural programme
- Experts
- Lecturers
- Scientific Committee
- Important dates (new)
- Application
- Scholarships (updated)
- Participation fees
- Refund policy
- T-Shirts
- Child care
- Birthday thoughts












