
Compilation, Annotation and Analysis of Written Text Corpora
Dieser Kurs bietet eine praktische Einführung in die Methoden des Aufbaus und der Analyse von linguistischen Korpora. Der Fokus liegt dabei auf historischen Texten; zeitgenössische Quellen werden aber in die Betrachtung ebenfalls mit einfließen sowie gegebenenfalls Materialien, die von den Kursteilnehmern bereitgestellt wurden.
Wir werden zunächst die Schritte für den Aufbau von Korpora behandeln: von der Textauswahl, dem Umgang mit Metadaten, der Transkription über die (linguistische ebenso wie textstrukturelle) Annotation bis hin zur Präsentation und Bereitstellung von Korpora. Dabei werden Standards und Best Practices für die Datenerfassung und Annotation behandelt und eingeübt, wie etwa die Richtlinien der Text Encoding Initiative (TEI) sowie verbreitete Formate der linguistischen Annotation.
Im zweiten Teil des Kurses werden wir Möglichkeiten der Korpusanalyse diskutieren, insbesondere unter Berücksichtigung der Angebote der CLARIN-Infrastruktur. Dabei werden wir uns vor allem auf die Überführung wissenschaftlicher Forschungsfragen in komplexe Suchanfragen an Korpora mit Hilfe linguistischer und struktureller Annotationen konzentrieren. Die Teilnehmer werden spezielle Analyseangebote kennenlernen und nutzen, beispielsweise die schreibweisentolerante, komplexe Suche des Deutschen Textarchivs und die Nutzung verschiedener Services in CLARINs WebLicht.
2022
2021
2020
2019
- Home
- Schedule
- Workshops
- Lectures (public)
- Projects (public)
- Poster Session (public)
- Panel (public)
- Teasers (public)
- Cultural programme
- Experts
- Lecturers
- Scientific Committee
- Important dates (new)
- Application
- Scholarships (updated)
- Participation fees
- Refund policy
- T-Shirts
- Child care
- Birthday thoughts












