Elektronischer Zugang zu Unterrichtsmaterialien
Learning Outcomes
Nach erfolgreichem Abschluss des Kurses verfügen die Studierenden über
Grundkenntnisse in Computerlinguistik,
Kenntnisse von Techniken und Methoden der Textverarbeitung,
Bewusstsein für die ethischen und rechtlichen Fragen,
die Fähigkeit, an der Gestaltung, Entwicklung und Bewertung von Werkzeugen zur Verarbeitung natürlicher Sprache mitzuwirken,
die Fähigkeit, an der Gestaltung, Entwicklung und Bewertung von Datensätzen mitzuwirken, indem sie Annotationsrichtlinien und -standards befolgen, um die Reproduzierbarkeit ihrer Arbeit zu gewährleisten,
Bewusstsein für die neuesten Fortschritte auf dem Gebiet (z. B. große Sprachmodelle).
Course Content (Syllabus)
Einführung in die Computerlinguistik und Verarbeitung natürlicher Sprache. Der Kurs ist wie folgt strukturiert:
1. Sprachtechnologie, Computerlinguistik und Verarbeitung natürlicher Sprache: Grundlegende Konzepte, Prinzipien.
2. Methoden. Ein kurzer historischer Überblick und bedeutende Meilensteine: von regelbasierten Systemen über probabilistische Ansätze, große Sprachmodelle, Generative Künstliche Intelligenz (KI) und menschengerechte KI.
3. Computerlinguistik und linguistische Theorie: Ebenen der sprachlichen Analyse. Grundlegende Vorverarbeitung: morphologische Analyse und Lemmatisierung.
4. Satzstruktur: syntaktische Analyse (kontextfreie Grammatiken, Abhängigkeitsparsing).
5. Ansätze zur Semantik: Argumentstruktur und semantische Rollenetikettierung. Abstrakte Bedeutungsrepräsentation.
6. Computersemantik: Schlussfolgerungen, Paraphrasierung, Vereinfachung.
7. Auflösung von Koreferenz.
8. Sprachressourcen: Korpora, lexikalische Ressourcen und Werkzeuge. Korpusanotation (Prinzipien, Methoden und Werkzeuge).
9. Anwendungen: Informationsextraktion: Erkennung von Ereignissen und Entitäten, Verknüpfung von Entitäten.
10. Anwendungen: Sentimentanalyse, Erkennung von beleidigender Sprache. Ironie, Humor und Argumentation.
11. Computerlinguistik: Rechtliche und ethische Fragen.
12. Präsentationen.
Schlüsselwörter
Verarbeitung natürlicher Sprache, natürlichsprachliche Generierung, Künstliche Intelligenz, Sprachressourcen, Korpusannotation
Weitere Bibliographie
Γιούλη, Π. (2024) Υπολογιστική Γλωσσολογία: Μέθοδοι και εφαρμογές. Από τις συμβολικές προσεγγίσεις στη Μηχανική Μάθηση και την Παραγωγική Τεχνητή Νοημοσύνη. Σημειώσεις μαθήματος.
Παναγιωτακόπουλος, Χ., Τσαλίδης, Χ., Γάκης, Π. και Κόκκινος, Θ. (2022). Υπολογιστική γλωσσολογία. Από τον προγραμματισμό μέχρι τη διδακτική πράξη. [Προπτυχιακό εγχειρίδιο]. Κάλλιπος, Ανοικτές Ακαδημαϊκές Εκδόσεις. https://dx.doi.org/10.57713/kallipos-127
Τάντος, Α., Μαρκαντωνάτου, Σ., Αναστασιάδη-Συμεωνίδη, Ά., Κυριακοπούλου, Π. (2015). Υπολογιστική γλωσσολογία. [ηλεκτρ. βιβλ.] Αθήνα: Σύνδεσμος Ελληνικών Ακαδημαϊκών Βιβλιοθηκών. http://hdl.handle.net/11419/2205 https://repository.kallipos.gr/handle/11419/2205
Jurafsky, D. and Martin, J. H. (2020-2021) Speech and Language Processing (3rd ed. draft) https://web.stanford.edu/~jurafsky/slp3/
Jacob Eisenstein. (2019). Natural Language Processing. MIT Press. https://cseweb.ucsd.edu/~nnakashole/teaching/eisenstein-nov18.pdf
Bender, Emily M. and Alex Lascarides. (2019). Linguistic Fundamentals for Natural Language Processing II: 100 Essentials from Semantics and Pragmatics. Synthesis Lectures on Human Language Technologies. Morgan & Claypool Publishers
Goldberg, Y. (2015). A Primer on Neural Network Models for Natural Language Processing. ArXiv, abs/1510.00726. https://www.semanticscholar.org/paper/A-Primer-on-Neural-Network-Models-for-Natural-Goldberg/56edaa1368ff4dfa45388e4be24fdfbded7d88a7