Can current NLI systems handle German word order? Investigating language model performance on a new German challenge set of minimal pairs


Reinig, Ines ; Markert, Katja



URL: https://aclanthology.org/2023.iwcs-1.1
Dokumenttyp: Konferenzveröffentlichung
Erscheinungsjahr: 2023
Buchtitel: The 15th International Conference on Computational Semantics : proceedings of the conference, June 21 - 23, 2023 Nancy, France
Seitenbereich: 1-15
Veranstaltungstitel: The 15th International Confrerence on Computational Semantics (IWCS) 2023
Veranstaltungsort: Nancy, France
Veranstaltungsdatum: 21.-23.06.2023
Herausgeber: Amblard, Maxime ; Breitholtz, Ellen
Ort der Veröffentlichung: Nancy, France
Verlag: Association for Computational Linguistics
Verwandte URLs:
Sprache der Veröffentlichung: Englisch
Einrichtung: Fakultät für Wirtschaftsinformatik und Wirtschaftsmathematik > Information Systems III: Enterprise Data Analysis (Ponzetto 2016-)
Fachgebiet: 004 Informatik
Abstract: Compared to English, German word order is freer and therefore poses additional challenges for natural language inference (NLI). We create WOGLI (Word Order in German Language Inference), the first adversarial NLI dataset for German word order that has the following properties: (i) each premise has an entailed and a non-entailed hypothesis; (ii) premise and hypotheses differ only in word order and necessary morphological changes to mark case and number. In particular, each premise and its two hypotheses contain exactly the same lemmata. Our adversarial examples require the model to use morphological markers in order to recognise or reject entailment. We show that current German autoencoding models fine-tuned on translated NLI data can struggle on this challenge set, reflecting the fact that translated NLI datasets will not mirror all necessary language phenomena in the target language. We also examine performance after data augmentation as well as on related word order phenomena derived from WOGLI. Our datasets are publically available at https://github.com/ireinig/wogli.




Dieser Eintrag ist Teil der Universitätsbibliographie.




Metadaten-Export


Zitation


+ Suche Autoren in

+ Aufruf-Statistik

Aufrufe im letzten Jahr

Detaillierte Angaben



Sie haben einen Fehler gefunden? Teilen Sie uns Ihren Korrekturwunsch bitte hier mit: E-Mail


Actions (login required)

Eintrag anzeigen Eintrag anzeigen