Knowledge Graph Question Answering Datasets and Their Generalizability: Are They Enough for Future Research?

Publikation: Beiträge in SammelwerkenAufsätze in KonferenzbändenForschungbegutachtet

Authors

Existing approaches on Question Answering over Knowledge Graphs (KGQA) have weak generalizability. That is often due to the standard i.i.d. assumption on the underlying dataset. Recently, three levels of generalization for KGQA were defined, namely i.i.d., compositional, zero-shot. We analyze 25 well-known KGQA datasets for 5 different Knowledge Graphs (KGs). We show that according to this definition many existing and online available KGQA datasets are either not suited to train a generalizable KGQA system or that the datasets are based on discontinued and out-dated KGs. Generating new datasets is a costly process and, thus, is not an alternative to smaller research groups and companies. In this work, we propose a mitigation method for re-splitting available KGQA datasets to enable their applicability to evaluate generalization, without any cost and manual effort. We test our hypothesis on three KGQA datasets, i.e., LC-QuAD, LC-QuAD 2.0 and QALD-9). Experiments on re-splitted KGQA datasets demonstrate its effectiveness towards generalizability. The code and a unified way to access 18 available datasets is online at https: //github.com/semantic-systems/KGQA-datasets as well as https: //github.com/semantic-systems/KGQA-datasets-generalization.

OriginalspracheEnglisch
TitelSIGIR 2022 - Proceedings of the 45th International ACM SIGIR Conference on Research and Development in Information Retrieval
HerausgeberEnrique Amigo, Pablo Castells, Julio Gonzalo
Anzahl der Seiten10
ErscheinungsortNew York
VerlagAssociation for Computing Machinery, Inc
Erscheinungsdatum06.07.2022
Seiten3209-3218
ISBN (elektronisch)9781450387323
DOIs
PublikationsstatusErschienen - 06.07.2022
Extern publiziertJa
Veranstaltung45th Annual International ACM SIGIR Conference on Research and Development in Information Retrieval - SIGIR 2022 - Online + Círculo de Bellas Artes (Circle of Beaux Arts), Madrid, Spanien
Dauer: 11.07.202215.07.2022
Konferenznummer: 45
https://sigir.org/sigir2022/

Bibliographische Notiz

Funding Information:
The authors acknowledge the financial support by the Federal Ministry for Economic Affairs and Climate Action of Germany in the project CoyPu (project number 01MK21007G).

Publisher Copyright:
© 2022 ACM.

Zuletzt angesehen

Publikationen

  1. Einführung in den Sammelband – „Studentische Forschung im Praxissemester“
  2. Die Dynamisierung des Innovationsgeschehens in einer Wirtschaftsregion
  3. Der Umgang von Lehrerinnen und Lehrern mit interkulturellen Konflikten
  4. RITUAL WITHOUT COMMITMENT - THE 3RD DIRECT EUROPEAN-PARLIAMENT ELECTIONS
  5. Scholtz, Christopher P.: Alltag mit künstlichen Lebewesen, Göttingen 2008
  6. Deutschunterricht zwischen Kompetenzerwerb und Persönlichkeitsbildung
  7. The effect of grain refinement on hot tearing in AZ91D magnesium alloy
  8. Akteure, Berater und Beobachter, oder: wie kommt Strategie in die Politik?
  9. Nachhaltiger Konsum: Wie lässt sich Nachhaltigkeit im Konsum beurteilen?
  10. Der Quantencomputer - ein zukünftiger Gegenstand der Medienwissenschaft?
  11. XOperator - An extensible semantic agent for instant messaging networks
  12. Spillover Effects across Transnational Industrial Relations Agreements
  13. Lehr- und Lernbedingungen in den Ländern der Bundesrepublik Deutschland
  14. Aktuelle Aspekte von Mehrsprachigkeit in Schule und Lehramtsausbildung
  15. Der Umgang von Lehrerinnen und Lehrern mit interkulturellen Konflikten
  16. Tax avoidance, tax risk and the cost of debt in a bank-dominated economy
  17. Archaeologies of Contemporary Art: Negativity, Inoperativity, Désœuvrement
  18. Homo sapiens reached the higher latitudes of Europe by 45,000 years ago
  19. Using Technologies for Foreign Language Learning in Inclusive Settings
  20. Unternehmerische Verantwortungsübernahme für gesellschaftlichen Nutzen
  21. IUCN and perspectives on biodiversity conservation in a changing world
  22. Art. 229 a EGV (Entscheidung über gewerblichen Rechtsschutz) (Nizza-Fassung)
  23. Construct Objectification and De-Objectification in Organization Theory
  24. Vertrag über die Europäische Union (EUV) : Artikel 14 [Gemeinsame Aktionen]
  25. Hysteresis Analysis and Control of a Metal-Polymer Hybrid Soft Actuator
  26. Der "fachdidaktische Code" der Lebenswelt- und/oder (?) Situationsorientierung