Benchmarking Large Language Models for Knowledge Graph Validation
Fuente:
arXiv
Saved in:
| Main Authors: | Shami, Farzad, Marchesin, Stefano, Silvello, Gianmaria |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Credible Intervals for Knowledge Graph Accuracy Estimation
by: Marchesin, Stefano, et al.
Published: (2025)
by: Marchesin, Stefano, et al.
Published: (2025)
From Single to Multi-Agent Reasoning: Advancing GeneGPT for Genomics QA
by: Abedini, Kimia, et al.
Published: (2026)
by: Abedini, Kimia, et al.
Published: (2026)
DOREMI: Optimizing Long Tail Predictions in Document-Level Relation Extraction
by: Menotti, Laura, et al.
Published: (2026)
by: Menotti, Laura, et al.
Published: (2026)
Efficient and Reliable Estimation of Named Entity Linking Quality: A Case Study on GutBrainIE
by: Martinelli, Marco, et al.
Published: (2026)
by: Martinelli, Marco, et al.
Published: (2026)
Can we measure the impact of a database?
by: Buneman, Peter, et al.
Published: (2024)
by: Buneman, Peter, et al.
Published: (2024)
Systematic Evaluation of Knowledge Graph Repair with Large Language Models
by: Lin, Tung-Wei, et al.
Published: (2025)
by: Lin, Tung-Wei, et al.
Published: (2025)
KOR-Bench: Benchmarking Language Models on Knowledge-Orthogonal Reasoning Tasks
by: Ma, Kaijing, et al.
Published: (2024)
by: Ma, Kaijing, et al.
Published: (2024)
Knowledge Graphs for Enhancing Large Language Models in Entity Disambiguation
by: Pons, Gerard, et al.
Published: (2025)
by: Pons, Gerard, et al.
Published: (2025)
A Change Language for Ontologies and Knowledge Graphs
by: Hegde, Harshad, et al.
Published: (2024)
by: Hegde, Harshad, et al.
Published: (2024)
Not All Neighbors Matter: Understanding the Impact of Graph Sparsification on GNN Pipelines
by: Song, Yuhang, et al.
Published: (2026)
by: Song, Yuhang, et al.
Published: (2026)
The KnowWhereGraph: A Large-Scale Geo-Knowledge Graph for Interdisciplinary Knowledge Discovery and Geo-Enrichment
by: Zhu, Rui, et al.
Published: (2025)
by: Zhu, Rui, et al.
Published: (2025)
Large Language Model-Enhanced Relational Operators: Taxonomy, Benchmark, and Analysis
by: Su, Yunxiang, et al.
Published: (2026)
by: Su, Yunxiang, et al.
Published: (2026)
DistillER: Knowledge Distillation in Entity Resolution with Large Language Models
by: Zeakis, Alexandros, et al.
Published: (2026)
by: Zeakis, Alexandros, et al.
Published: (2026)
Evaluating Large Language Models in Process Mining: Capabilities, Benchmarks, and Evaluation Strategies
by: Berti, Alessandro, et al.
Published: (2024)
by: Berti, Alessandro, et al.
Published: (2024)
Multi-hop Question Answering over Knowledge Graphs using Large Language Models
by: Chakraborty, Abir
Published: (2024)
by: Chakraborty, Abir
Published: (2024)
Evaluating Large Language Models on Business Process Modeling: Framework, Benchmark, and Self-Improvement Analysis
by: Kourani, Humam, et al.
Published: (2024)
by: Kourani, Humam, et al.
Published: (2024)
From RDF Graph Validation to RDF Dataset Validation with SHACL-DS
by: Dao, Davan Chiem, et al.
Published: (2025)
by: Dao, Davan Chiem, et al.
Published: (2025)
Revisiting Task-Oriented Dataset Search in the Era of Large Language Models: Challenges, Benchmark, and Solution
by: Wei, Zixin, et al.
Published: (2025)
by: Wei, Zixin, et al.
Published: (2025)
DB-GPT-Hub: Towards Open Benchmarking Text-to-SQL Empowered by Large Language Models
by: Zhou, Fan, et al.
Published: (2024)
by: Zhou, Fan, et al.
Published: (2024)
Modelling Legislative Systems into Property Graphs to Enable Advanced Pattern Detection
by: Colombo, Andrea, et al.
Published: (2024)
by: Colombo, Andrea, et al.
Published: (2024)
An LLM-Guided Query-Aware Inference System for GNN Models on Large Knowledge Graphs
by: Afandi, Waleed, et al.
Published: (2026)
by: Afandi, Waleed, et al.
Published: (2026)
A Domain-Specific Curated Benchmark for Entity and Document-Level Relation Extraction
by: Martinelli, Marco, et al.
Published: (2026)
by: Martinelli, Marco, et al.
Published: (2026)
xpSHACL: Explainable SHACL Validation using Retrieval-Augmented Generation and Large Language Models
by: Publio, Gustavo Correa, et al.
Published: (2025)
by: Publio, Gustavo Correa, et al.
Published: (2025)
PM-LLM-Benchmark: Evaluating Large Language Models on Process Mining Tasks
by: Berti, Alessandro, et al.
Published: (2024)
by: Berti, Alessandro, et al.
Published: (2024)
Revolutionizing Database Q&A with Large Language Models: Comprehensive Benchmark and Evaluation
by: Zheng, Yihang, et al.
Published: (2024)
by: Zheng, Yihang, et al.
Published: (2024)
MEBench: Benchmarking Large Language Models for Cross-Document Multi-Entity Question Answering
by: Lin, Teng, et al.
Published: (2025)
by: Lin, Teng, et al.
Published: (2025)
Conflict Detection for Temporal Knowledge Graphs:A Fast Constraint Mining Algorithm and New Benchmarks
by: Chen, Jianhao, et al.
Published: (2023)
by: Chen, Jianhao, et al.
Published: (2023)
Graph Repairs with Large Language Models: An Empirical Study
by: Terdalkar, Hrishikesh, et al.
Published: (2025)
by: Terdalkar, Hrishikesh, et al.
Published: (2025)
Revisiting Graph Analytics Benchmark
by: Meng, Lingkai, et al.
Published: (2025)
by: Meng, Lingkai, et al.
Published: (2025)
SoK: The Faults in our Graph Benchmarks
by: Mehrotra, Puneet, et al.
Published: (2024)
by: Mehrotra, Puneet, et al.
Published: (2024)
Generating Knowledge Graphs from Large Language Models: A Comparative Study of GPT-4, LLaMA 2, and BERT
by: Bhatt, Ahan, et al.
Published: (2024)
by: Bhatt, Ahan, et al.
Published: (2024)
Towards Temporal Knowledge Graph Alignment in the Wild
by: Zhao, Runhao, et al.
Published: (2025)
by: Zhao, Runhao, et al.
Published: (2025)
Comprehensive Evaluation for a Large Scale Knowledge Graph Question Answering Service
by: Potdar, Saloni, et al.
Published: (2025)
by: Potdar, Saloni, et al.
Published: (2025)
MatTools: Benchmarking Large Language Models for Materials Science Tools
by: Liu, Siyu, et al.
Published: (2025)
by: Liu, Siyu, et al.
Published: (2025)
An Algebraic Foundation for Knowledge Graph Construction (Extended Version)
by: Oo, Sitt Min, et al.
Published: (2025)
by: Oo, Sitt Min, et al.
Published: (2025)
Towards Practical Benchmarking of Data Cleaning Techniques: On Generating Authentic Errors via Large Language Models
by: Liu, Xinyuan, et al.
Published: (2025)
by: Liu, Xinyuan, et al.
Published: (2025)
Data Cleaning Using Large Language Models
by: Zhang, Shuo, et al.
Published: (2024)
by: Zhang, Shuo, et al.
Published: (2024)
Evaluating SQL Understanding in Large Language Models
by: Rahaman, Ananya, et al.
Published: (2024)
by: Rahaman, Ananya, et al.
Published: (2024)
Large Language Models for JSON Schema Discovery
by: Mior, Michael J.
Published: (2024)
by: Mior, Michael J.
Published: (2024)
Brook-2PL: Tolerating High Contention Workloads with A Deadlock-Free Two-Phase Locking Protocol
by: Habibi, Farzad, et al.
Published: (2025)
by: Habibi, Farzad, et al.
Published: (2025)
Similar Items
-
Credible Intervals for Knowledge Graph Accuracy Estimation
by: Marchesin, Stefano, et al.
Published: (2025) -
From Single to Multi-Agent Reasoning: Advancing GeneGPT for Genomics QA
by: Abedini, Kimia, et al.
Published: (2026) -
DOREMI: Optimizing Long Tail Predictions in Document-Level Relation Extraction
by: Menotti, Laura, et al.
Published: (2026) -
Efficient and Reliable Estimation of Named Entity Linking Quality: A Case Study on GutBrainIE
by: Martinelli, Marco, et al.
Published: (2026) -
Can we measure the impact of a database?
by: Buneman, Peter, et al.
Published: (2024)