DW-Bench: Benchmarking LLMs on Data Warehouse Graph Topology Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Ahmed, Ahmed G. A. H, Sakar, C. Okan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
KramaBench: A Benchmark for AI Systems on Data-to-Insight Pipelines over Data Lakes
di: Lai, Eugenie, et al.
Pubblicazione: (2025)
di: Lai, Eugenie, et al.
Pubblicazione: (2025)
GraphAide: Advanced Graph-Assisted Query and Reasoning System
di: Purohit, Sumit, et al.
Pubblicazione: (2024)
di: Purohit, Sumit, et al.
Pubblicazione: (2024)
ELT-Bench-Verified: Benchmark Quality Issues Underestimate AI Agent Capabilities
di: Zanoli, Christopher, et al.
Pubblicazione: (2026)
di: Zanoli, Christopher, et al.
Pubblicazione: (2026)
ELT-Bench: An End-to-End Benchmark for Evaluating AI Agents on ELT Pipelines
di: Jin, Tengjun, et al.
Pubblicazione: (2025)
di: Jin, Tengjun, et al.
Pubblicazione: (2025)
ClinDet-Bench: Beyond Abstention, Evaluating Judgment Determinability of LLMs in Clinical Decision-Making
di: Watanabe, Yusuke, et al.
Pubblicazione: (2026)
di: Watanabe, Yusuke, et al.
Pubblicazione: (2026)
Reframing Spatial Reasoning Evaluation in Language Models: A Real-World Simulation Benchmark for Qualitative Reasoning
di: Li, Fangjun, et al.
Pubblicazione: (2024)
di: Li, Fangjun, et al.
Pubblicazione: (2024)
AmbiGraph-Eval: Can LLMs Effectively Handle Ambiguous Graph Queries?
di: Tian, Yuchen, et al.
Pubblicazione: (2025)
di: Tian, Yuchen, et al.
Pubblicazione: (2025)
Managing FAIR Knowledge Graphs as Polyglot Data End Points: A Benchmark based on the rdf2pg Framework and Plant Biology Data
di: Brandizi, Marco, et al.
Pubblicazione: (2025)
di: Brandizi, Marco, et al.
Pubblicazione: (2025)
PrepBench: How Far Are We from Natural-Language-Driven Data Preparation?
di: Xu, Jingzhe, et al.
Pubblicazione: (2026)
di: Xu, Jingzhe, et al.
Pubblicazione: (2026)
RelBench: A Benchmark for Deep Learning on Relational Databases
di: Robinson, Joshua, et al.
Pubblicazione: (2024)
di: Robinson, Joshua, et al.
Pubblicazione: (2024)
OMNIA: Closing the Loop by Leveraging LLMs for Knowledge Graph Completion
di: Ieng, Frédéric, et al.
Pubblicazione: (2026)
di: Ieng, Frédéric, et al.
Pubblicazione: (2026)
Leveraging Knowledge Graphs and LLMs to Support and Monitor Legislative Systems
di: Colombo, Andrea
Pubblicazione: (2024)
di: Colombo, Andrea
Pubblicazione: (2024)
Adaptive Data Quality Scoring Operations Framework using Drift-Aware Mechanism for Industrial Applications
di: Bayram, Firas, et al.
Pubblicazione: (2024)
di: Bayram, Firas, et al.
Pubblicazione: (2024)
Knowledge Graph Construction for Stock Markets with LLM-Based Explainable Reasoning
di: Lee, Cheonsol, et al.
Pubblicazione: (2025)
di: Lee, Cheonsol, et al.
Pubblicazione: (2025)
A System and Benchmark for LLM-based Q&A on Heterogeneous Data
di: Fokoue, Achille, et al.
Pubblicazione: (2024)
di: Fokoue, Achille, et al.
Pubblicazione: (2024)
Conflict Detection for Temporal Knowledge Graphs:A Fast Constraint Mining Algorithm and New Benchmarks
di: Chen, Jianhao, et al.
Pubblicazione: (2023)
di: Chen, Jianhao, et al.
Pubblicazione: (2023)
Grid-Based Projection of Spatial Data into Knowledge Graphs
di: Anjomshoaa, Amin, et al.
Pubblicazione: (2024)
di: Anjomshoaa, Amin, et al.
Pubblicazione: (2024)
LLM-KG-Bench 3.0: A Compass for SemanticTechnology Capabilities in the Ocean of LLMs
di: Meyer, Lars-Peter, et al.
Pubblicazione: (2025)
di: Meyer, Lars-Peter, et al.
Pubblicazione: (2025)
Comprehending Semantic Types in JSON Data with Graph Neural Networks
di: Wei, Shuang, et al.
Pubblicazione: (2023)
di: Wei, Shuang, et al.
Pubblicazione: (2023)
TKG-Thinker: Towards Dynamic Reasoning over Temporal Knowledge Graphs via Agentic Reinforcement Learning
di: Jiang, Zihao, et al.
Pubblicazione: (2026)
di: Jiang, Zihao, et al.
Pubblicazione: (2026)
HCT-QA: A Benchmark for Question Answering on Human-Centric Tables
di: Ahmad, Mohammad S., et al.
Pubblicazione: (2025)
di: Ahmad, Mohammad S., et al.
Pubblicazione: (2025)
CANDY: A Benchmark for Continuous Approximate Nearest Neighbor Search with Dynamic Data Ingestion
di: Zeng, Xianzhi, et al.
Pubblicazione: (2024)
di: Zeng, Xianzhi, et al.
Pubblicazione: (2024)
CMDBench: A Benchmark for Coarse-to-fine Multimodal Data Discovery in Compound AI Systems
di: Feng, Yanlin, et al.
Pubblicazione: (2024)
di: Feng, Yanlin, et al.
Pubblicazione: (2024)
A Multi-Agent System for Semantic Mapping of Relational Data to Knowledge Graphs
di: Trajanoska, Milena, et al.
Pubblicazione: (2025)
di: Trajanoska, Milena, et al.
Pubblicazione: (2025)
AvalancheBench: Evaluating Enterprise Data Agents Through Latent World Recovery
di: Kleczek, Darek, et al.
Pubblicazione: (2026)
di: Kleczek, Darek, et al.
Pubblicazione: (2026)
EpiCastBench: Datasets and Benchmarks for Multivariate Epidemic Forecasting
di: Panja, Madhurima, et al.
Pubblicazione: (2026)
di: Panja, Madhurima, et al.
Pubblicazione: (2026)
CypherBench: Towards Precise Retrieval over Full-scale Modern Knowledge Graphs in the LLM Era
di: Feng, Yanlin, et al.
Pubblicazione: (2024)
di: Feng, Yanlin, et al.
Pubblicazione: (2024)
OpenGLT: A Comprehensive Benchmark of Graph Neural Networks for Graph-Level Tasks
di: Li, Haoyang, et al.
Pubblicazione: (2025)
di: Li, Haoyang, et al.
Pubblicazione: (2025)
The Phish, The Spam, and The Valid: Generating Feature-Rich Emails for Benchmarking LLMs
di: Toth, Rebeka, et al.
Pubblicazione: (2025)
di: Toth, Rebeka, et al.
Pubblicazione: (2025)
NormTab: Improving Symbolic Reasoning in LLMs Through Tabular Data Normalization
di: Nahid, Md Mahadi Hasan, et al.
Pubblicazione: (2024)
di: Nahid, Md Mahadi Hasan, et al.
Pubblicazione: (2024)
From Data Quality for AI to AI for Data Quality: A Systematic Review of Tools for AI-Augmented Data Quality Management in Data Warehouses
di: Tamm, Heidi Carolina, et al.
Pubblicazione: (2024)
di: Tamm, Heidi Carolina, et al.
Pubblicazione: (2024)
Using off-the-shelf LLMs to query enterprise data by progressively revealing ontologies
di: Civili, C., et al.
Pubblicazione: (2024)
di: Civili, C., et al.
Pubblicazione: (2024)
Mind the Data Gap: Bridging LLMs to Enterprise Data Integration
di: Kayali, Moe, et al.
Pubblicazione: (2024)
di: Kayali, Moe, et al.
Pubblicazione: (2024)
Global Benchmark Database
di: Iser, Ashlin, et al.
Pubblicazione: (2024)
di: Iser, Ashlin, et al.
Pubblicazione: (2024)
Making LLMs Work for Enterprise Data Tasks
di: Demiralp, Çağatay, et al.
Pubblicazione: (2024)
di: Demiralp, Çağatay, et al.
Pubblicazione: (2024)
TopoBench: Benchmarking LLMs on Hard Topological Reasoning
di: Maniparambil, Mayug, et al.
Pubblicazione: (2026)
di: Maniparambil, Mayug, et al.
Pubblicazione: (2026)
Trustworthy and Efficient LLMs Meet Databases
di: Kim, Kyoungmin, et al.
Pubblicazione: (2024)
di: Kim, Kyoungmin, et al.
Pubblicazione: (2024)
LLMs for Knowledge Graph Construction and Reasoning: Recent Capabilities and Future Opportunities
di: Zhu, Yuqi, et al.
Pubblicazione: (2023)
di: Zhu, Yuqi, et al.
Pubblicazione: (2023)
Graph Learning in the Era of LLMs: A Survey from the Perspective of Data, Models, and Tasks
di: Li, Xunkai, et al.
Pubblicazione: (2024)
di: Li, Xunkai, et al.
Pubblicazione: (2024)
Odin: Multi-Signal Graph Intelligence for Autonomous Discovery in Knowledge Graphs
di: Kizito, Muyukani, et al.
Pubblicazione: (2026)
di: Kizito, Muyukani, et al.
Pubblicazione: (2026)
Documenti analoghi
-
KramaBench: A Benchmark for AI Systems on Data-to-Insight Pipelines over Data Lakes
di: Lai, Eugenie, et al.
Pubblicazione: (2025) -
GraphAide: Advanced Graph-Assisted Query and Reasoning System
di: Purohit, Sumit, et al.
Pubblicazione: (2024) -
ELT-Bench-Verified: Benchmark Quality Issues Underestimate AI Agent Capabilities
di: Zanoli, Christopher, et al.
Pubblicazione: (2026) -
ELT-Bench: An End-to-End Benchmark for Evaluating AI Agents on ELT Pipelines
di: Jin, Tengjun, et al.
Pubblicazione: (2025) -
ClinDet-Bench: Beyond Abstention, Evaluating Judgment Determinability of LLMs in Clinical Decision-Making
di: Watanabe, Yusuke, et al.
Pubblicazione: (2026)