MEBench: Benchmarking Large Language Models for Cross-Document Multi-Entity Question Answering
Fuente:
arXiv
Guardado en:
| Autores principales: | Lin, Teng, Luo, Yuyu, Zhang, Honglin, Zhang, Jicheng, Liu, Chunlin, Wu, Kaishun, Tang, Nan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
SRAG: Structured Retrieval-Augmented Generation for Multi-Entity Question Answering over Wikipedia Graph
por: Lin, Teng, et al.
Publicado: (2025)
por: Lin, Teng, et al.
Publicado: (2025)
SketchFill: Sketch-Guided Code Generation for Imputing Derived Missing Values
por: Zhang, Yunfan, et al.
Publicado: (2024)
por: Zhang, Yunfan, et al.
Publicado: (2024)
TCM-Ladder: A Benchmark for Multimodal Question Answering on Traditional Chinese Medicine
por: Xie, Jiacheng, et al.
Publicado: (2025)
por: Xie, Jiacheng, et al.
Publicado: (2025)
Multi-hop Question Answering over Knowledge Graphs using Large Language Models
por: Chakraborty, Abir
Publicado: (2024)
por: Chakraborty, Abir
Publicado: (2024)
Text to Query Plans for Question Answering on Large Tables
por: Zhang, Yipeng, et al.
Publicado: (2025)
por: Zhang, Yipeng, et al.
Publicado: (2025)
DocSage: An Information Structuring Agent for Multi-Doc Multi-Entity Question Answering
por: Lin, Teng, et al.
Publicado: (2026)
por: Lin, Teng, et al.
Publicado: (2026)
SCARE: A Benchmark for SQL Correction and Question Answerability Classification for Reliable EHR Question Answering
por: Lee, Gyubok, et al.
Publicado: (2025)
por: Lee, Gyubok, et al.
Publicado: (2025)
Match, Compare, or Select? An Investigation of Large Language Models for Entity Matching
por: Wang, Tianshu, et al.
Publicado: (2024)
por: Wang, Tianshu, et al.
Publicado: (2024)
EllieSQL: Cost-Efficient Text-to-SQL with Complexity-Aware Routing
por: Zhu, Yizhang, et al.
Publicado: (2025)
por: Zhu, Yizhang, et al.
Publicado: (2025)
Comprehensive Evaluation for a Large Scale Knowledge Graph Question Answering Service
por: Potdar, Saloni, et al.
Publicado: (2025)
por: Potdar, Saloni, et al.
Publicado: (2025)
Disambiguate Entity Matching using Large Language Models through Relation Discovery
por: Huang, Zezhou
Publicado: (2024)
por: Huang, Zezhou
Publicado: (2024)
Accurate Table Question Answering with Accessible LLMs
por: Jiang, Yangfan, et al.
Publicado: (2026)
por: Jiang, Yangfan, et al.
Publicado: (2026)
Towards Question Answering over Large Semi-structured Tables
por: Wang, Yuxiang, et al.
Publicado: (2025)
por: Wang, Yuxiang, et al.
Publicado: (2025)
Benchmarking Large Language Models for Conversational Question Answering in Multi-instructional Documents
por: Wu, Shiwei, et al.
Publicado: (2024)
por: Wu, Shiwei, et al.
Publicado: (2024)
ChartInsights: Evaluating Multimodal Large Language Models for Low-Level Chart Question Answering
por: Wu, Yifan, et al.
Publicado: (2024)
por: Wu, Yifan, et al.
Publicado: (2024)
MedPath: Multi-Domain Cross-Vocabulary Hierarchical Paths for Biomedical Entity Linking
por: Mishra, Nishant, et al.
Publicado: (2025)
por: Mishra, Nishant, et al.
Publicado: (2025)
KBQA-o1: Agentic Knowledge Base Question Answering with Monte Carlo Tree Search
por: Luo, Haoran, et al.
Publicado: (2025)
por: Luo, Haoran, et al.
Publicado: (2025)
RouterKGQA: Specialized--General Model Routing for Constraint-Aware Knowledge Graph Question Answering
por: Yuan, Bo, et al.
Publicado: (2026)
por: Yuan, Bo, et al.
Publicado: (2026)
From Tokens to Materials: Leveraging Language Models for Scientific Discovery
por: Wan, Yuwei, et al.
Publicado: (2024)
por: Wan, Yuwei, et al.
Publicado: (2024)
Memory-QA: Answering Recall Questions Based on Multimodal Memories
por: Jiang, Hongda, et al.
Publicado: (2025)
por: Jiang, Hongda, et al.
Publicado: (2025)
Knowledge Graph-Guided Multi-Agent Distillation for Reliable Industrial Question Answering with Datasets
por: Pan, Jiqun, et al.
Publicado: (2025)
por: Pan, Jiqun, et al.
Publicado: (2025)
NL2SQL-BUGs: A Benchmark for Detecting Semantic Errors in NL2SQL Translation
por: Liu, Xinyu, et al.
Publicado: (2025)
por: Liu, Xinyu, et al.
Publicado: (2025)
RADAR: Benchmarking Language Models on Imperfect Tabular Data
por: Gu, Ken, et al.
Publicado: (2025)
por: Gu, Ken, et al.
Publicado: (2025)
AnyMatch -- Efficient Zero-Shot Entity Matching with a Small Language Model
por: Zhang, Zeyu, et al.
Publicado: (2024)
por: Zhang, Zeyu, et al.
Publicado: (2024)
STARQA: A Question Answering Dataset for Complex Analytical Reasoning over Structured Databases
por: Maddela, Mounica, et al.
Publicado: (2025)
por: Maddela, Mounica, et al.
Publicado: (2025)
LakeHopper: Cross Data Lakes Column Type Annotation through Model Adaptation
por: Sun, Yushi, et al.
Publicado: (2026)
por: Sun, Yushi, et al.
Publicado: (2026)
PM-LLM-Benchmark: Evaluating Large Language Models on Process Mining Tasks
por: Berti, Alessandro, et al.
Publicado: (2024)
por: Berti, Alessandro, et al.
Publicado: (2024)
Natural Language Querying System Through Entity Enrichment
por: Amavi, Joshua, et al.
Publicado: (2024)
por: Amavi, Joshua, et al.
Publicado: (2024)
Relational Database Augmented Large Language Model
por: Qin, Zongyue, et al.
Publicado: (2024)
por: Qin, Zongyue, et al.
Publicado: (2024)
The Dawn of Natural Language to SQL: Are We Fully Ready?
por: Li, Boyan, et al.
Publicado: (2024)
por: Li, Boyan, et al.
Publicado: (2024)
ContextCache: Context-Aware Semantic Cache for Multi-Turn Queries in Large Language Models
por: Yan, Jianxin, et al.
Publicado: (2025)
por: Yan, Jianxin, et al.
Publicado: (2025)
Are Large Language Models a Good Replacement of Taxonomies?
por: Sun, Yushi, et al.
Publicado: (2024)
por: Sun, Yushi, et al.
Publicado: (2024)
GraLMatch: Matching Groups of Entities with Graphs and Language Models
por: Pardo, Fernando De Meer, et al.
Publicado: (2024)
por: Pardo, Fernando De Meer, et al.
Publicado: (2024)
A Plug-and-Play Natural Language Rewriter for Natural Language to SQL
por: Ma, Peixian, et al.
Publicado: (2024)
por: Ma, Peixian, et al.
Publicado: (2024)
Data Agents: Levels, State of the Art, and Open Problems
por: Luo, Yuyu, et al.
Publicado: (2026)
por: Luo, Yuyu, et al.
Publicado: (2026)
Entity-Aware and Secure Query Optimization in Database Using Named Entity Recognition
por: Sultana, Azrin, et al.
Publicado: (2026)
por: Sultana, Azrin, et al.
Publicado: (2026)
Cost-Efficient RAG for Entity Matching with LLMs: A Blocking-based Exploration
por: Ma, Chuangtao, et al.
Publicado: (2026)
por: Ma, Chuangtao, et al.
Publicado: (2026)
MatTools: Benchmarking Large Language Models for Materials Science Tools
por: Liu, Siyu, et al.
Publicado: (2025)
por: Liu, Siyu, et al.
Publicado: (2025)
Q-NL Verifier: Leveraging Synthetic Data for Robust Knowledge Graph Question Answering
por: Schwabe, Tim, et al.
Publicado: (2025)
por: Schwabe, Tim, et al.
Publicado: (2025)
Leveraging LLM-GNN Integration for Open-World Question Answering over Knowledge Graphs
por: Abdallah, Hussein, et al.
Publicado: (2026)
por: Abdallah, Hussein, et al.
Publicado: (2026)
Ejemplares similares
-
SRAG: Structured Retrieval-Augmented Generation for Multi-Entity Question Answering over Wikipedia Graph
por: Lin, Teng, et al.
Publicado: (2025) -
SketchFill: Sketch-Guided Code Generation for Imputing Derived Missing Values
por: Zhang, Yunfan, et al.
Publicado: (2024) -
TCM-Ladder: A Benchmark for Multimodal Question Answering on Traditional Chinese Medicine
por: Xie, Jiacheng, et al.
Publicado: (2025) -
Multi-hop Question Answering over Knowledge Graphs using Large Language Models
por: Chakraborty, Abir
Publicado: (2024) -
Text to Query Plans for Question Answering on Large Tables
por: Zhang, Yipeng, et al.
Publicado: (2025)