StructText: A Synthetic Table-to-Text Approach for Benchmark Generation with Multi-Dimensional Evaluation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kashyap, Satyananda, Shirai, Sola, Mihindukulasooriya, Nandana, Samulowitz, Horst |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DP-Bench: A Benchmark for Evaluating Data Product Creation Systems
par: Chowdhury, Faisal, et autres
Publié: (2025)
par: Chowdhury, Faisal, et autres
Publié: (2025)
SemStruct: Contextualizing Semantic Embeddings with Structural Information for Schema Matching
par: Kang, Inwon, et autres
Publié: (2026)
par: Kang, Inwon, et autres
Publié: (2026)
RUST-BENCH: Benchmarking LLM Reasoning on Unstructured Text within Structured Tables
par: Abhyankar, Nikhil, et autres
Publié: (2025)
par: Abhyankar, Nikhil, et autres
Publié: (2025)
TARGET: Benchmarking Table Retrieval for Generative Tasks
par: Ji, Xingyu, et autres
Publié: (2025)
par: Ji, Xingyu, et autres
Publié: (2025)
Text-to-SQL Task-oriented Dialogue Ontology Construction
par: Vukovic, Renato, et autres
Publié: (2025)
par: Vukovic, Renato, et autres
Publié: (2025)
KeyInst: Keyword Instruction for Improving SQL Formulation in Text-to-SQL
par: Liu, Xiping, et autres
Publié: (2024)
par: Liu, Xiping, et autres
Publié: (2024)
DPDisc: From Factoid Questions to Data Product Requests for Open-World Data Product Discovery over Tables and Text
par: Zhang, Liangliang, et autres
Publié: (2025)
par: Zhang, Liangliang, et autres
Publié: (2025)
Multilingual Text-to-SQL: Benchmarking the Limits of Language Models with Collaborative Language Agents
par: Pham, Khanh Trinh, et autres
Publié: (2025)
par: Pham, Khanh Trinh, et autres
Publié: (2025)
Reliable Answers for Recurring Questions: Boosting Text-to-SQL Accuracy with Template Constrained Decoding
par: Jivani, Smit, et autres
Publié: (2026)
par: Jivani, Smit, et autres
Publié: (2026)
Text-to-SQL Oriented to the Process Mining Domain: A PT-EN Dataset for Query Translation
par: Yamate, Bruno Yui, et autres
Publié: (2025)
par: Yamate, Bruno Yui, et autres
Publié: (2025)
EHR-SeqSQL : A Sequential Text-to-SQL Dataset For Interactively Exploring Electronic Health Records
par: Ryu, Jaehee, et autres
Publié: (2024)
par: Ryu, Jaehee, et autres
Publié: (2024)
LR-SQL: A Supervised Fine-Tuning Method for Text2SQL Tasks under Low-Resource Scenarios
par: Wuzhenghong, Wen, et autres
Publié: (2024)
par: Wuzhenghong, Wen, et autres
Publié: (2024)
QDA-SQL: Questions Enhanced Dialogue Augmentation for Multi-Turn Text-to-SQL
par: Sun, Yinggang, et autres
Publié: (2024)
par: Sun, Yinggang, et autres
Publié: (2024)
From Questions to Queries: An AI-powered Multi-Agent Framework for Spatial Text-to-SQL
par: Kazazi, Ali Khosravi, et autres
Publié: (2025)
par: Kazazi, Ali Khosravi, et autres
Publié: (2025)
Balancing Content Size in RAG-Text2SQL System
par: Gurawa, Prakhar, et autres
Publié: (2025)
par: Gurawa, Prakhar, et autres
Publié: (2025)
Text-to-SQL Calibration: No Need to Ask -- Just Rescale Model Probabilities
par: Ramachandran, Ashwin, et autres
Publié: (2024)
par: Ramachandran, Ashwin, et autres
Publié: (2024)
Fine-Grained Table Retrieval Through the Lens of Complex Queries
par: Kosiuk, Wojciech, et autres
Publié: (2026)
par: Kosiuk, Wojciech, et autres
Publié: (2026)
PARROT: A Benchmark for Evaluating LLMs in Cross-System SQL Translation
par: Zhou, Wei, et autres
Publié: (2025)
par: Zhou, Wei, et autres
Publié: (2025)
SPARKLE: Enhancing SPARQL Generation with Direct KG Integration in Decoding
par: Lee, Jaebok, et autres
Publié: (2024)
par: Lee, Jaebok, et autres
Publié: (2024)
KU-DMIS at EHRSQL 2024:Generating SQL query via question templatization in EHR
par: Kim, Hajung, et autres
Publié: (2024)
par: Kim, Hajung, et autres
Publié: (2024)
Something's Fishy In The Data Lake: A Critical Re-evaluation of Table Union Search Benchmarks
par: Boutaleb, Allaa, et autres
Publié: (2025)
par: Boutaleb, Allaa, et autres
Publié: (2025)
HCT-QA: A Benchmark for Question Answering on Human-Centric Tables
par: Ahmad, Mohammad S., et autres
Publié: (2025)
par: Ahmad, Mohammad S., et autres
Publié: (2025)
Exploring Multi-Table Retrieval Through Iterative Search
par: Boutaleb, Allaa, et autres
Publié: (2025)
par: Boutaleb, Allaa, et autres
Publié: (2025)
Agent-UniRAG: A Trainable Open-Source LLM Agent Framework for Unified Retrieval-Augmented Generation Systems
par: Pham, Hoang, et autres
Publié: (2025)
par: Pham, Hoang, et autres
Publié: (2025)
SPARQL Generation: an analysis on fine-tuning OpenLLaMA for Question Answering over a Life Science Knowledge Graph
par: Rangel, Julio C., et autres
Publié: (2024)
par: Rangel, Julio C., et autres
Publié: (2024)
Evaluating Structured Decoding for Text-to-Table Generation: Evidence from Three Datasets
par: Oestreich, Julian, et autres
Publié: (2025)
par: Oestreich, Julian, et autres
Publié: (2025)
GaussMaster: An LLM-based Database Copilot System
par: Zhou, Wei, et autres
Publié: (2025)
par: Zhou, Wei, et autres
Publié: (2025)
Assessing SPARQL capabilities of Large Language Models
par: Meyer, Lars-Peter, et autres
Publié: (2024)
par: Meyer, Lars-Peter, et autres
Publié: (2024)
Capturing Legal Reasoning Paths from Facts to Law in Court Judgments using Knowledge Graphs
par: Kondo, Ryoma, et autres
Publié: (2025)
par: Kondo, Ryoma, et autres
Publié: (2025)
DRAMA: Unifying Data Retrieval and Analysis for Open-Domain Analytic Queries
par: Hu, Chuxuan, et autres
Publié: (2025)
par: Hu, Chuxuan, et autres
Publié: (2025)
Taxonomy Inference for Tabular Data Using Large Language Models
par: Wu, Zhenyu, et autres
Publié: (2025)
par: Wu, Zhenyu, et autres
Publié: (2025)
Verify-in-the-Graph: Entity Disambiguation Enhancement for Complex Claim Verification with Interactive Graph Representation
par: Pham, Hoang, et autres
Publié: (2025)
par: Pham, Hoang, et autres
Publié: (2025)
NormTab: Improving Symbolic Reasoning in LLMs Through Tabular Data Normalization
par: Nahid, Md Mahadi Hasan, et autres
Publié: (2024)
par: Nahid, Md Mahadi Hasan, et autres
Publié: (2024)
Benchmarking Advanced Text Anonymisation Methods: A Comparative Study on Novel and Traditional Approaches
par: Asimopoulos, Dimitris, et autres
Publié: (2024)
par: Asimopoulos, Dimitris, et autres
Publié: (2024)
RAE: A Neural Network Dimensionality Reduction Method for Nearest Neighbors Preservation in Vector Search
par: Zhang, Han, et autres
Publié: (2025)
par: Zhang, Han, et autres
Publié: (2025)
ModelTables: A Corpus of Tables about Models
par: Dong, Zhengyuan, et autres
Publié: (2025)
par: Dong, Zhengyuan, et autres
Publié: (2025)
MMTEB: Massive Multilingual Text Embedding Benchmark
par: Enevoldsen, Kenneth, et autres
Publié: (2025)
par: Enevoldsen, Kenneth, et autres
Publié: (2025)
Capturing P: On the Expressive Power and Efficient Evaluation of Boolean Retrieval
par: Aavani, Amir
Publié: (2026)
par: Aavani, Amir
Publié: (2026)
ExPerT: Effective and Explainable Evaluation of Personalized Long-Form Text Generation
par: Salemi, Alireza, et autres
Publié: (2025)
par: Salemi, Alireza, et autres
Publié: (2025)
OneGen: Efficient One-Pass Unified Generation and Retrieval for LLMs
par: Zhang, Jintian, et autres
Publié: (2024)
par: Zhang, Jintian, et autres
Publié: (2024)
Documents similaires
-
DP-Bench: A Benchmark for Evaluating Data Product Creation Systems
par: Chowdhury, Faisal, et autres
Publié: (2025) -
SemStruct: Contextualizing Semantic Embeddings with Structural Information for Schema Matching
par: Kang, Inwon, et autres
Publié: (2026) -
RUST-BENCH: Benchmarking LLM Reasoning on Unstructured Text within Structured Tables
par: Abhyankar, Nikhil, et autres
Publié: (2025) -
TARGET: Benchmarking Table Retrieval for Generative Tasks
par: Ji, Xingyu, et autres
Publié: (2025) -
Text-to-SQL Task-oriented Dialogue Ontology Construction
par: Vukovic, Renato, et autres
Publié: (2025)