Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks
Fuente:
arXiv
Saved in:
| Main Authors: | Yin, Jiaqi, Chen, Yi-Wei, Lee, Meng-Lung, Liu, Xiya |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
IEPile: Unearthing Large-Scale Schema-Based Information Extraction Corpus
by: Gui, Honghao, et al.
Published: (2024)
by: Gui, Honghao, et al.
Published: (2024)
SchemaGraphSQL: Efficient Schema Linking with Pathfinding Graph Algorithms for Text-to-SQL on Large-Scale Databases
by: Safdarian, AmirHossein, et al.
Published: (2025)
by: Safdarian, AmirHossein, et al.
Published: (2025)
IndicDB -- Benchmarking Multilingual Text-to-SQL Capabilities in Indian Languages
by: Dawar, Aviral, et al.
Published: (2026)
by: Dawar, Aviral, et al.
Published: (2026)
RSL-SQL: Robust Schema Linking in Text-to-SQL Generation
by: Cao, Zhenbiao, et al.
Published: (2024)
by: Cao, Zhenbiao, et al.
Published: (2024)
Are Large Language Models the New Interface for Data Pipelines?
by: Junior, Sylvio Barbon, et al.
Published: (2024)
by: Junior, Sylvio Barbon, et al.
Published: (2024)
Extractive Schema Linking for Text-to-SQL
by: Glass, Michael, et al.
Published: (2025)
by: Glass, Michael, et al.
Published: (2025)
OneKE: A Dockerized Schema-Guided LLM Agent-based Knowledge Extraction System
by: Luo, Yujie, et al.
Published: (2024)
by: Luo, Yujie, et al.
Published: (2024)
EvoSchema: Towards Text-to-SQL Robustness Against Schema Evolution
by: Zhang, Tianshu, et al.
Published: (2026)
by: Zhang, Tianshu, et al.
Published: (2026)
SMUTF: Schema Matching Using Generative Tags and Hybrid Features
by: Zhang, Yu, et al.
Published: (2024)
by: Zhang, Yu, et al.
Published: (2024)
Schema-Aware Multi-Task Learning for Complex Text-to-SQL
by: Wu, Yangjun, et al.
Published: (2024)
by: Wu, Yangjun, et al.
Published: (2024)
Making Prompts First-Class Citizens for Adaptive LLM Pipelines
by: Cetintemel, Ugur, et al.
Published: (2025)
by: Cetintemel, Ugur, et al.
Published: (2025)
Reframing Spatial Reasoning Evaluation in Language Models: A Real-World Simulation Benchmark for Qualitative Reasoning
by: Li, Fangjun, et al.
Published: (2024)
by: Li, Fangjun, et al.
Published: (2024)
RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models
by: Satriani, Dario, et al.
Published: (2025)
by: Satriani, Dario, et al.
Published: (2025)
Multilingual Text-to-SQL: Benchmarking the Limits of Language Models with Collaborative Language Agents
by: Pham, Khanh Trinh, et al.
Published: (2025)
by: Pham, Khanh Trinh, et al.
Published: (2025)
Towards Scalable Schema Mapping using Large Language Models
by: Buss, Christopher, et al.
Published: (2025)
by: Buss, Christopher, et al.
Published: (2025)
Prompt4Vis: Prompting Large Language Models with Example Mining and Schema Filtering for Tabular Data Visualization
by: Li, Shuaimin, et al.
Published: (2024)
by: Li, Shuaimin, et al.
Published: (2024)
Improving Retrieval-augmented Text-to-SQL with AST-based Ranking and Schema Pruning
by: Shen, Zhili, et al.
Published: (2024)
by: Shen, Zhili, et al.
Published: (2024)
Spider 2.0: Evaluating Language Models on Real-World Enterprise Text-to-SQL Workflows
by: Lei, Fangyu, et al.
Published: (2024)
by: Lei, Fangyu, et al.
Published: (2024)
Schema-R1: A reasoning training approach for schema linking in Text-to-SQL Task
by: Wen, Wuzhenghong, et al.
Published: (2025)
by: Wen, Wuzhenghong, et al.
Published: (2025)
Conceptual Schema Inference for Tabular Datasets using Large Language Models
by: Wu, Zhenyu, et al.
Published: (2025)
by: Wu, Zhenyu, et al.
Published: (2025)
Schema Matching with Large Language Models: an Experimental Study
by: Parciak, Marcel, et al.
Published: (2024)
by: Parciak, Marcel, et al.
Published: (2024)
BAPPA: Benchmarking Agents, Plans, and Pipelines for Automated Text-to-SQL Generation
by: Ahmed, Fahim, et al.
Published: (2025)
by: Ahmed, Fahim, et al.
Published: (2025)
SQL-to-Schema Enhances Schema Linking in Text-to-SQL
by: Yang, Sun, et al.
Published: (2024)
by: Yang, Sun, et al.
Published: (2024)
BEAVER: An Enterprise Benchmark for Text-to-SQL
by: Chen, Peter Baile, et al.
Published: (2024)
by: Chen, Peter Baile, et al.
Published: (2024)
Hunt Instead of Wait: Evaluating Deep Data Research on Large Language Models
by: Liu, Wei, et al.
Published: (2026)
by: Liu, Wei, et al.
Published: (2026)
Compound Schema Registry
by: Fu, Silvery D., et al.
Published: (2024)
by: Fu, Silvery D., et al.
Published: (2024)
PURPLE: Making a Large Language Model a Better SQL Writer
by: Ren, Tonghui, et al.
Published: (2024)
by: Ren, Tonghui, et al.
Published: (2024)
KcMF: A Knowledge-compliant Framework for Schema and Entity Matching with Fine-tuning-free LLMs
by: Xu, Yongqin, et al.
Published: (2024)
by: Xu, Yongqin, et al.
Published: (2024)
Automated Data Visualization from Natural Language via Large Language Models: An Exploratory Study
by: Wu, Yang, et al.
Published: (2024)
by: Wu, Yang, et al.
Published: (2024)
Evaluating the Data Model Robustness of Text-to-SQL Systems Based on Real User Queries
by: Fürst, Jonathan, et al.
Published: (2024)
by: Fürst, Jonathan, et al.
Published: (2024)
OsmT: Bridging OpenStreetMap Queries and Natural Language with Open-source Tag-aware Language Models
by: Wan, Zhuoyue, et al.
Published: (2025)
by: Wan, Zhuoyue, et al.
Published: (2025)
Structure Guided Large Language Model for SQL Generation
by: Zhang, Qinggang, et al.
Published: (2024)
by: Zhang, Qinggang, et al.
Published: (2024)
Revolutionizing Database Q&A with Large Language Models: Comprehensive Benchmark and Evaluation
by: Zheng, Yihang, et al.
Published: (2024)
by: Zheng, Yihang, et al.
Published: (2024)
SEAR: Schema-Based Evaluation and Routing for LLM Gateways
by: Zhang, Zecheng, et al.
Published: (2026)
by: Zhang, Zecheng, et al.
Published: (2026)
Towards Improving Interpretability of Language Model Generation through a Structured Knowledge Discovery Approach
by: Liu, Shuqi, et al.
Published: (2025)
by: Liu, Shuqi, et al.
Published: (2025)
Workspace-Bench 1.0: Benchmarking AI Agents on Workspace Tasks with Large-Scale File Dependencies
by: Tang, Zirui, et al.
Published: (2026)
by: Tang, Zirui, et al.
Published: (2026)
ELT-Bench: An End-to-End Benchmark for Evaluating AI Agents on ELT Pipelines
by: Jin, Tengjun, et al.
Published: (2025)
by: Jin, Tengjun, et al.
Published: (2025)
SQL-PaLM: Improved Large Language Model Adaptation for Text-to-SQL (extended)
by: Sun, Ruoxi, et al.
Published: (2023)
by: Sun, Ruoxi, et al.
Published: (2023)
Advancing Spatial Reasoning in Large Language Models: An In-Depth Evaluation and Enhancement Using the StepGame Benchmark
by: Li, Fangjun, et al.
Published: (2024)
by: Li, Fangjun, et al.
Published: (2024)
Are Large Language Models a Good Replacement of Taxonomies?
by: Sun, Yushi, et al.
Published: (2024)
by: Sun, Yushi, et al.
Published: (2024)
Similar Items
-
IEPile: Unearthing Large-Scale Schema-Based Information Extraction Corpus
by: Gui, Honghao, et al.
Published: (2024) -
SchemaGraphSQL: Efficient Schema Linking with Pathfinding Graph Algorithms for Text-to-SQL on Large-Scale Databases
by: Safdarian, AmirHossein, et al.
Published: (2025) -
IndicDB -- Benchmarking Multilingual Text-to-SQL Capabilities in Indian Languages
by: Dawar, Aviral, et al.
Published: (2026) -
RSL-SQL: Robust Schema Linking in Text-to-SQL Generation
by: Cao, Zhenbiao, et al.
Published: (2024) -
Are Large Language Models the New Interface for Data Pipelines?
by: Junior, Sylvio Barbon, et al.
Published: (2024)