Synthesizing Text-to-SQL Data from Weak and Strong LLMs
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Yang, Jiaxi, Hui, Binyuan, Yang, Min, Yang, Jian, Lin, Junyang, Zhou, Chang |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
SWE-Flow: Synthesizing Software Engineering Data in a Test-Driven Manner
von: Zhang, Lei, et al.
Veröffentlicht: (2025)
von: Zhang, Lei, et al.
Veröffentlicht: (2025)
Evaluating and Aligning CodeLLMs on Human Preference
von: Yang, Jian, et al.
Veröffentlicht: (2024)
von: Yang, Jian, et al.
Veröffentlicht: (2024)
SQLForge: Synthesizing Reliable and Diverse Data to Enhance Text-to-SQL Reasoning in LLMs
von: Guo, Yu, et al.
Veröffentlicht: (2025)
von: Guo, Yu, et al.
Veröffentlicht: (2025)
PlotCraft: Pushing the Limits of LLMs for Complex and Interactive Data Visualization
von: Zhang, Jiajun, et al.
Veröffentlicht: (2025)
von: Zhang, Jiajun, et al.
Veröffentlicht: (2025)
PTD-SQL: Partitioning and Targeted Drilling with LLMs in Text-to-SQL
von: Luo, Ruilin, et al.
Veröffentlicht: (2024)
von: Luo, Ruilin, et al.
Veröffentlicht: (2024)
Evaluating and Achieving Controllable Code Completion in Code LLM
von: Zhang, Jiajun, et al.
Veröffentlicht: (2026)
von: Zhang, Jiajun, et al.
Veröffentlicht: (2026)
Parallel Scaling Law for Language Models
von: Chen, Mouxiang, et al.
Veröffentlicht: (2025)
von: Chen, Mouxiang, et al.
Veröffentlicht: (2025)
Multi-Agent Collaboration for Multilingual Code Instruction Tuning
von: Yang, Jian, et al.
Veröffentlicht: (2025)
von: Yang, Jian, et al.
Veröffentlicht: (2025)
OmniSQL: Synthesizing High-quality Text-to-SQL Data at Scale
von: Li, Haoyang, et al.
Veröffentlicht: (2025)
von: Li, Haoyang, et al.
Veröffentlicht: (2025)
CodeElo: Benchmarking Competition-level Code Generation of LLMs with Human-comparable Elo Ratings
von: Quan, Shanghaoran, et al.
Veröffentlicht: (2025)
von: Quan, Shanghaoran, et al.
Veröffentlicht: (2025)
SWE-RM: Execution-free Feedback For Software Engineering Agents
von: Shum, KaShun, et al.
Veröffentlicht: (2025)
von: Shum, KaShun, et al.
Veröffentlicht: (2025)
ExecRepoBench: Multi-level Executable Code Completion Evaluation
von: Yang, Jian, et al.
Veröffentlicht: (2024)
von: Yang, Jian, et al.
Veröffentlicht: (2024)
Iterative Forward Tuning Boosts In-Context Learning in Language Models
von: Yang, Jiaxi, et al.
Veröffentlicht: (2023)
von: Yang, Jiaxi, et al.
Veröffentlicht: (2023)
START: Self-taught Reasoner with Tools
von: Li, Chengpeng, et al.
Veröffentlicht: (2025)
von: Li, Chengpeng, et al.
Veröffentlicht: (2025)
Pi-SQL: Enhancing Text-to-SQL with Fine-Grained Guidance from Pivot Programming Languages
von: chi, Yongdong, et al.
Veröffentlicht: (2025)
von: chi, Yongdong, et al.
Veröffentlicht: (2025)
Text2SQL-Flow: A Robust SQL-Aware Data Augmentation Framework for Text-to-SQL
von: Cai, Qifeng, et al.
Veröffentlicht: (2025)
von: Cai, Qifeng, et al.
Veröffentlicht: (2025)
ReEx-SQL: Reasoning with Execution-Aware Reinforcement Learning for Text-to-SQL
von: Dai, Yaxun, et al.
Veröffentlicht: (2025)
von: Dai, Yaxun, et al.
Veröffentlicht: (2025)
MAC-SQL: A Multi-Agent Collaborative Framework for Text-to-SQL
von: Wang, Bing, et al.
Veröffentlicht: (2023)
von: Wang, Bing, et al.
Veröffentlicht: (2023)
MARS-SQL: A multi-agent reinforcement learning framework for Text-to-SQL
von: Yang, Haolin, et al.
Veröffentlicht: (2025)
von: Yang, Haolin, et al.
Veröffentlicht: (2025)
Open-SQL Framework: Enhancing Text-to-SQL on Open-source Large Language Models
von: Chen, Xiaojun, et al.
Veröffentlicht: (2024)
von: Chen, Xiaojun, et al.
Veröffentlicht: (2024)
Scaling Agentic Verifier for Competitive Coding
von: Ma, Zeyao, et al.
Veröffentlicht: (2026)
von: Ma, Zeyao, et al.
Veröffentlicht: (2026)
DialCLIP: Empowering CLIP as Multi-Modal Dialog Retriever
von: Yin, Zhichao, et al.
Veröffentlicht: (2024)
von: Yin, Zhichao, et al.
Veröffentlicht: (2024)
Can Large Language Models Always Solve Easy Problems if They Can Solve Harder Ones?
von: Yang, Zhe, et al.
Veröffentlicht: (2024)
von: Yang, Zhe, et al.
Veröffentlicht: (2024)
Arctic-Text2SQL-R1: Simple Rewards, Strong Reasoning in Text-to-SQL
von: Yao, Zhewei, et al.
Veröffentlicht: (2025)
von: Yao, Zhewei, et al.
Veröffentlicht: (2025)
From Completion to Editing: Unlocking Context-Aware Code Infilling via Search-and-Replace Instruction Tuning
von: Zhang, Jiajun, et al.
Veröffentlicht: (2026)
von: Zhang, Jiajun, et al.
Veröffentlicht: (2026)
ExeSQL: Self-Taught Text-to-SQL Models with Execution-Driven Bootstrapping for SQL Dialects
von: Zhang, Jipeng, et al.
Veröffentlicht: (2025)
von: Zhang, Jipeng, et al.
Veröffentlicht: (2025)
EvolSQL: Structure-Aware Evolution for Scalable Text-to-SQL Data Synthesis
von: Pan, Xuanguang, et al.
Veröffentlicht: (2026)
von: Pan, Xuanguang, et al.
Veröffentlicht: (2026)
One-Shot Learning as Instruction Data Prospector for Large Language Models
von: Li, Yunshui, et al.
Veröffentlicht: (2023)
von: Li, Yunshui, et al.
Veröffentlicht: (2023)
IFEvalCode: Controlled Code Generation
von: Yang, Jian, et al.
Veröffentlicht: (2025)
von: Yang, Jian, et al.
Veröffentlicht: (2025)
Weak-to-Strong Reasoning
von: Yang, Yuqing, et al.
Veröffentlicht: (2024)
von: Yang, Yuqing, et al.
Veröffentlicht: (2024)
AmbiSQL: Interactive Ambiguity Detection and Resolution for Text-to-SQL
von: Ding, Zhongjun, et al.
Veröffentlicht: (2025)
von: Ding, Zhongjun, et al.
Veröffentlicht: (2025)
Improving Weak-to-Strong Generalization with Reliability-Aware Alignment
von: Guo, Yue, et al.
Veröffentlicht: (2024)
von: Guo, Yue, et al.
Veröffentlicht: (2024)
FinSQL: Model-Agnostic LLMs-based Text-to-SQL Framework for Financial Analysis
von: Zhang, Chao, et al.
Veröffentlicht: (2024)
von: Zhang, Chao, et al.
Veröffentlicht: (2024)
FlexSQL: Flexible Exploration and Execution Make Better Text-to-SQL Agents
von: Pham, Quang Hieu, et al.
Veröffentlicht: (2026)
von: Pham, Quang Hieu, et al.
Veröffentlicht: (2026)
Weak-to-Strong Jailbreaking on Large Language Models
von: Zhao, Xuandong, et al.
Veröffentlicht: (2024)
von: Zhao, Xuandong, et al.
Veröffentlicht: (2024)
Weak-to-Strong Generalization beyond Accuracy: a Pilot Study in Safety, Toxicity, and Legal Reasoning
von: Ye, Ruimeng, et al.
Veröffentlicht: (2024)
von: Ye, Ruimeng, et al.
Veröffentlicht: (2024)
Super(ficial)-alignment: Strong Models May Deceive Weak Models in Weak-to-Strong Generalization
von: Yang, Wenkai, et al.
Veröffentlicht: (2024)
von: Yang, Wenkai, et al.
Veröffentlicht: (2024)
Business Logic-Driven Text-to-SQL Data Synthesis for Business Intelligence
von: Liu, Jinhui, et al.
Veröffentlicht: (2026)
von: Liu, Jinhui, et al.
Veröffentlicht: (2026)
Weakly Supervised Text-to-SQL Parsing through Question Decomposition
von: Wolfson, Tomer, et al.
Veröffentlicht: (2021)
von: Wolfson, Tomer, et al.
Veröffentlicht: (2021)
Qwen2.5-Coder Technical Report
von: Hui, Binyuan, et al.
Veröffentlicht: (2024)
von: Hui, Binyuan, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
SWE-Flow: Synthesizing Software Engineering Data in a Test-Driven Manner
von: Zhang, Lei, et al.
Veröffentlicht: (2025) -
Evaluating and Aligning CodeLLMs on Human Preference
von: Yang, Jian, et al.
Veröffentlicht: (2024) -
SQLForge: Synthesizing Reliable and Diverse Data to Enhance Text-to-SQL Reasoning in LLMs
von: Guo, Yu, et al.
Veröffentlicht: (2025) -
PlotCraft: Pushing the Limits of LLMs for Complex and Interactive Data Visualization
von: Zhang, Jiajun, et al.
Veröffentlicht: (2025) -
PTD-SQL: Partitioning and Targeted Drilling with LLMs in Text-to-SQL
von: Luo, Ruilin, et al.
Veröffentlicht: (2024)