Navigating Tabular Data Synthesis Research: Understanding User Needs and Tool Capabilities
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | R., Maria F. Davila, Groen, Sven, Panse, Fabian, Wingerath, Wolfram |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Towards Scalable Generation of Realistic Test Data for Duplicate Detection
par: Panse, Fabian, et autres
Publié: (2023)
par: Panse, Fabian, et autres
Publié: (2023)
Measuring LLM Sensitivity in Transformer-based Tabular Data Synthesis
par: R, Maria F. Davila, et autres
Publié: (2025)
par: R, Maria F. Davila, et autres
Publié: (2025)
Tabular Data Synthesis with Differential Privacy: A Survey
par: Yang, Mengmeng, et autres
Publié: (2024)
par: Yang, Mengmeng, et autres
Publié: (2024)
Position: Foundation Models for Tabular Data within Systemic Contexts Need Grounding
par: Klein, Tassilo, et autres
Publié: (2025)
par: Klein, Tassilo, et autres
Publié: (2025)
Robust Detection of Synthetic Tabular Data under Schema Variability
par: Kindji, G. Charbel N., et autres
Publié: (2025)
par: Kindji, G. Charbel N., et autres
Publié: (2025)
Sophrosyne: Agentic Exploration of Relational Data Systems Needs Moderation
par: Jivrajani, Madhav, et autres
Publié: (2026)
par: Jivrajani, Madhav, et autres
Publié: (2026)
Towards Synthesizing High-Dimensional Tabular Data with Limited Samples
par: Li, Zuqing, et autres
Publié: (2025)
par: Li, Zuqing, et autres
Publié: (2025)
DiffImpute: Tabular Data Imputation With Denoising Diffusion Probabilistic Model
par: Wen, Yizhu, et autres
Publié: (2024)
par: Wen, Yizhu, et autres
Publié: (2024)
Synthetic Tabular Data Detection In the Wild
par: Kindji, G. Charbel N., et autres
Publié: (2025)
par: Kindji, G. Charbel N., et autres
Publié: (2025)
Conceptual Schema Inference for Tabular Datasets using Large Language Models
par: Wu, Zhenyu, et autres
Publié: (2025)
par: Wu, Zhenyu, et autres
Publié: (2025)
TableGPT2: A Large Multimodal Model with Tabular Data Integration
par: Su, Aofeng, et autres
Publié: (2024)
par: Su, Aofeng, et autres
Publié: (2024)
Tabular Data Augmentation for Machine Learning: Progress and Prospects of Embracing Generative AI
par: Cui, Lingxi, et autres
Publié: (2024)
par: Cui, Lingxi, et autres
Publié: (2024)
Quality Assessment of Tabular Data using Large Language Models and Code Generation
par: Akella, Ashlesha, et autres
Publié: (2025)
par: Akella, Ashlesha, et autres
Publié: (2025)
TabSketchFM: Sketch-based Tabular Representation Learning for Data Discovery over Data Lakes
par: Khatiwada, Aamod, et autres
Publié: (2024)
par: Khatiwada, Aamod, et autres
Publié: (2024)
Learning from Anonymized and Incomplete Tabular Data
par: Lange, Lucas, et autres
Publié: (2026)
par: Lange, Lucas, et autres
Publié: (2026)
Datum-wise Transformer for Synthetic Tabular Data Detection in the Wild
par: Kindji, G. Charbel N., et autres
Publié: (2025)
par: Kindji, G. Charbel N., et autres
Publié: (2025)
Evaluating Data Quality Tools: Measurement Capabilities and LLM Integration
par: Rehberger, Tobias, et autres
Publié: (2026)
par: Rehberger, Tobias, et autres
Publié: (2026)
Taxonomy Inference for Tabular Data Using Large Language Models
par: Wu, Zhenyu, et autres
Publié: (2025)
par: Wu, Zhenyu, et autres
Publié: (2025)
AGRO-SQL: Agentic Group-Relative Optimization with High-Fidelity Data Synthesis
par: Yang, Cehua, et autres
Publié: (2025)
par: Yang, Cehua, et autres
Publié: (2025)
Boosting Relational Deep Learning with Pretrained Tabular Models
par: Lachi, Veronica, et autres
Publié: (2025)
par: Lachi, Veronica, et autres
Publié: (2025)
Tabular Foundation Models Can Learn Association Rules
par: Karabulut, Erkan, et autres
Publié: (2026)
par: Karabulut, Erkan, et autres
Publié: (2026)
ELT-Bench-Verified: Benchmark Quality Issues Underestimate AI Agent Capabilities
par: Zanoli, Christopher, et autres
Publié: (2026)
par: Zanoli, Christopher, et autres
Publié: (2026)
SimClone: Detecting Tabular Data Clones using Value Similarity
par: Yang, Xu, et autres
Publié: (2024)
par: Yang, Xu, et autres
Publié: (2024)
Auto-FP: An Experimental Study of Automated Feature Preprocessing for Tabular Data
par: Qi, Danrui, et autres
Publié: (2023)
par: Qi, Danrui, et autres
Publié: (2023)
Mind the Data Gap: Bridging LLMs to Enterprise Data Integration
par: Kayali, Moe, et autres
Publié: (2024)
par: Kayali, Moe, et autres
Publié: (2024)
NormTab: Improving Symbolic Reasoning in LLMs Through Tabular Data Normalization
par: Nahid, Md Mahadi Hasan, et autres
Publié: (2024)
par: Nahid, Md Mahadi Hasan, et autres
Publié: (2024)
Toward Real-World Table Agents: Capabilities, Workflows, and Design Principles for LLM-based Table Intelligence
par: Tian, Jiaming, et autres
Publié: (2025)
par: Tian, Jiaming, et autres
Publié: (2025)
Capturing and Anticipating User Intents in Data Analytics via Knowledge Graphs
par: Pons, Gerard, et autres
Publié: (2024)
par: Pons, Gerard, et autres
Publié: (2024)
A Survey of Pipeline Tools for Data Engineering
par: Mbata, Anthony, et autres
Publié: (2024)
par: Mbata, Anthony, et autres
Publié: (2024)
Generating the Traces You Need: A Conditional Generative Model for Process Mining Data
par: Graziosi, Riccardo, et autres
Publié: (2024)
par: Graziosi, Riccardo, et autres
Publié: (2024)
Is Long Context All You Need? Leveraging LLM's Extended Context for NL2SQL
par: Chung, Yeounoh, et autres
Publié: (2025)
par: Chung, Yeounoh, et autres
Publié: (2025)
OVT-MLCS: An Online Visual Tool for MLCS Mining from Long or Big Sequences
par: Wang, Zhi, et autres
Publié: (2026)
par: Wang, Zhi, et autres
Publié: (2026)
DAOnt: A Formal Ontology for EU Data Act Compliance
par: Leyva-Sánchez, Sheyla, et autres
Publié: (2026)
par: Leyva-Sánchez, Sheyla, et autres
Publié: (2026)
Evaluating the Data Model Robustness of Text-to-SQL Systems Based on Real User Queries
par: Fürst, Jonathan, et autres
Publié: (2024)
par: Fürst, Jonathan, et autres
Publié: (2024)
FLORA: Unsupervised Knowledge Graph Alignment by Fuzzy Logic
par: Peng, Yiwen, et autres
Publié: (2025)
par: Peng, Yiwen, et autres
Publié: (2025)
SWE-SQL: Illuminating LLM Pathways to Solve User SQL Issues in Real-World Applications
par: Li, Jinyang, et autres
Publié: (2025)
par: Li, Jinyang, et autres
Publié: (2025)
DataVisT5: A Pre-trained Language Model for Jointly Understanding Text and Data Visualization
par: Wan, Zhuoyue, et autres
Publié: (2024)
par: Wan, Zhuoyue, et autres
Publié: (2024)
RDF Stream Taxonomy: Systematizing RDF Stream Types in Research and Practice
par: Sowinski, Piotr, et autres
Publié: (2023)
par: Sowinski, Piotr, et autres
Publié: (2023)
RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models
par: Satriani, Dario, et autres
Publié: (2025)
par: Satriani, Dario, et autres
Publié: (2025)
AgenticData: An Agentic Data Analytics System for Heterogeneous Data
par: Sun, Ji, et autres
Publié: (2025)
par: Sun, Ji, et autres
Publié: (2025)
Documents similaires
-
Towards Scalable Generation of Realistic Test Data for Duplicate Detection
par: Panse, Fabian, et autres
Publié: (2023) -
Measuring LLM Sensitivity in Transformer-based Tabular Data Synthesis
par: R, Maria F. Davila, et autres
Publié: (2025) -
Tabular Data Synthesis with Differential Privacy: A Survey
par: Yang, Mengmeng, et autres
Publié: (2024) -
Position: Foundation Models for Tabular Data within Systemic Contexts Need Grounding
par: Klein, Tassilo, et autres
Publié: (2025) -
Robust Detection of Synthetic Tabular Data under Schema Variability
par: Kindji, G. Charbel N., et autres
Publié: (2025)