AutoDDG: Automated Dataset Description Generation using Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Zhang, Haoxiang, Liu, Yurong, Santos, Aécio, Hung, Wei-Lun, Freire, Juliana |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Magneto: Combining Small and Large Language Models for Schema Matching
by: Liu, Yurong, et al.
Published: (2024)
by: Liu, Yurong, et al.
Published: (2024)
Sampling Methods for Inner Product Sketching
by: Daliri, Majid, et al.
Published: (2023)
by: Daliri, Majid, et al.
Published: (2023)
Simple Analysis of Priority Sampling
by: Daliri, Majid, et al.
Published: (2023)
by: Daliri, Majid, et al.
Published: (2023)
Efficiently Estimating Mutual Information Between Attributes Across Tables
by: Santos, Aécio, et al.
Published: (2024)
by: Santos, Aécio, et al.
Published: (2024)
Weighted Minwise Hashing Beats Linear Sketching for Inner Product Estimation
by: Bessa, Aline, et al.
Published: (2023)
by: Bessa, Aline, et al.
Published: (2023)
Interactive Data Harmonization with LLM Agents: Opportunities and Challenges
by: Santos, Aécio, et al.
Published: (2025)
by: Santos, Aécio, et al.
Published: (2025)
StraTyper: Automated Semantic Type Discovery and Multi-Type Annotation for Dataset Collections
by: Koutras, Christos, et al.
Published: (2026)
by: Koutras, Christos, et al.
Published: (2026)
Correlation Sketches for Approximate Join-Correlation Queries
by: Santos, Aécio, et al.
Published: (2021)
by: Santos, Aécio, et al.
Published: (2021)
BDI-Kit Demo: A Toolkit for Programmable and Conversational Data Harmonization
by: Lopez, Roque, et al.
Published: (2026)
by: Lopez, Roque, et al.
Published: (2026)
Conceptual Schema Inference for Tabular Datasets using Large Language Models
by: Wu, Zhenyu, et al.
Published: (2026)
by: Wu, Zhenyu, et al.
Published: (2026)
AutoGEEval: A Multimodal and Automated Framework for Geospatial Code Generation on GEE with Large Language Models
by: Hou, Shuyang, et al.
Published: (2025)
by: Hou, Shuyang, et al.
Published: (2025)
A Unified Approach for Multi-Granularity Search over Spatial Datasets
by: Yang, Wenzhe, et al.
Published: (2024)
by: Yang, Wenzhe, et al.
Published: (2024)
Less Is More? When Dataset Context Hurts LLM-Generated Dataset Descriptions
by: Gan, Lisa-Yao, et al.
Published: (2026)
by: Gan, Lisa-Yao, et al.
Published: (2026)
Conceptual Schema Inference for Tabular Datasets using Large Language Models
by: Wu, Zhenyu, et al.
Published: (2025)
by: Wu, Zhenyu, et al.
Published: (2025)
Revisiting Task-Oriented Dataset Search in the Era of Large Language Models: Challenges, Benchmark, and Solution
by: Wei, Zixin, et al.
Published: (2025)
by: Wei, Zixin, et al.
Published: (2025)
A Flexible and Scalable Approach for Collecting Wildlife Advertisements on the Web
by: Barbosa, Juliana, et al.
Published: (2024)
by: Barbosa, Juliana, et al.
Published: (2024)
Automated Extraction of Mechanical Constitutive Models from Scientific Literature using Large Language Models: Applications in Cultural Heritage Conservation
by: Hu, Rui, et al.
Published: (2026)
by: Hu, Rui, et al.
Published: (2026)
Automated Data Visualization from Natural Language via Large Language Models: An Exploratory Study
by: Wu, Yang, et al.
Published: (2024)
by: Wu, Yang, et al.
Published: (2024)
λ-Tune: Harnessing Large Language Models for Automated Database System Tuning
by: Giannankouris, Victor, et al.
Published: (2024)
by: Giannankouris, Victor, et al.
Published: (2024)
Towards Automated Cross-domain Exploratory Data Analysis through Large Language Models
by: Zhu, Jun-Peng, et al.
Published: (2024)
by: Zhu, Jun-Peng, et al.
Published: (2024)
Large Language Model Enhanced Text-to-SQL Generation: A Survey
by: Zhu, Xiaohu, et al.
Published: (2024)
by: Zhu, Xiaohu, et al.
Published: (2024)
AutoComp: Automated Data Compaction for Log-Structured Tables in Data Lakes
by: Gruenheid, Anja, et al.
Published: (2025)
by: Gruenheid, Anja, et al.
Published: (2025)
CogPic: A Multimodal Dataset for Early Cognitive Impairment Assessment via Picture Description Tasks
by: Wu, Liuyu, et al.
Published: (2026)
by: Wu, Liuyu, et al.
Published: (2026)
AutoCE: An Accurate and Efficient Model Advisor for Learned Cardinality Estimation
by: Zhang, Jintao, et al.
Published: (2024)
by: Zhang, Jintao, et al.
Published: (2024)
DB-GPT: Empowering Database Interactions with Private Large Language Models
by: Xue, Siqiao, et al.
Published: (2023)
by: Xue, Siqiao, et al.
Published: (2023)
Data Cleaning Using Large Language Models
by: Zhang, Shuo, et al.
Published: (2024)
by: Zhang, Shuo, et al.
Published: (2024)
GenRewrite: Query Rewriting via Large Language Models
by: Liu, Jie, et al.
Published: (2024)
by: Liu, Jie, et al.
Published: (2024)
Reliable Curation of EHR Dataset via Large Language Models under Environmental Constraints
by: Xiong, Raymond M., et al.
Published: (2025)
by: Xiong, Raymond M., et al.
Published: (2025)
xpSHACL: Explainable SHACL Validation using Retrieval-Augmented Generation and Large Language Models
by: Publio, Gustavo Correa, et al.
Published: (2025)
by: Publio, Gustavo Correa, et al.
Published: (2025)
AutoDCWorkflow: LLM-based Data Cleaning Workflow Auto-Generation and Benchmark
by: Li, Lan, et al.
Published: (2024)
by: Li, Lan, et al.
Published: (2024)
LINX: A Language Driven Generative System for Goal-Oriented Automated Data Exploration
by: Lipman, Tavor, et al.
Published: (2024)
by: Lipman, Tavor, et al.
Published: (2024)
Can Large Language Models be a Cardinality Estimator? An Empirical study
by: Liu, Liangzu, et al.
Published: (2026)
by: Liu, Liangzu, et al.
Published: (2026)
Large Language Model-Enhanced Relational Operators: Taxonomy, Benchmark, and Analysis
by: Su, Yunxiang, et al.
Published: (2026)
by: Su, Yunxiang, et al.
Published: (2026)
A Query Optimization Method Utilizing Large Language Models
by: Yao, Zhiming, et al.
Published: (2025)
by: Yao, Zhiming, et al.
Published: (2025)
Quality Assessment of Tabular Data using Large Language Models and Code Generation
by: Akella, Ashlesha, et al.
Published: (2025)
by: Akella, Ashlesha, et al.
Published: (2025)
LLMATCH: A Unified Schema Matching Framework with Large Language Models
by: Wang, Sha, et al.
Published: (2025)
by: Wang, Sha, et al.
Published: (2025)
Towards Scalable Schema Mapping using Large Language Models
by: Buss, Christopher, et al.
Published: (2025)
by: Buss, Christopher, et al.
Published: (2025)
Structure Guided Large Language Model for SQL Generation
by: Zhang, Qinggang, et al.
Published: (2024)
by: Zhang, Qinggang, et al.
Published: (2024)
Castle: Causal Cascade Updates in Relational Databases with Large Language Models
by: Su, Yongye, et al.
Published: (2025)
by: Su, Yongye, et al.
Published: (2025)
DB-GPT-Hub: Towards Open Benchmarking Text-to-SQL Empowered by Large Language Models
by: Zhou, Fan, et al.
Published: (2024)
by: Zhou, Fan, et al.
Published: (2024)
Similar Items
-
Magneto: Combining Small and Large Language Models for Schema Matching
by: Liu, Yurong, et al.
Published: (2024) -
Sampling Methods for Inner Product Sketching
by: Daliri, Majid, et al.
Published: (2023) -
Simple Analysis of Priority Sampling
by: Daliri, Majid, et al.
Published: (2023) -
Efficiently Estimating Mutual Information Between Attributes Across Tables
by: Santos, Aécio, et al.
Published: (2024) -
Weighted Minwise Hashing Beats Linear Sketching for Inner Product Estimation
by: Bessa, Aline, et al.
Published: (2023)