Doubling Your Data in Minutes: Ultra-fast Tabular Data Generation via LLM-Induced Dependency Graphs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yang, Shuo, Zhang, Zheyu, Prenkaj, Bardh, Kasneci, Gjergji |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Active Tabular Augmentation via Policy-Guided Diffusion Inpainting
par: Zhang, Zheyu, et autres
Publié: (2026)
par: Zhang, Zheyu, et autres
Publié: (2026)
SAGE: Sparse Adaptive Guidance for Dependency-Aware Tabular Data Generation
par: Yang, Shuo, et autres
Publié: (2026)
par: Yang, Shuo, et autres
Publié: (2026)
Not All Features Deserve Attention: Graph-Guided Dependency Learning for Tabular Data Generation with Language Models
par: Zhang, Zheyu, et autres
Publié: (2025)
par: Zhang, Zheyu, et autres
Publié: (2025)
CURE: Controlled Unlearning for Robust Embeddings -- Mitigating Conceptual Shortcuts in Pre-Trained Language Models
par: Kocak, Aysenur, et autres
Publié: (2025)
par: Kocak, Aysenur, et autres
Publié: (2025)
TabSCM: A practical Framework for Generating Realistic Tabular Data
par: Jacob, Sven, et autres
Publié: (2026)
par: Jacob, Sven, et autres
Publié: (2026)
Enriching Tabular Data with Contextual LLM Embeddings: A Comprehensive Ablation Study for Ensemble Classifiers
par: Kasneci, Gjergji, et autres
Publié: (2024)
par: Kasneci, Gjergji, et autres
Publié: (2024)
SCISSOR: Mitigating Semantic Bias through Cluster-Aware Siamese Networks for Robust Classification
par: Yang, Shuo, et autres
Publié: (2025)
par: Yang, Shuo, et autres
Publié: (2025)
RAZOR: Sharpening Knowledge by Cutting Bias with Unsupervised Text Rewriting
par: Yang, Shuo, et autres
Publié: (2024)
par: Yang, Shuo, et autres
Publié: (2024)
Probabilistic Aggregation and Targeted Embedding Optimization for Collective Moral Reasoning in Large Language Models
par: Yuan, Chenchen, et autres
Publié: (2025)
par: Yuan, Chenchen, et autres
Publié: (2025)
From Confidence to Collapse in LLM Factual Robustness
par: Fastowski, Alina, et autres
Publié: (2025)
par: Fastowski, Alina, et autres
Publié: (2025)
Graph Inverse Style Transfer for Counterfactual Explainability
par: Prenkaj, Bardh, et autres
Publié: (2025)
par: Prenkaj, Bardh, et autres
Publié: (2025)
Reinforcement Unlearning via Group Relative Policy Optimization
par: Zaradoukas, Efstratios, et autres
Publié: (2026)
par: Zaradoukas, Efstratios, et autres
Publié: (2026)
Where Paths Split: Localized, Calibrated Control of Moral Reasoning in Large Language Models
par: Yuan, Chenchen, et autres
Publié: (2026)
par: Yuan, Chenchen, et autres
Publié: (2026)
Towards Non-Adversarial Algorithmic Recourse
par: Leemann, Tobias, et autres
Publié: (2024)
par: Leemann, Tobias, et autres
Publié: (2024)
Moral Lenses, Political Coordinates: Towards Ideological Positioning of Morally Conditioned LLMs
par: Yuan, Chenchen, et autres
Publié: (2026)
par: Yuan, Chenchen, et autres
Publié: (2026)
Robust Stochastic Graph Generator for Counterfactual Explanations
par: Prado-Romero, Mario Alfonso, et autres
Publié: (2023)
par: Prado-Romero, Mario Alfonso, et autres
Publié: (2023)
Injecting Falsehoods: Adversarial Man-in-the-Middle Attacks Undermining Factual Recall in LLMs
par: Fastowski, Alina, et autres
Publié: (2025)
par: Fastowski, Alina, et autres
Publié: (2025)
Consolidating Rewarded Perturbations for LLM Post-Training
par: Zhang, Zheyu, et autres
Publié: (2026)
par: Zhang, Zheyu, et autres
Publié: (2026)
TLOB: A Novel Transformer Model with Dual Attention for Price Trend Prediction with Limit Order Book Data
par: Berti, Leonardo, et autres
Publié: (2025)
par: Berti, Leonardo, et autres
Publié: (2025)
Position: Uncertainty Quantification Needs Reassessment for Large-language Model Agents
par: Kirchhof, Michael, et autres
Publié: (2025)
par: Kirchhof, Michael, et autres
Publié: (2025)
Is Crowdsourcing Breaking Your Bank? Cost-Effective Fine-Tuning of Pre-trained Language Models with Proximal Policy Optimization
par: Yang, Shuo, et autres
Publié: (2024)
par: Yang, Shuo, et autres
Publié: (2024)
A Survey on Graph Counterfactual Explanations: Definitions, Methods, Evaluation, and Research Challenges
par: Prado-Romero, Mario Alfonso, et autres
Publié: (2022)
par: Prado-Romero, Mario Alfonso, et autres
Publié: (2022)
TRADES: Generating Realistic Market Simulations with Diffusion Models
par: Berti, Leonardo, et autres
Publié: (2025)
par: Berti, Leonardo, et autres
Publié: (2025)
I Prefer not to Say: Protecting User Consent in Models with Optional Personal Data
par: Leemann, Tobias, et autres
Publié: (2022)
par: Leemann, Tobias, et autres
Publié: (2022)
P-TA: Using Proximal Policy Optimization to Enhance Tabular Data Augmentation via Large Language Models
par: Yang, Shuo, et autres
Publié: (2024)
par: Yang, Shuo, et autres
Publié: (2024)
Emergent Abilities in Large Language Models: A Survey
par: Berti, Leonardo, et autres
Publié: (2025)
par: Berti, Leonardo, et autres
Publié: (2025)
TAGAL: Tabular Data Generation using Agentic LLM Methods
par: Ronval, Benoît, et autres
Publié: (2025)
par: Ronval, Benoît, et autres
Publié: (2025)
Attention Mechanisms Don't Learn Additive Models: Rethinking Feature Importance for Transformers
par: Leemann, Tobias, et autres
Publié: (2024)
par: Leemann, Tobias, et autres
Publié: (2024)
Gender Bias in Explainability: Investigating Performance Disparity in Post-hoc Methods
par: Dhaini, Mahdi, et autres
Publié: (2025)
par: Dhaini, Mahdi, et autres
Publié: (2025)
Grokking in the Wild: Data Augmentation for Real-World Multi-Hop Reasoning with Transformers
par: Abramov, Roman, et autres
Publié: (2025)
par: Abramov, Roman, et autres
Publié: (2025)
Sycophancy is an Educational Safety Risk: Why LLM Tutors Need Sycophancy Benchmarks
par: Kasneci, Enkelejda, et autres
Publié: (2026)
par: Kasneci, Enkelejda, et autres
Publié: (2026)
GEM-T: Generative Tabular Data via Fitting Moments
par: Li, Miao, et autres
Publié: (2025)
par: Li, Miao, et autres
Publié: (2025)
LLM Embeddings for Deep Learning on Tabular Data
par: Koloski, Boshko, et autres
Publié: (2025)
par: Koloski, Boshko, et autres
Publié: (2025)
Improving LLM Group Fairness on Tabular Data via In-Context Learning
par: Cherepanova, Valeriia, et autres
Publié: (2024)
par: Cherepanova, Valeriia, et autres
Publié: (2024)
Interpretable Graph Neural Networks for Tabular Data
par: Alkhatib, Amr, et autres
Publié: (2023)
par: Alkhatib, Amr, et autres
Publié: (2023)
Team, Then Trim: An Assembly-Line LLM Framework for High-Quality Tabular Data Generation
par: Zhang, Congjing, et autres
Publié: (2026)
par: Zhang, Congjing, et autres
Publié: (2026)
EvalxNLP: A Framework for Benchmarking Post-Hoc Explainability Methods on NLP Models
par: Dhaini, Mahdi, et autres
Publié: (2025)
par: Dhaini, Mahdi, et autres
Publié: (2025)
Semantically Guided Representation Learning For Action Anticipation
par: Diko, Anxhelo, et autres
Publié: (2024)
par: Diko, Anxhelo, et autres
Publié: (2024)
When Tables Leak: Attacking String Memorization in LLM-Based Tabular Data Generation
par: Ward, Joshua, et autres
Publié: (2025)
par: Ward, Joshua, et autres
Publié: (2025)
A Sobering Look at Tabular Data Generation via Probabilistic Circuits
par: Scassola, Davide, et autres
Publié: (2026)
par: Scassola, Davide, et autres
Publié: (2026)
Documents similaires
-
Active Tabular Augmentation via Policy-Guided Diffusion Inpainting
par: Zhang, Zheyu, et autres
Publié: (2026) -
SAGE: Sparse Adaptive Guidance for Dependency-Aware Tabular Data Generation
par: Yang, Shuo, et autres
Publié: (2026) -
Not All Features Deserve Attention: Graph-Guided Dependency Learning for Tabular Data Generation with Language Models
par: Zhang, Zheyu, et autres
Publié: (2025) -
CURE: Controlled Unlearning for Robust Embeddings -- Mitigating Conceptual Shortcuts in Pre-Trained Language Models
par: Kocak, Aysenur, et autres
Publié: (2025) -
TabSCM: A practical Framework for Generating Realistic Tabular Data
par: Jacob, Sven, et autres
Publié: (2026)