Towards Universal Debiasing for Language Models-based Tabular Data Generation
Fuente:
arXiv
Saved in:
| Main Authors: | Li, Tianchun, Liu, Tianci, Wang, Xingchen, Wei, Rongzhe, Li, Pan, Su, Lu, Gao, Jing |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
LIDAO: Towards Limited Interventions for Debiasing (Large) Language Models
by: Liu, Tianci, et al.
Published: (2024)
by: Liu, Tianci, et al.
Published: (2024)
Privately Learning from Graphs with Applications in Fine-tuning Large Language Models
by: Yin, Haoteng, et al.
Published: (2024)
by: Yin, Haoteng, et al.
Published: (2024)
Model Generalization on Text Attribute Graphs: Principles with Large Language Models
by: Wang, Haoyu, et al.
Published: (2025)
by: Wang, Haoyu, et al.
Published: (2025)
LegalDrill: Diagnosis-Driven Synthesis for Legal Reasoning in Small Language Models
by: Li, Tianchun, et al.
Published: (2026)
by: Li, Tianchun, et al.
Published: (2026)
Towards Privacy-Preserving and Heterogeneity-aware Split Federated Learning via Probabilistic Masking
by: Wang, Xingchen, et al.
Published: (2025)
by: Wang, Xingchen, et al.
Published: (2025)
Towards Federated RLHF with Aggregated Client Preference for LLMs
by: Wu, Feijie, et al.
Published: (2024)
by: Wu, Feijie, et al.
Published: (2024)
DBR: Divergence-Based Regularization for Debiasing Natural Language Understanding Models
by: Li, Zihao, et al.
Published: (2025)
by: Li, Zihao, et al.
Published: (2025)
Towards Poisoning Fair Representations
by: Liu, Tianci, et al.
Published: (2023)
by: Liu, Tianci, et al.
Published: (2023)
Debiasing Watermarks for Large Language Models via Maximal Coupling
by: Xie, Yangxinyu, et al.
Published: (2024)
by: Xie, Yangxinyu, et al.
Published: (2024)
FIARSE: Model-Heterogeneous Federated Learning via Importance-Aware Submodel Extraction
by: Wu, Feijie, et al.
Published: (2024)
by: Wu, Feijie, et al.
Published: (2024)
Differentially Private Tabular Data Synthesis using Large Language Models
by: Tran, Toan V., et al.
Published: (2024)
by: Tran, Toan V., et al.
Published: (2024)
UniTabE: A Universal Pretraining Protocol for Tabular Foundation Model in Data Science
by: Yang, Yazheng, et al.
Published: (2023)
by: Yang, Yazheng, et al.
Published: (2023)
ELF-Gym: Evaluating Large Language Models Generated Features for Tabular Prediction
by: Zhang, Yanlin, et al.
Published: (2024)
by: Zhang, Yanlin, et al.
Published: (2024)
Dynamic Universal Approximation Theory: The Basic Theory for Transformer-based Large Language Models
by: Wang, Wei, et al.
Published: (2024)
by: Wang, Wei, et al.
Published: (2024)
Not All Features Deserve Attention: Graph-Guided Dependency Learning for Tabular Data Generation with Language Models
by: Zhang, Zheyu, et al.
Published: (2025)
by: Zhang, Zheyu, et al.
Published: (2025)
Elephants Never Forget: Testing Language Models for Memorization of Tabular Data
by: Bordt, Sebastian, et al.
Published: (2024)
by: Bordt, Sebastian, et al.
Published: (2024)
Beyond Extraction: Contextualising Tabular Data for Efficient Summarisation by Language Models
by: Allu, Uday, et al.
Published: (2024)
by: Allu, Uday, et al.
Published: (2024)
TabSTAR: A Tabular Foundation Model for Tabular Data with Text Fields
by: Arazi, Alan, et al.
Published: (2025)
by: Arazi, Alan, et al.
Published: (2025)
Masked Language Modeling Becomes Conditional Density Estimation for Tabular Data Synthesis
by: An, Seunghwan, et al.
Published: (2024)
by: An, Seunghwan, et al.
Published: (2024)
An Automatic Prompt Generation System for Tabular Data Tasks
by: Akella, Ashlesha, et al.
Published: (2024)
by: Akella, Ashlesha, et al.
Published: (2024)
Human-LLM Collaborative Feature Engineering for Tabular Data
by: Li, Zhuoyan, et al.
Published: (2026)
by: Li, Zhuoyan, et al.
Published: (2026)
Transfer Learning of Tabular Data by Finetuning Large Language Models
by: Rabbani, Shourav B., et al.
Published: (2025)
by: Rabbani, Shourav B., et al.
Published: (2025)
Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing
by: Liu, Tianci, et al.
Published: (2025)
by: Liu, Tianci, et al.
Published: (2025)
Can Large Language Models Generalize Procedures Across Representations?
by: Lin, Fangru, et al.
Published: (2026)
by: Lin, Fangru, et al.
Published: (2026)
Harnessing LLMs Explanations to Boost Surrogate Models in Tabular Data Classification
by: Shi, Ruxue, et al.
Published: (2025)
by: Shi, Ruxue, et al.
Published: (2025)
Towards Active Synthetic Data Generation for Finetuning Language Models
by: Kessler, Samuel, et al.
Published: (2025)
by: Kessler, Samuel, et al.
Published: (2025)
Large Scale Transfer Learning for Tabular Data via Language Modeling
by: Gardner, Josh, et al.
Published: (2024)
by: Gardner, Josh, et al.
Published: (2024)
CuTS: Customizable Tabular Synthetic Data Generation
by: Vero, Mark, et al.
Published: (2023)
by: Vero, Mark, et al.
Published: (2023)
TabDLM: Free-Form Tabular Data Generation via Joint Numerical-Language Diffusion
by: Cai, Donghong, et al.
Published: (2026)
by: Cai, Donghong, et al.
Published: (2026)
Efficient Uncertainty Estimation for LLM-based Entity Linking in Tabular Data
by: Bono, Carlo, et al.
Published: (2025)
by: Bono, Carlo, et al.
Published: (2025)
BiasEdit: Debiasing Stereotyped Language Models via Model Editing
by: Xu, Xin, et al.
Published: (2025)
by: Xu, Xin, et al.
Published: (2025)
Confronting LLMs with Traditional ML: Rethinking the Fairness of Large Language Models in Tabular Classifications
by: Liu, Yanchen, et al.
Published: (2023)
by: Liu, Yanchen, et al.
Published: (2023)
Making Pre-trained Language Models Great on Tabular Prediction
by: Yan, Jiahuan, et al.
Published: (2024)
by: Yan, Jiahuan, et al.
Published: (2024)
Elephants Never Forget: Memorization and Learning of Tabular Data in Large Language Models
by: Bordt, Sebastian, et al.
Published: (2024)
by: Bordt, Sebastian, et al.
Published: (2024)
TritonBench: Benchmarking Large Language Model Capabilities for Generating Triton Operators
by: Li, Jianling, et al.
Published: (2025)
by: Li, Jianling, et al.
Published: (2025)
Differentially Private Graph Diffusion with Applications in Personalized PageRanks
by: Wei, Rongzhe, et al.
Published: (2024)
by: Wei, Rongzhe, et al.
Published: (2024)
API Is Enough: Conformal Prediction for Large Language Models Without Logit-Access
by: Su, Jiayuan, et al.
Published: (2024)
by: Su, Jiayuan, et al.
Published: (2024)
Tabby: A Language Model Architecture for Tabular and Structured Data Synthesis
by: Cromp, Sonia, et al.
Published: (2025)
by: Cromp, Sonia, et al.
Published: (2025)
Vulnerability Mitigation for Safety-Aligned Language Models via Debiasing
by: Tran, Thien Q., et al.
Published: (2025)
by: Tran, Thien Q., et al.
Published: (2025)
Thermometer: Towards Universal Calibration for Large Language Models
by: Shen, Maohao, et al.
Published: (2024)
by: Shen, Maohao, et al.
Published: (2024)
Similar Items
-
LIDAO: Towards Limited Interventions for Debiasing (Large) Language Models
by: Liu, Tianci, et al.
Published: (2024) -
Privately Learning from Graphs with Applications in Fine-tuning Large Language Models
by: Yin, Haoteng, et al.
Published: (2024) -
Model Generalization on Text Attribute Graphs: Principles with Large Language Models
by: Wang, Haoyu, et al.
Published: (2025) -
LegalDrill: Diagnosis-Driven Synthesis for Legal Reasoning in Small Language Models
by: Li, Tianchun, et al.
Published: (2026) -
Towards Privacy-Preserving and Heterogeneity-aware Split Federated Learning via Probabilistic Masking
by: Wang, Xingchen, et al.
Published: (2025)