Large Scale Transfer Learning for Tabular Data via Language Modeling
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Gardner, Josh, Perdomo, Juan C., Schmidt, Ludwig |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Transfer Learning of Tabular Data by Finetuning Large Language Models
von: Rabbani, Shourav B., et al.
Veröffentlicht: (2025)
von: Rabbani, Shourav B., et al.
Veröffentlicht: (2025)
Elephants Never Forget: Memorization and Learning of Tabular Data in Large Language Models
von: Bordt, Sebastian, et al.
Veröffentlicht: (2024)
von: Bordt, Sebastian, et al.
Veröffentlicht: (2024)
Tabular Transfer Learning via Prompting LLMs
von: Nam, Jaehyun, et al.
Veröffentlicht: (2024)
von: Nam, Jaehyun, et al.
Veröffentlicht: (2024)
ELF-Gym: Evaluating Large Language Models Generated Features for Tabular Prediction
von: Zhang, Yanlin, et al.
Veröffentlicht: (2024)
von: Zhang, Yanlin, et al.
Veröffentlicht: (2024)
Recycling the Web: A Method to Enhance Pre-training Data Quality and Quantity for Language Models
von: Nguyen, Thao, et al.
Veröffentlicht: (2025)
von: Nguyen, Thao, et al.
Veröffentlicht: (2025)
TabDLM: Free-Form Tabular Data Generation via Joint Numerical-Language Diffusion
von: Cai, Donghong, et al.
Veröffentlicht: (2026)
von: Cai, Donghong, et al.
Veröffentlicht: (2026)
Uncovering Scaling Laws for Large Language Models via Inverse Problems
von: Verma, Arun, et al.
Veröffentlicht: (2025)
von: Verma, Arun, et al.
Veröffentlicht: (2025)
Scaling Data-Constrained Language Models
von: Muennighoff, Niklas, et al.
Veröffentlicht: (2023)
von: Muennighoff, Niklas, et al.
Veröffentlicht: (2023)
Selecting Large Language Model to Fine-tune via Rectified Scaling Law
von: Lin, Haowei, et al.
Veröffentlicht: (2024)
von: Lin, Haowei, et al.
Veröffentlicht: (2024)
Skywork-Math: Data Scaling Laws for Mathematical Reasoning in Large Language Models -- The Story Goes On
von: Zeng, Liang, et al.
Veröffentlicht: (2024)
von: Zeng, Liang, et al.
Veröffentlicht: (2024)
Can Small-Scale Data Poisoning Exacerbate Dialect-Linked Biases in Large Language Models?
von: Abbas, Chaymaa, et al.
Veröffentlicht: (2025)
von: Abbas, Chaymaa, et al.
Veröffentlicht: (2025)
Anomaly Detection of Tabular Data Using LLMs
von: Li, Aodong, et al.
Veröffentlicht: (2024)
von: Li, Aodong, et al.
Veröffentlicht: (2024)
Scaling Sparse Fine-Tuning to Large Language Models
von: Ansell, Alan, et al.
Veröffentlicht: (2024)
von: Ansell, Alan, et al.
Veröffentlicht: (2024)
GUARD: Guided Unlearning and Retention via Data Attribution for Large Language Models
von: Niu, Peizhi, et al.
Veröffentlicht: (2025)
von: Niu, Peizhi, et al.
Veröffentlicht: (2025)
Bridging the Semantic Gap for Categorical Data Clustering via Large Language Models
von: Yang, Zihua, et al.
Veröffentlicht: (2026)
von: Yang, Zihua, et al.
Veröffentlicht: (2026)
DavIR: Data Selection via Implicit Reward for Large Language Models
von: Zhou, Haotian, et al.
Veröffentlicht: (2023)
von: Zhou, Haotian, et al.
Veröffentlicht: (2023)
ReEval: Automatic Hallucination Evaluation for Retrieval-Augmented Large Language Models via Transferable Adversarial Attacks
von: Yu, Xiaodong, et al.
Veröffentlicht: (2023)
von: Yu, Xiaodong, et al.
Veröffentlicht: (2023)
Unveiling Imitation Learning: Exploring the Impact of Data Falsity to Large Language Model
von: Cho, Hyunsoo
Veröffentlicht: (2024)
von: Cho, Hyunsoo
Veröffentlicht: (2024)
Evaluating the Factuality of Large Language Models using Large-Scale Knowledge Graphs
von: Liu, Xiaoze, et al.
Veröffentlicht: (2024)
von: Liu, Xiaoze, et al.
Veröffentlicht: (2024)
Few-Shot Cross-Lingual Transfer for Prompting Large Language Models in Low-Resource Languages
von: Toukmaji, Christopher
Veröffentlicht: (2024)
von: Toukmaji, Christopher
Veröffentlicht: (2024)
Learning to Detect Language Model Training Data via Active Reconstruction
von: Yin, Junjie Oscar, et al.
Veröffentlicht: (2026)
von: Yin, Junjie Oscar, et al.
Veröffentlicht: (2026)
Health-LLM: Large Language Models for Health Prediction via Wearable Sensor Data
von: Kim, Yubin, et al.
Veröffentlicht: (2024)
von: Kim, Yubin, et al.
Veröffentlicht: (2024)
Layer Swapping for Zero-Shot Cross-Lingual Transfer in Large Language Models
von: Bandarkar, Lucas, et al.
Veröffentlicht: (2024)
von: Bandarkar, Lucas, et al.
Veröffentlicht: (2024)
Big-Math: A Large-Scale, High-Quality Math Dataset for Reinforcement Learning in Language Models
von: Albalak, Alon, et al.
Veröffentlicht: (2025)
von: Albalak, Alon, et al.
Veröffentlicht: (2025)
Detecting Data Contamination from Reinforcement Learning Post-training for Large Language Models
von: Tao, Yongding, et al.
Veröffentlicht: (2025)
von: Tao, Yongding, et al.
Veröffentlicht: (2025)
Mix Data or Merge Models? Balancing the Helpfulness, Honesty, and Harmlessness of Large Language Model via Model Merging
von: Yang, Jinluan, et al.
Veröffentlicht: (2025)
von: Yang, Jinluan, et al.
Veröffentlicht: (2025)
UniTabE: A Universal Pretraining Protocol for Tabular Foundation Model in Data Science
von: Yang, Yazheng, et al.
Veröffentlicht: (2023)
von: Yang, Yazheng, et al.
Veröffentlicht: (2023)
Scaling Multimodal Search and Recommendation with Small Language Models via Upside-Down Reinforcement Learning
von: Lin, Yu-Chen, et al.
Veröffentlicht: (2025)
von: Lin, Yu-Chen, et al.
Veröffentlicht: (2025)
Provable Scaling Laws for the Test-Time Compute of Large Language Models
von: Chen, Yanxi, et al.
Veröffentlicht: (2024)
von: Chen, Yanxi, et al.
Veröffentlicht: (2024)
Revisiting the Scaling Properties of Downstream Metrics in Large Language Model Training
von: Krajewski, Jakub, et al.
Veröffentlicht: (2025)
von: Krajewski, Jakub, et al.
Veröffentlicht: (2025)
Beware of Calibration Data for Pruning Large Language Models
von: Ji, Yixin, et al.
Veröffentlicht: (2024)
von: Ji, Yixin, et al.
Veröffentlicht: (2024)
Personalized Product Search Ranking: A Multi-Task Learning Approach with Tabular and Non-Tabular Data
von: Morishetti, Lalitesh, et al.
Veröffentlicht: (2025)
von: Morishetti, Lalitesh, et al.
Veröffentlicht: (2025)
Diversity-oriented Data Augmentation with Large Language Models
von: Wang, Zaitian, et al.
Veröffentlicht: (2025)
von: Wang, Zaitian, et al.
Veröffentlicht: (2025)
LLMSurgeon: Diagnosing Data Mixture of Large Language Models
von: Luo, Yaxin, et al.
Veröffentlicht: (2026)
von: Luo, Yaxin, et al.
Veröffentlicht: (2026)
TharuChat: Bootstrapping Large Language Models for a Low-Resource Language via Synthetic Data and Human Validation
von: Panth, Prajwal, et al.
Veröffentlicht: (2026)
von: Panth, Prajwal, et al.
Veröffentlicht: (2026)
A Large-Scale Benchmark for Evaluating Large Language Models on Medical Question Answering in Romanian
von: Rogoz, Ana-Cristina, et al.
Veröffentlicht: (2025)
von: Rogoz, Ana-Cristina, et al.
Veröffentlicht: (2025)
Scaling Smart: Accelerating Large Language Model Pre-training with Small Model Initialization
von: Samragh, Mohammad, et al.
Veröffentlicht: (2024)
von: Samragh, Mohammad, et al.
Veröffentlicht: (2024)
MaskTab: Scalable Masked Tabular Pretraining with Scaling Laws and Distillation for Industrial Classification
von: Zheng, Bo, et al.
Veröffentlicht: (2026)
von: Zheng, Bo, et al.
Veröffentlicht: (2026)
TaTToo: Tool-Grounded Thinking PRM for Test-Time Scaling in Tabular Reasoning
von: Zou, Jiaru, et al.
Veröffentlicht: (2025)
von: Zou, Jiaru, et al.
Veröffentlicht: (2025)
Learning Mathematical Rules with Large Language Models
von: Gorceix, Antoine, et al.
Veröffentlicht: (2024)
von: Gorceix, Antoine, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Transfer Learning of Tabular Data by Finetuning Large Language Models
von: Rabbani, Shourav B., et al.
Veröffentlicht: (2025) -
Elephants Never Forget: Memorization and Learning of Tabular Data in Large Language Models
von: Bordt, Sebastian, et al.
Veröffentlicht: (2024) -
Tabular Transfer Learning via Prompting LLMs
von: Nam, Jaehyun, et al.
Veröffentlicht: (2024) -
ELF-Gym: Evaluating Large Language Models Generated Features for Tabular Prediction
von: Zhang, Yanlin, et al.
Veröffentlicht: (2024) -
Recycling the Web: A Method to Enhance Pre-training Data Quality and Quantity for Language Models
von: Nguyen, Thao, et al.
Veröffentlicht: (2025)