Data Mixing Optimization for Supervised Fine-Tuning of Large Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Li, Yuan, Liu, Zhengzhong, Xing, Eric |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
SFT-GO: Supervised Fine-Tuning with Group Optimization for Large Language Models
von: Kim, Gyuhak, et al.
Veröffentlicht: (2025)
von: Kim, Gyuhak, et al.
Veröffentlicht: (2025)
Preserving Diversity in Supervised Fine-Tuning of Large Language Models
von: Li, Ziniu, et al.
Veröffentlicht: (2024)
von: Li, Ziniu, et al.
Veröffentlicht: (2024)
How Does Controllability Emerge In Language Models During Pretraining?
von: She, Jianshu, et al.
Veröffentlicht: (2025)
von: She, Jianshu, et al.
Veröffentlicht: (2025)
The Effectiveness of Approximate Regularized Replay for Efficient Supervised Fine-Tuning of Large Language Models
von: Riemer, Matthew, et al.
Veröffentlicht: (2025)
von: Riemer, Matthew, et al.
Veröffentlicht: (2025)
How Abilities in Large Language Models are Affected by Supervised Fine-tuning Data Composition
von: Dong, Guanting, et al.
Veröffentlicht: (2023)
von: Dong, Guanting, et al.
Veröffentlicht: (2023)
Improved Supervised Fine-Tuning for Large Language Models to Mitigate Catastrophic Forgetting
von: Ding, Fei, et al.
Veröffentlicht: (2025)
von: Ding, Fei, et al.
Veröffentlicht: (2025)
LIA: Supervised Fine-Tuning of Large Language Models for Automatic Issue Assignment
von: Khosravani, Arsham, et al.
Veröffentlicht: (2026)
von: Khosravani, Arsham, et al.
Veröffentlicht: (2026)
Data Efficient Adaptation in Large Language Models via Continuous Low-Rank Fine-Tuning
von: Han, Xiao, et al.
Veröffentlicht: (2025)
von: Han, Xiao, et al.
Veröffentlicht: (2025)
Safety-Aware Fine-Tuning of Large Language Models
von: Choi, Hyeong Kyu, et al.
Veröffentlicht: (2024)
von: Choi, Hyeong Kyu, et al.
Veröffentlicht: (2024)
RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models
von: Wei, Quan, et al.
Veröffentlicht: (2025)
von: Wei, Quan, et al.
Veröffentlicht: (2025)
Large Language Models Reasoning Abilities Under Non-Ideal Conditions After RL-Fine-Tuning
von: Tian, Chang, et al.
Veröffentlicht: (2025)
von: Tian, Chang, et al.
Veröffentlicht: (2025)
Token Cleaning: Fine-Grained Data Selection for LLM Supervised Fine-Tuning
von: Pang, Jinlong, et al.
Veröffentlicht: (2025)
von: Pang, Jinlong, et al.
Veröffentlicht: (2025)
On-Policy Supervised Fine-Tuning for Efficient Reasoning
von: Zhao, Anhao, et al.
Veröffentlicht: (2026)
von: Zhao, Anhao, et al.
Veröffentlicht: (2026)
Memorization in Fine-Tuned Large Language Models
von: Savine, Danil
Veröffentlicht: (2025)
von: Savine, Danil
Veröffentlicht: (2025)
A Self-Supervised Reinforcement Learning Approach for Fine-Tuning Large Language Models Using Cross-Attention Signals
von: Kiruluta, Andrew, et al.
Veröffentlicht: (2025)
von: Kiruluta, Andrew, et al.
Veröffentlicht: (2025)
Large Language Models for Sequential Decision-Making: Improving In-Context Learning via Supervised Fine-Tuning
von: Zhang, Minmin, et al.
Veröffentlicht: (2026)
von: Zhang, Minmin, et al.
Veröffentlicht: (2026)
Surgery: Mitigating Harmful Fine-Tuning for Large Language Models via Attention Sink
von: Liu, Guozhi, et al.
Veröffentlicht: (2026)
von: Liu, Guozhi, et al.
Veröffentlicht: (2026)
MixLoRA: Enhancing Large Language Models Fine-Tuning with LoRA-based Mixture of Experts
von: Li, Dengchun, et al.
Veröffentlicht: (2024)
von: Li, Dengchun, et al.
Veröffentlicht: (2024)
Assessing and Mitigating Data Memorization Risks in Fine-Tuned Large Language Models
von: Ramakrishnan, Badrinath, et al.
Veröffentlicht: (2025)
von: Ramakrishnan, Badrinath, et al.
Veröffentlicht: (2025)
Agent-Q: Fine-Tuning Large Language Models for Quantum Circuit Generation and Optimization
von: Jern, Linus, et al.
Veröffentlicht: (2025)
von: Jern, Linus, et al.
Veröffentlicht: (2025)
Fine Tuning Large Language Models for Medicine: The Role and Importance of Direct Preference Optimization
von: Savage, Thomas, et al.
Veröffentlicht: (2024)
von: Savage, Thomas, et al.
Veröffentlicht: (2024)
Dynamic Adaptive Optimization for Effective Sentiment Analysis Fine-Tuning on Large Language Models
von: Ding, Hongcheng, et al.
Veröffentlicht: (2024)
von: Ding, Hongcheng, et al.
Veröffentlicht: (2024)
Linear Chain Transformation: Expanding Optimization Dynamics for Fine-Tuning Large Language Models
von: Wang, Yulong, et al.
Veröffentlicht: (2024)
von: Wang, Yulong, et al.
Veröffentlicht: (2024)
GraphGen: Enhancing Supervised Fine-Tuning for LLMs with Knowledge-Driven Synthetic Data Generation
von: Chen, Zihong, et al.
Veröffentlicht: (2025)
von: Chen, Zihong, et al.
Veröffentlicht: (2025)
The Thinking Therapist: Training Large Language Models to Deliver Acceptance and Commitment Therapy using Supervised Fine-Tuning and Odds Ratio Policy Optimization
von: Tahir, Talha
Veröffentlicht: (2025)
von: Tahir, Talha
Veröffentlicht: (2025)
Data Provenance Auditing of Fine-Tuned Large Language Models with a Text-Preserving Technique
von: Li, Yanming, et al.
Veröffentlicht: (2025)
von: Li, Yanming, et al.
Veröffentlicht: (2025)
On the Entropy Dynamics in Reinforcement Fine-Tuning of Large Language Models
von: Wang, Shumin, et al.
Veröffentlicht: (2026)
von: Wang, Shumin, et al.
Veröffentlicht: (2026)
Fine-Tuning and Deploying Large Language Models Over Edges: Issues and Approaches
von: Dong, Yanjie, et al.
Veröffentlicht: (2024)
von: Dong, Yanjie, et al.
Veröffentlicht: (2024)
Rotation-Preserving Supervised Fine-Tuning
von: Jin, Hangzhan, et al.
Veröffentlicht: (2026)
von: Jin, Hangzhan, et al.
Veröffentlicht: (2026)
Proximal Supervised Fine-Tuning
von: Zhu, Wenhong, et al.
Veröffentlicht: (2025)
von: Zhu, Wenhong, et al.
Veröffentlicht: (2025)
PrivTune: Efficient and Privacy-Preserving Fine-Tuning of Large Language Models via Device-Cloud Collaboration
von: Liu, Yi, et al.
Veröffentlicht: (2025)
von: Liu, Yi, et al.
Veröffentlicht: (2025)
Phased Instruction Fine-Tuning for Large Language Models
von: Pang, Wei, et al.
Veröffentlicht: (2024)
von: Pang, Wei, et al.
Veröffentlicht: (2024)
Linearization Explains Fine-Tuning in Large Language Models
von: Afzal, Zahra Rahimi, et al.
Veröffentlicht: (2026)
von: Afzal, Zahra Rahimi, et al.
Veröffentlicht: (2026)
Supervised Fine-Tuning versus Reinforcement Learning: A Study of Post-Training Methods for Large Language Models
von: Jiang, Haitao, et al.
Veröffentlicht: (2026)
von: Jiang, Haitao, et al.
Veröffentlicht: (2026)
Unveiling the Impact of Coding Data Instruction Fine-Tuning on Large Language Models Reasoning
von: Zhang, Xinlu, et al.
Veröffentlicht: (2024)
von: Zhang, Xinlu, et al.
Veröffentlicht: (2024)
Adaptive Defense against Harmful Fine-Tuning for Large Language Models via Bayesian Data Scheduler
von: Hu, Zixuan, et al.
Veröffentlicht: (2025)
von: Hu, Zixuan, et al.
Veröffentlicht: (2025)
A Mechanistic Investigation of Supervised Fine Tuning
von: Chopra, Ruhaan
Veröffentlicht: (2026)
von: Chopra, Ruhaan
Veröffentlicht: (2026)
Does RLVR Extend Reasoning Boundaries? Investigating Capability Expansion in Vision-Language Models
von: Shen, Minghe, et al.
Veröffentlicht: (2025)
von: Shen, Minghe, et al.
Veröffentlicht: (2025)
Fine-Tuning or Fine-Failing? Debunking Performance Myths in Large Language Models
von: Barnett, Scott, et al.
Veröffentlicht: (2024)
von: Barnett, Scott, et al.
Veröffentlicht: (2024)
Unlock the Correlation between Supervised Fine-Tuning and Reinforcement Learning in Training Code Large Language Models
von: Chen, Jie, et al.
Veröffentlicht: (2024)
von: Chen, Jie, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
SFT-GO: Supervised Fine-Tuning with Group Optimization for Large Language Models
von: Kim, Gyuhak, et al.
Veröffentlicht: (2025) -
Preserving Diversity in Supervised Fine-Tuning of Large Language Models
von: Li, Ziniu, et al.
Veröffentlicht: (2024) -
How Does Controllability Emerge In Language Models During Pretraining?
von: She, Jianshu, et al.
Veröffentlicht: (2025) -
The Effectiveness of Approximate Regularized Replay for Efficient Supervised Fine-Tuning of Large Language Models
von: Riemer, Matthew, et al.
Veröffentlicht: (2025) -
How Abilities in Large Language Models are Affected by Supervised Fine-tuning Data Composition
von: Dong, Guanting, et al.
Veröffentlicht: (2023)