ASFT: Aligned Supervised Fine-Tuning through Absolute Likelihood
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Ruoyu, Sun, Jiachen, Hua, Shaowei, Fang, Quan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Preserving Diversity in Supervised Fine-Tuning of Large Language Models
par: Li, Ziniu, et autres
Publié: (2024)
par: Li, Ziniu, et autres
Publié: (2024)
Proximal Supervised Fine-Tuning
par: Zhu, Wenhong, et autres
Publié: (2025)
par: Zhu, Wenhong, et autres
Publié: (2025)
Aligning LLMs with Biomedical Knowledge using Balanced Fine-Tuning
par: Tang, Zhenchao, et autres
Publié: (2025)
par: Tang, Zhenchao, et autres
Publié: (2025)
Supervised Fine-Tuning as Inverse Reinforcement Learning
par: Sun, Hao
Publié: (2024)
par: Sun, Hao
Publié: (2024)
MoFO: Momentum-Filtered Optimizer for Mitigating Forgetting in LLM Fine-Tuning
par: Chen, Yupeng, et autres
Publié: (2024)
par: Chen, Yupeng, et autres
Publié: (2024)
Rotation-Preserving Supervised Fine-Tuning
par: Jin, Hangzhan, et autres
Publié: (2026)
par: Jin, Hangzhan, et autres
Publié: (2026)
Deconfounded Causality-aware Parameter-Efficient Fine-Tuning for Problem-Solving Improvement of LLMs
par: Wang, Ruoyu, et autres
Publié: (2024)
par: Wang, Ruoyu, et autres
Publié: (2024)
RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models
par: Wei, Quan, et autres
Publié: (2025)
par: Wei, Quan, et autres
Publié: (2025)
Stabilizing LLM Supervised Fine-Tuning via Explicit Distributional Control
par: Wang, Xinyu, et autres
Publié: (2026)
par: Wang, Xinyu, et autres
Publié: (2026)
A Layer-wise Analysis of Supervised Fine-Tuning
par: Zhao, Qinghua, et autres
Publié: (2026)
par: Zhao, Qinghua, et autres
Publié: (2026)
Goal-Conditioned Supervised Learning for LLM Fine-Tuning
par: Li, Shijun, et autres
Publié: (2026)
par: Li, Shijun, et autres
Publié: (2026)
BiSSL: Enhancing the Alignment Between Self-Supervised Pretraining and Downstream Fine-Tuning via Bilevel Optimization
par: Zakarias, Gustav Wagner, et autres
Publié: (2024)
par: Zakarias, Gustav Wagner, et autres
Publié: (2024)
Understanding and Preserving Safety in Fine-Tuned LLMs
par: Zhang, Jiawen, et autres
Publié: (2026)
par: Zhang, Jiawen, et autres
Publié: (2026)
Balancing Fidelity and Plasticity: Aligning Mixed-Precision Fine-Tuning with Linguistic Hierarchies
par: Zhou, Changhai, et autres
Publié: (2025)
par: Zhou, Changhai, et autres
Publié: (2025)
Restoring Calibration for Aligned Large Language Models: A Calibration-Aware Fine-Tuning Approach
par: Xiao, Jiancong, et autres
Publié: (2025)
par: Xiao, Jiancong, et autres
Publié: (2025)
Aligning Large Language Model Agents with Rational and Moral Preferences: A Supervised Fine-Tuning Approach
par: Lu, Wei, et autres
Publié: (2025)
par: Lu, Wei, et autres
Publié: (2025)
Supervised Fine Tuning on Curated Data is Reinforcement Learning (and can be improved)
par: Qin, Chongli, et autres
Publié: (2025)
par: Qin, Chongli, et autres
Publié: (2025)
Blending Supervised and Reinforcement Fine-Tuning with Prefix Sampling
par: Huang, Zeyu, et autres
Publié: (2025)
par: Huang, Zeyu, et autres
Publié: (2025)
Zeroth-Order Fine-Tuning of LLMs in Random Subspaces
par: Yu, Ziming, et autres
Publié: (2024)
par: Yu, Ziming, et autres
Publié: (2024)
Aligning Large Language Models via Fine-grained Supervision
par: Xu, Dehong, et autres
Publié: (2024)
par: Xu, Dehong, et autres
Publié: (2024)
On-Policy RL Meets Off-Policy Experts: Harmonizing Supervised Fine-Tuning and Reinforcement Learning via Dynamic Weighting
par: Zhang, Wenhao, et autres
Publié: (2025)
par: Zhang, Wenhao, et autres
Publié: (2025)
SFT-GO: Supervised Fine-Tuning with Group Optimization for Large Language Models
par: Kim, Gyuhak, et autres
Publié: (2025)
par: Kim, Gyuhak, et autres
Publié: (2025)
Supervised Fine-Tuning Needs to Unlock the Potential of Token Priority
par: Shen, Zhanming, et autres
Publié: (2026)
par: Shen, Zhanming, et autres
Publié: (2026)
Half-order Fine-Tuning for Diffusion Model: A Recursive Likelihood Ratio Optimizer
par: Ren, Tao, et autres
Publié: (2025)
par: Ren, Tao, et autres
Publié: (2025)
The Effectiveness of Approximate Regularized Replay for Efficient Supervised Fine-Tuning of Large Language Models
par: Riemer, Matthew, et autres
Publié: (2025)
par: Riemer, Matthew, et autres
Publié: (2025)
Just Enough Shifts: Mitigating Over-Refusal in Aligned Language Models with Targeted Representation Fine-Tuning
par: Dabas, Mahavir, et autres
Publié: (2025)
par: Dabas, Mahavir, et autres
Publié: (2025)
SA-EMO: Structure-Aligned Encoder Mixture of Operators for Generalizable Full-waveform Inversion
par: Zhenyu, Wang, et autres
Publié: (2025)
par: Zhenyu, Wang, et autres
Publié: (2025)
Automated Federated Pipeline for Parameter-Efficient Fine-Tuning of Large Language Models
par: Fang, Zihan, et autres
Publié: (2024)
par: Fang, Zihan, et autres
Publié: (2024)
Task-Aware Parameter-Efficient Fine-Tuning of Large Pre-Trained Models at the Edge
par: Hu, Senkang, et autres
Publié: (2025)
par: Hu, Senkang, et autres
Publié: (2025)
FedMomentum: Preserving LoRA Training Momentum in Federated Fine-Tuning
par: Yan, Peishen, et autres
Publié: (2026)
par: Yan, Peishen, et autres
Publié: (2026)
Aligning Backchannel and Dialogue Context Representations via Contrastive LLM Fine-Tuning
par: Qian, Livia, et autres
Publié: (2026)
par: Qian, Livia, et autres
Publié: (2026)
Fine-Tuning without Performance Degradation
par: Wang, Han, et autres
Publié: (2025)
par: Wang, Han, et autres
Publié: (2025)
TuckA: Hierarchical Compact Tensor Experts for Efficient Fine-Tuning
par: Lei, Qifeng, et autres
Publié: (2025)
par: Lei, Qifeng, et autres
Publié: (2025)
SRFT: A Single-Stage Method with Supervised and Reinforcement Fine-Tuning for Reasoning
par: Fu, Yuqian, et autres
Publié: (2025)
par: Fu, Yuqian, et autres
Publié: (2025)
Large Language Models for Sequential Decision-Making: Improving In-Context Learning via Supervised Fine-Tuning
par: Zhang, Minmin, et autres
Publié: (2026)
par: Zhang, Minmin, et autres
Publié: (2026)
RAFT: Data Refinement and Adaptive Distillation for Domain Fine-Tuning with Alleviated Forgetting
par: Li, Yuduo, et autres
Publié: (2026)
par: Li, Yuduo, et autres
Publié: (2026)
On the Entropy Dynamics in Reinforcement Fine-Tuning of Large Language Models
par: Wang, Shumin, et autres
Publié: (2026)
par: Wang, Shumin, et autres
Publié: (2026)
Fine-Tuning LLMs for Report Summarization: Analysis on Supervised and Unsupervised Data
par: Rallapalli, Swati, et autres
Publié: (2025)
par: Rallapalli, Swati, et autres
Publié: (2025)
IA2: Alignment with ICL Activations Improves Supervised Fine-Tuning
par: Mishra, Aayush, et autres
Publié: (2025)
par: Mishra, Aayush, et autres
Publié: (2025)
Pruning for Protection: Increasing Jailbreak Resistance in Aligned LLMs Without Fine-Tuning
par: Hasan, Adib, et autres
Publié: (2024)
par: Hasan, Adib, et autres
Publié: (2024)
Documents similaires
-
Preserving Diversity in Supervised Fine-Tuning of Large Language Models
par: Li, Ziniu, et autres
Publié: (2024) -
Proximal Supervised Fine-Tuning
par: Zhu, Wenhong, et autres
Publié: (2025) -
Aligning LLMs with Biomedical Knowledge using Balanced Fine-Tuning
par: Tang, Zhenchao, et autres
Publié: (2025) -
Supervised Fine-Tuning as Inverse Reinforcement Learning
par: Sun, Hao
Publié: (2024) -
MoFO: Momentum-Filtered Optimizer for Mitigating Forgetting in LLM Fine-Tuning
par: Chen, Yupeng, et autres
Publié: (2024)