A Layer-wise Analysis of Supervised Fine-Tuning
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhao, Qinghua, Gong, Xueling, Chen, Xinyu, Kang, Zhongfeng, Li, Xinlu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Beyond Frequency: The Role of Redundancy in Large Language Model Memorization
di: Zhang, Jie, et al.
Pubblicazione: (2025)
di: Zhang, Jie, et al.
Pubblicazione: (2025)
Rotation-Preserving Supervised Fine-Tuning
di: Jin, Hangzhan, et al.
Pubblicazione: (2026)
di: Jin, Hangzhan, et al.
Pubblicazione: (2026)
LEVI: Generalizable Fine-tuning via Layer-wise Ensemble of Different Views
di: Roh, Yuji, et al.
Pubblicazione: (2024)
di: Roh, Yuji, et al.
Pubblicazione: (2024)
Stabilizing LLM Supervised Fine-Tuning via Explicit Distributional Control
di: Wang, Xinyu, et al.
Pubblicazione: (2026)
di: Wang, Xinyu, et al.
Pubblicazione: (2026)
Preserving Diversity in Supervised Fine-Tuning of Large Language Models
di: Li, Ziniu, et al.
Pubblicazione: (2024)
di: Li, Ziniu, et al.
Pubblicazione: (2024)
DeltaDQ: Ultra-High Delta Compression for Fine-Tuned LLMs via Group-wise Dropout and Separate Quantization
di: Jiang, Yanfeng, et al.
Pubblicazione: (2024)
di: Jiang, Yanfeng, et al.
Pubblicazione: (2024)
Goal-Conditioned Supervised Learning for LLM Fine-Tuning
di: Li, Shijun, et al.
Pubblicazione: (2026)
di: Li, Shijun, et al.
Pubblicazione: (2026)
HELENE: Hessian Layer-wise Clipping and Gradient Annealing for Accelerating Fine-tuning LLM with Zeroth-order Optimization
di: Zhao, Huaqin, et al.
Pubblicazione: (2024)
di: Zhao, Huaqin, et al.
Pubblicazione: (2024)
RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models
di: Wei, Quan, et al.
Pubblicazione: (2025)
di: Wei, Quan, et al.
Pubblicazione: (2025)
Echo-LoRA: Parameter-Efficient Fine-Tuning via Cross-Layer Representation Injection
di: Peng, Yihang, et al.
Pubblicazione: (2026)
di: Peng, Yihang, et al.
Pubblicazione: (2026)
Step-wise Adaptive Integration of Supervised Fine-tuning and Reinforcement Learning for Task-Specific LLMs
di: Chen, Jack, et al.
Pubblicazione: (2025)
di: Chen, Jack, et al.
Pubblicazione: (2025)
Proximal Supervised Fine-Tuning
di: Zhu, Wenhong, et al.
Pubblicazione: (2025)
di: Zhu, Wenhong, et al.
Pubblicazione: (2025)
ASFT: Aligned Supervised Fine-Tuning through Absolute Likelihood
di: Wang, Ruoyu, et al.
Pubblicazione: (2024)
di: Wang, Ruoyu, et al.
Pubblicazione: (2024)
Fine-Tuning LLMs for Report Summarization: Analysis on Supervised and Unsupervised Data
di: Rallapalli, Swati, et al.
Pubblicazione: (2025)
di: Rallapalli, Swati, et al.
Pubblicazione: (2025)
CLOVER: Cross-Layer Orthogonal Vectors Pruning and Fine-Tuning
di: Meng, Fanxu, et al.
Pubblicazione: (2024)
di: Meng, Fanxu, et al.
Pubblicazione: (2024)
SRFT: A Single-Stage Method with Supervised and Reinforcement Fine-Tuning for Reasoning
di: Fu, Yuqian, et al.
Pubblicazione: (2025)
di: Fu, Yuqian, et al.
Pubblicazione: (2025)
Supervised Fine Tuning on Curated Data is Reinforcement Learning (and can be improved)
di: Qin, Chongli, et al.
Pubblicazione: (2025)
di: Qin, Chongli, et al.
Pubblicazione: (2025)
Supervised Fine-Tuning as Inverse Reinforcement Learning
di: Sun, Hao
Pubblicazione: (2024)
di: Sun, Hao
Pubblicazione: (2024)
Supervised Fine-Tuning Needs to Unlock the Potential of Token Priority
di: Shen, Zhanming, et al.
Pubblicazione: (2026)
di: Shen, Zhanming, et al.
Pubblicazione: (2026)
A Novel Multimodal RUL Framework for Remaining Useful Life Estimation with Layer-wise Explanations
di: Razzaq, Waleed, et al.
Pubblicazione: (2025)
di: Razzaq, Waleed, et al.
Pubblicazione: (2025)
SFT-GO: Supervised Fine-Tuning with Group Optimization for Large Language Models
di: Kim, Gyuhak, et al.
Pubblicazione: (2025)
di: Kim, Gyuhak, et al.
Pubblicazione: (2025)
Disentangling Recall and Reasoning in Transformer Models through Layer-wise Attention and Activation Analysis
di: Fartale, Harshwardhan, et al.
Pubblicazione: (2025)
di: Fartale, Harshwardhan, et al.
Pubblicazione: (2025)
Blending Supervised and Reinforcement Fine-Tuning with Prefix Sampling
di: Huang, Zeyu, et al.
Pubblicazione: (2025)
di: Huang, Zeyu, et al.
Pubblicazione: (2025)
On-Policy RL Meets Off-Policy Experts: Harmonizing Supervised Fine-Tuning and Reinforcement Learning via Dynamic Weighting
di: Zhang, Wenhao, et al.
Pubblicazione: (2025)
di: Zhang, Wenhao, et al.
Pubblicazione: (2025)
Towards Instance-wise Personalized Federated Learning via Semi-Implicit Bayesian Prompt Tuning
di: Ye, Tiandi, et al.
Pubblicazione: (2025)
di: Ye, Tiandi, et al.
Pubblicazione: (2025)
LaRA: Layer-wise Representation Analysis for Detecting Data Contamination in RL Post-Training
di: Gwak, Minju, et al.
Pubblicazione: (2026)
di: Gwak, Minju, et al.
Pubblicazione: (2026)
Zeroth-Order Fine-Tuning of LLMs with Extreme Sparsity
di: Guo, Wentao, et al.
Pubblicazione: (2024)
di: Guo, Wentao, et al.
Pubblicazione: (2024)
The Effectiveness of Approximate Regularized Replay for Efficient Supervised Fine-Tuning of Large Language Models
di: Riemer, Matthew, et al.
Pubblicazione: (2025)
di: Riemer, Matthew, et al.
Pubblicazione: (2025)
Convergence Analysis of Aggregation-Broadcast in LoRA-enabled Distributed Fine-Tuning
di: Chen, Xin, et al.
Pubblicazione: (2025)
di: Chen, Xin, et al.
Pubblicazione: (2025)
Understanding and Guiding Layer Placement in Parameter-Efficient Fine-Tuning of Large Language Models
di: Xu, Yichen, et al.
Pubblicazione: (2026)
di: Xu, Yichen, et al.
Pubblicazione: (2026)
MallowsPO: Fine-Tune Your LLM with Preference Dispersions
di: Chen, Haoxian, et al.
Pubblicazione: (2024)
di: Chen, Haoxian, et al.
Pubblicazione: (2024)
Resource-efficient Layer-wise Federated Self-supervised Learning
di: Tun, Ye Lin, et al.
Pubblicazione: (2024)
di: Tun, Ye Lin, et al.
Pubblicazione: (2024)
Stochastic Layer-wise Learning: Scalable and Efficient Alternative to Backpropagation
di: Yin, Bojian, et al.
Pubblicazione: (2025)
di: Yin, Bojian, et al.
Pubblicazione: (2025)
Parameter Efficient Quasi-Orthogonal Fine-Tuning via Givens Rotation
di: Ma, Xinyu, et al.
Pubblicazione: (2024)
di: Ma, Xinyu, et al.
Pubblicazione: (2024)
Alignment Dynamics in LLM Fine-Tuning
di: Huang, Yuhan, et al.
Pubblicazione: (2026)
di: Huang, Yuhan, et al.
Pubblicazione: (2026)
Ratio law: mathematical descriptions for a universal relationship between AI performance and input samples
di: Kang, Boming, et al.
Pubblicazione: (2024)
di: Kang, Boming, et al.
Pubblicazione: (2024)
LoCA: Location-Aware Cosine Adaptation for Parameter-Efficient Fine-Tuning
di: Du, Zhekai, et al.
Pubblicazione: (2025)
di: Du, Zhekai, et al.
Pubblicazione: (2025)
Large Language Models for Sequential Decision-Making: Improving In-Context Learning via Supervised Fine-Tuning
di: Zhang, Minmin, et al.
Pubblicazione: (2026)
di: Zhang, Minmin, et al.
Pubblicazione: (2026)
LAVa: Layer-wise KV Cache Eviction with Dynamic Budget Allocation
di: Shen, Yiqun, et al.
Pubblicazione: (2025)
di: Shen, Yiqun, et al.
Pubblicazione: (2025)
Information-Theoretic Greedy Layer-wise Training for Traffic Sign Recognition
di: Lyu, Shuyan, et al.
Pubblicazione: (2025)
di: Lyu, Shuyan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Beyond Frequency: The Role of Redundancy in Large Language Model Memorization
di: Zhang, Jie, et al.
Pubblicazione: (2025) -
Rotation-Preserving Supervised Fine-Tuning
di: Jin, Hangzhan, et al.
Pubblicazione: (2026) -
LEVI: Generalizable Fine-tuning via Layer-wise Ensemble of Different Views
di: Roh, Yuji, et al.
Pubblicazione: (2024) -
Stabilizing LLM Supervised Fine-Tuning via Explicit Distributional Control
di: Wang, Xinyu, et al.
Pubblicazione: (2026) -
Preserving Diversity in Supervised Fine-Tuning of Large Language Models
di: Li, Ziniu, et al.
Pubblicazione: (2024)