A Mechanistic Investigation of Supervised Fine Tuning
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Chopra, Ruhaan |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Hecto: Modular Sparse Experts for Adaptive and Interpretable Reasoning
par: Pandey, Sanskar, et autres
Publié: (2025)
par: Pandey, Sanskar, et autres
Publié: (2025)
Beacon: Single-Turn Diagnosis and Mitigation of Latent Sycophancy in Large Language Models
par: Pandey, Sanskar, et autres
Publié: (2025)
par: Pandey, Sanskar, et autres
Publié: (2025)
On-Policy Supervised Fine-Tuning for Efficient Reasoning
par: Zhao, Anhao, et autres
Publié: (2026)
par: Zhao, Anhao, et autres
Publié: (2026)
Rotation-Preserving Supervised Fine-Tuning
par: Jin, Hangzhan, et autres
Publié: (2026)
par: Jin, Hangzhan, et autres
Publié: (2026)
Proximal Supervised Fine-Tuning
par: Zhu, Wenhong, et autres
Publié: (2025)
par: Zhu, Wenhong, et autres
Publié: (2025)
A Layer-wise Analysis of Supervised Fine-Tuning
par: Zhao, Qinghua, et autres
Publié: (2026)
par: Zhao, Qinghua, et autres
Publié: (2026)
Understanding Overadaptation in Supervised Fine-Tuning: The Role of Ensemble Methods
par: Hao, Yifan, et autres
Publié: (2025)
par: Hao, Yifan, et autres
Publié: (2025)
Data Mixing Optimization for Supervised Fine-Tuning of Large Language Models
par: Li, Yuan, et autres
Publié: (2025)
par: Li, Yuan, et autres
Publié: (2025)
Goal-Conditioned Supervised Learning for LLM Fine-Tuning
par: Li, Shijun, et autres
Publié: (2026)
par: Li, Shijun, et autres
Publié: (2026)
Token Cleaning: Fine-Grained Data Selection for LLM Supervised Fine-Tuning
par: Pang, Jinlong, et autres
Publié: (2025)
par: Pang, Jinlong, et autres
Publié: (2025)
Supervised Fine-Tuning as Inverse Reinforcement Learning
par: Sun, Hao
Publié: (2024)
par: Sun, Hao
Publié: (2024)
Teaching AI to Handle Exceptions: Supervised Fine-Tuning with Human-Aligned Judgment
par: DiSorbo, Matthew DosSantos, et autres
Publié: (2025)
par: DiSorbo, Matthew DosSantos, et autres
Publié: (2025)
Preserving Diversity in Supervised Fine-Tuning of Large Language Models
par: Li, Ziniu, et autres
Publié: (2024)
par: Li, Ziniu, et autres
Publié: (2024)
ASFT: Aligned Supervised Fine-Tuning through Absolute Likelihood
par: Wang, Ruoyu, et autres
Publié: (2024)
par: Wang, Ruoyu, et autres
Publié: (2024)
Directional Gradient Projection for Robust Fine-Tuning of Foundation Models
par: Huang, Chengyue, et autres
Publié: (2025)
par: Huang, Chengyue, et autres
Publié: (2025)
Beyond Perplexity: A Lightweight Benchmark for Knowledge Retention in Supervised Fine-Tuning
par: Shabgahi, Soheil Zibakhsh, et autres
Publié: (2026)
par: Shabgahi, Soheil Zibakhsh, et autres
Publié: (2026)
Blending Supervised and Reinforcement Fine-Tuning with Prefix Sampling
par: Huang, Zeyu, et autres
Publié: (2025)
par: Huang, Zeyu, et autres
Publié: (2025)
Supervised Fine-Tuning or In-Context Learning? Evaluating LLMs for Clinical NER
par: Baroian, Andrei
Publié: (2025)
par: Baroian, Andrei
Publié: (2025)
Supervised Fine Tuning on Curated Data is Reinforcement Learning (and can be improved)
par: Qin, Chongli, et autres
Publié: (2025)
par: Qin, Chongli, et autres
Publié: (2025)
Supervised Fine-Tuning Needs to Unlock the Potential of Token Priority
par: Shen, Zhanming, et autres
Publié: (2026)
par: Shen, Zhanming, et autres
Publié: (2026)
LIA: Supervised Fine-Tuning of Large Language Models for Automatic Issue Assignment
par: Khosravani, Arsham, et autres
Publié: (2026)
par: Khosravani, Arsham, et autres
Publié: (2026)
SFT-GO: Supervised Fine-Tuning with Group Optimization for Large Language Models
par: Kim, Gyuhak, et autres
Publié: (2025)
par: Kim, Gyuhak, et autres
Publié: (2025)
Improved Supervised Fine-Tuning for Large Language Models to Mitigate Catastrophic Forgetting
par: Ding, Fei, et autres
Publié: (2025)
par: Ding, Fei, et autres
Publié: (2025)
FRAMES-VQA: Benchmarking Fine-Tuning Robustness across Multi-Modal Shifts in Visual Question Answering
par: Huang, Chengyue, et autres
Publié: (2025)
par: Huang, Chengyue, et autres
Publié: (2025)
GeoLocSFT: Efficient Visual Geolocation via Supervised Fine-Tuning of Multimodal Foundation Models
par: Yi, Qiang, et autres
Publié: (2025)
par: Yi, Qiang, et autres
Publié: (2025)
Simulation as Supervision: Mechanistic Pretraining for Scientific Discovery
par: Dudley, Carson, et autres
Publié: (2025)
par: Dudley, Carson, et autres
Publié: (2025)
A Self-Supervised Reinforcement Learning Approach for Fine-Tuning Large Language Models Using Cross-Attention Signals
par: Kiruluta, Andrew, et autres
Publié: (2025)
par: Kiruluta, Andrew, et autres
Publié: (2025)
SRFT: A Single-Stage Method with Supervised and Reinforcement Fine-Tuning for Reasoning
par: Fu, Yuqian, et autres
Publié: (2025)
par: Fu, Yuqian, et autres
Publié: (2025)
Analyzing the Effects of Supervised Fine-Tuning on Model Knowledge from Token and Parameter Levels
par: Ye, Junjie, et autres
Publié: (2025)
par: Ye, Junjie, et autres
Publié: (2025)
The Effectiveness of Approximate Regularized Replay for Efficient Supervised Fine-Tuning of Large Language Models
par: Riemer, Matthew, et autres
Publié: (2025)
par: Riemer, Matthew, et autres
Publié: (2025)
Rethinking Supervised Fine-Tuning: Emphasizing Key Answer Tokens for Improved LLM Accuracy
par: Shi, Xiaofeng, et autres
Publié: (2025)
par: Shi, Xiaofeng, et autres
Publié: (2025)
Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs
par: Lu, Yuxiao, et autres
Publié: (2024)
par: Lu, Yuxiao, et autres
Publié: (2024)
Mechanistic Interpretability of Fine-Tuned Vision Transformers on Distorted Images: Decoding Attention Head Behavior for Transparent and Trustworthy AI
par: Bahador, Nooshin
Publié: (2025)
par: Bahador, Nooshin
Publié: (2025)
Stabilizing LLM Supervised Fine-Tuning via Explicit Distributional Control
par: Wang, Xinyu, et autres
Publié: (2026)
par: Wang, Xinyu, et autres
Publié: (2026)
Fine-Tuning LLMs for Report Summarization: Analysis on Supervised and Unsupervised Data
par: Rallapalli, Swati, et autres
Publié: (2025)
par: Rallapalli, Swati, et autres
Publié: (2025)
IA2: Alignment with ICL Activations Improves Supervised Fine-Tuning
par: Mishra, Aayush, et autres
Publié: (2025)
par: Mishra, Aayush, et autres
Publié: (2025)
RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models
par: Wei, Quan, et autres
Publié: (2025)
par: Wei, Quan, et autres
Publié: (2025)
GraphGen: Enhancing Supervised Fine-Tuning for LLMs with Knowledge-Driven Synthetic Data Generation
par: Chen, Zihong, et autres
Publié: (2025)
par: Chen, Zihong, et autres
Publié: (2025)
Mechanistic Fine-tuning for In-context Learning
par: Cho, Hakaze, et autres
Publié: (2025)
par: Cho, Hakaze, et autres
Publié: (2025)
Beyond Generation: Unlocking Universal Editing via Self-Supervised Fine-Tuning
par: Chen, Harold Haodong, et autres
Publié: (2024)
par: Chen, Harold Haodong, et autres
Publié: (2024)
Documents similaires
-
Hecto: Modular Sparse Experts for Adaptive and Interpretable Reasoning
par: Pandey, Sanskar, et autres
Publié: (2025) -
Beacon: Single-Turn Diagnosis and Mitigation of Latent Sycophancy in Large Language Models
par: Pandey, Sanskar, et autres
Publié: (2025) -
On-Policy Supervised Fine-Tuning for Efficient Reasoning
par: Zhao, Anhao, et autres
Publié: (2026) -
Rotation-Preserving Supervised Fine-Tuning
par: Jin, Hangzhan, et autres
Publié: (2026) -
Proximal Supervised Fine-Tuning
par: Zhu, Wenhong, et autres
Publié: (2025)