SFT-GO: Supervised Fine-Tuning with Group Optimization for Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Kim, Gyuhak, Thakur, Sumiran Singh, Park, Su Min, Wei, Wei, Bao, Yujia |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Q-SFT: Q-Learning for Language Models via Supervised Fine-Tuning
por: Hong, Joey, et al.
Publicado: (2024)
por: Hong, Joey, et al.
Publicado: (2024)
RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models
por: Wei, Quan, et al.
Publicado: (2025)
por: Wei, Quan, et al.
Publicado: (2025)
From Weak Cues to Real Identities: Evaluating Inference-Driven De-Anonymization in LLM Agents
por: Ko, Myeongseob, et al.
Publicado: (2026)
por: Ko, Myeongseob, et al.
Publicado: (2026)
RL Fine-Tuning Heals OOD Forgetting in SFT
por: Jin, Hangzhan, et al.
Publicado: (2025)
por: Jin, Hangzhan, et al.
Publicado: (2025)
Preserving Diversity in Supervised Fine-Tuning of Large Language Models
por: Li, Ziniu, et al.
Publicado: (2024)
por: Li, Ziniu, et al.
Publicado: (2024)
Harnessing Business and Media Insights with Large Language Models
por: Bao, Yujia, et al.
Publicado: (2024)
por: Bao, Yujia, et al.
Publicado: (2024)
InstructAV: Instruction Fine-tuning Large Language Models for Authorship Verification
por: Hu, Yujia, et al.
Publicado: (2024)
por: Hu, Yujia, et al.
Publicado: (2024)
The Effectiveness of Approximate Regularized Replay for Efficient Supervised Fine-Tuning of Large Language Models
por: Riemer, Matthew, et al.
Publicado: (2025)
por: Riemer, Matthew, et al.
Publicado: (2025)
Linear Chain Transformation: Expanding Optimization Dynamics for Fine-Tuning Large Language Models
por: Wang, Yulong, et al.
Publicado: (2024)
por: Wang, Yulong, et al.
Publicado: (2024)
Aligning Large Language Model Agents with Rational and Moral Preferences: A Supervised Fine-Tuning Approach
por: Lu, Wei, et al.
Publicado: (2025)
por: Lu, Wei, et al.
Publicado: (2025)
Large Language Models for Sequential Decision-Making: Improving In-Context Learning via Supervised Fine-Tuning
por: Zhang, Minmin, et al.
Publicado: (2026)
por: Zhang, Minmin, et al.
Publicado: (2026)
DynamixSFT: Dynamic Mixture Optimization of Instruction Tuning Collections
por: Shin, Haebin, et al.
Publicado: (2025)
por: Shin, Haebin, et al.
Publicado: (2025)
Linearization Explains Fine-Tuning in Large Language Models
por: Afzal, Zahra Rahimi, et al.
Publicado: (2026)
por: Afzal, Zahra Rahimi, et al.
Publicado: (2026)
Adaptive Defense against Harmful Fine-Tuning for Large Language Models via Bayesian Data Scheduler
por: Hu, Zixuan, et al.
Publicado: (2025)
por: Hu, Zixuan, et al.
Publicado: (2025)
Aligning Large Language Models via Fine-grained Supervision
por: Xu, Dehong, et al.
Publicado: (2024)
por: Xu, Dehong, et al.
Publicado: (2024)
On the Entropy Dynamics in Reinforcement Fine-Tuning of Large Language Models
por: Wang, Shumin, et al.
Publicado: (2026)
por: Wang, Shumin, et al.
Publicado: (2026)
Restoring Calibration for Aligned Large Language Models: A Calibration-Aware Fine-Tuning Approach
por: Xiao, Jiancong, et al.
Publicado: (2025)
por: Xiao, Jiancong, et al.
Publicado: (2025)
Rotation-Preserving Supervised Fine-Tuning
por: Jin, Hangzhan, et al.
Publicado: (2026)
por: Jin, Hangzhan, et al.
Publicado: (2026)
GVPO: Group Variance Policy Optimization for Large Language Model Post-Training
por: Zhang, Kaichen, et al.
Publicado: (2025)
por: Zhang, Kaichen, et al.
Publicado: (2025)
MaZO: Masked Zeroth-Order Optimization for Multi-Task Fine-Tuning of Large Language Models
por: Zhang, Zhen, et al.
Publicado: (2025)
por: Zhang, Zhen, et al.
Publicado: (2025)
RPO:Reinforcement Fine-Tuning with Partial Reasoning Optimization
por: Yi, Hongzhu, et al.
Publicado: (2026)
por: Yi, Hongzhu, et al.
Publicado: (2026)
Unlock the Correlation between Supervised Fine-Tuning and Reinforcement Learning in Training Code Large Language Models
por: Chen, Jie, et al.
Publicado: (2024)
por: Chen, Jie, et al.
Publicado: (2024)
FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed
por: Dang, Sizhe, et al.
Publicado: (2025)
por: Dang, Sizhe, et al.
Publicado: (2025)
QuZO: Quantized Zeroth-Order Fine-Tuning for Large Language Models
por: Zhou, Jiajun, et al.
Publicado: (2025)
por: Zhou, Jiajun, et al.
Publicado: (2025)
Automated Federated Pipeline for Parameter-Efficient Fine-Tuning of Large Language Models
por: Fang, Zihan, et al.
Publicado: (2024)
por: Fang, Zihan, et al.
Publicado: (2024)
Reinforcement Learning Fine-Tunes a Sparse Subnetwork in Large Language Models
por: Balashov, Andrii
Publicado: (2025)
por: Balashov, Andrii
Publicado: (2025)
Boosting Large Language Models with Mask Fine-Tuning
por: Zhang, Mingyuan, et al.
Publicado: (2025)
por: Zhang, Mingyuan, et al.
Publicado: (2025)
Scaling Sparse Fine-Tuning to Large Language Models
por: Ansell, Alan, et al.
Publicado: (2024)
por: Ansell, Alan, et al.
Publicado: (2024)
Proximal Supervised Fine-Tuning
por: Zhu, Wenhong, et al.
Publicado: (2025)
por: Zhu, Wenhong, et al.
Publicado: (2025)
How Abilities in Large Language Models are Affected by Supervised Fine-tuning Data Composition
por: Dong, Guanting, et al.
Publicado: (2023)
por: Dong, Guanting, et al.
Publicado: (2023)
Optimizing Prompts for Large Language Models: A Causal Approach
por: Chen, Wei, et al.
Publicado: (2026)
por: Chen, Wei, et al.
Publicado: (2026)
A Layer-wise Analysis of Supervised Fine-Tuning
por: Zhao, Qinghua, et al.
Publicado: (2026)
por: Zhao, Qinghua, et al.
Publicado: (2026)
Goal-Conditioned Supervised Learning for LLM Fine-Tuning
por: Li, Shijun, et al.
Publicado: (2026)
por: Li, Shijun, et al.
Publicado: (2026)
A Bayesian Hybrid Parameter-Efficient Fine-Tuning Method for Large Language Models
por: Chai, Yidong, et al.
Publicado: (2025)
por: Chai, Yidong, et al.
Publicado: (2025)
FedKRSO: Communication and Memory Efficient Federated Fine-Tuning of Large Language Models
por: Yang, Guohao, et al.
Publicado: (2026)
por: Yang, Guohao, et al.
Publicado: (2026)
Sparsity-Aware Low-Rank Representation for Efficient Fine-Tuning of Large Language Models
por: Zhang, Longteng, et al.
Publicado: (2026)
por: Zhang, Longteng, et al.
Publicado: (2026)
Robust Reinforcement Learning from Human Feedback for Large Language Models Fine-Tuning
por: Ye, Kai, et al.
Publicado: (2025)
por: Ye, Kai, et al.
Publicado: (2025)
Understanding and Guiding Layer Placement in Parameter-Efficient Fine-Tuning of Large Language Models
por: Xu, Yichen, et al.
Publicado: (2026)
por: Xu, Yichen, et al.
Publicado: (2026)
IRIS: Interpolative Rényi Iterative Self-play for Large Language Model Fine-Tuning
por: Liao, Wenjie, et al.
Publicado: (2026)
por: Liao, Wenjie, et al.
Publicado: (2026)
Personas within Parameters: Fine-Tuning Small Language Models with Low-Rank Adapters to Mimic User Behaviors
por: Thakur, Himanshu, et al.
Publicado: (2025)
por: Thakur, Himanshu, et al.
Publicado: (2025)
Ejemplares similares
-
Q-SFT: Q-Learning for Language Models via Supervised Fine-Tuning
por: Hong, Joey, et al.
Publicado: (2024) -
RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models
por: Wei, Quan, et al.
Publicado: (2025) -
From Weak Cues to Real Identities: Evaluating Inference-Driven De-Anonymization in LLM Agents
por: Ko, Myeongseob, et al.
Publicado: (2026) -
RL Fine-Tuning Heals OOD Forgetting in SFT
por: Jin, Hangzhan, et al.
Publicado: (2025) -
Preserving Diversity in Supervised Fine-Tuning of Large Language Models
por: Li, Ziniu, et al.
Publicado: (2024)