Understanding the Performance and Estimating the Cost of LLM Fine-Tuning
Fuente:
arXiv
Guardado en:
| Autores principales: | Xia, Yuchen, Kim, Jiho, Chen, Yuhan, Ye, Haojie, Kundu, Souvik, Hao, Cong, Talati, Nishil |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
LaMDA: Large Model Fine-Tuning via Spectrally Decomposed Low-Dimensional Adaptation
por: Azizi, Seyedarmin, et al.
Publicado: (2024)
por: Azizi, Seyedarmin, et al.
Publicado: (2024)
AFLoRA: Adaptive Freezing of Low Rank Adaptation in Parameter Efficient Fine-Tuning of Large Models
por: Liu, Zeyu, et al.
Publicado: (2024)
por: Liu, Zeyu, et al.
Publicado: (2024)
Sphinx: Efficiently Serving Novel View Synthesis using Regression-Guided Selective Refinement
por: Xia, Yuchen, et al.
Publicado: (2025)
por: Xia, Yuchen, et al.
Publicado: (2025)
Rethinking Parameter Sharing for LLM Fine-Tuning with Multiple LoRAs
por: Ban, Hao, et al.
Publicado: (2025)
por: Ban, Hao, et al.
Publicado: (2025)
EMORL: Ensemble Multi-Objective Reinforcement Learning for Efficient and Flexible LLM Fine-Tuning
por: Kong, Lingxiao, et al.
Publicado: (2025)
por: Kong, Lingxiao, et al.
Publicado: (2025)
Alignment Dynamics in LLM Fine-Tuning
por: Huang, Yuhan, et al.
Publicado: (2026)
por: Huang, Yuhan, et al.
Publicado: (2026)
GEAR: An Efficient KV Cache Compression Recipe for Near-Lossless Generative Inference of LLM
por: Kang, Hao, et al.
Publicado: (2024)
por: Kang, Hao, et al.
Publicado: (2024)
LLMem: Estimating GPU Memory Usage for Fine-Tuning Pre-Trained LLMs
por: Kim, Taeho, et al.
Publicado: (2024)
por: Kim, Taeho, et al.
Publicado: (2024)
Supervised Fine-Tuning as Inverse Reinforcement Learning
por: Sun, Hao
Publicado: (2024)
por: Sun, Hao
Publicado: (2024)
Sparse MeZO: Less Parameters for Better Performance in Zeroth-Order LLM Fine-Tuning
por: Liu, Yong, et al.
Publicado: (2024)
por: Liu, Yong, et al.
Publicado: (2024)
Supervised Fine-Tuning Needs to Unlock the Potential of Token Priority
por: Shen, Zhanming, et al.
Publicado: (2026)
por: Shen, Zhanming, et al.
Publicado: (2026)
MoE-Lens: Towards the Hardware Limit of High-Throughput MoE LLM Serving Under Resource Constraints
por: Yuan, Yichao, et al.
Publicado: (2025)
por: Yuan, Yichao, et al.
Publicado: (2025)
MSSR: Memory-Aware Adaptive Replay for Continual LLM Fine-Tuning
por: Lu, Yiyang, et al.
Publicado: (2026)
por: Lu, Yiyang, et al.
Publicado: (2026)
Understanding Forgetting in LLM Supervised Fine-Tuning and Preference Learning -- A Convex Optimization Perspective
por: Fernando, Heshan, et al.
Publicado: (2024)
por: Fernando, Heshan, et al.
Publicado: (2024)
Fine-Tune an SLM or Prompt an LLM? The Case of Generating Low-Code Workflows
por: Ayala, Orlando Marquez, et al.
Publicado: (2025)
por: Ayala, Orlando Marquez, et al.
Publicado: (2025)
Tuning LLM Judge Design Decisions for 1/1000 of the Cost
por: Salinas, David, et al.
Publicado: (2025)
por: Salinas, David, et al.
Publicado: (2025)
Towards Understanding Fine-Tuning Mechanisms of LLMs via Circuit Analysis
por: Wang, Xu, et al.
Publicado: (2025)
por: Wang, Xu, et al.
Publicado: (2025)
Selection of LLM Fine-Tuning Data based on Orthogonal Rules
por: Li, Xiaomin, et al.
Publicado: (2024)
por: Li, Xiaomin, et al.
Publicado: (2024)
Top-H Decoding: Adapting the Creativity and Coherence with Bounded Entropy in Text Generation
por: Potraghloo, Erfan Baghaei, et al.
Publicado: (2025)
por: Potraghloo, Erfan Baghaei, et al.
Publicado: (2025)
Etalon: Holistic Performance Evaluation Framework for LLM Inference Systems
por: Agrawal, Amey, et al.
Publicado: (2024)
por: Agrawal, Amey, et al.
Publicado: (2024)
Fine-Tuning Language Models with Reward Learning on Policy
por: Lang, Hao, et al.
Publicado: (2024)
por: Lang, Hao, et al.
Publicado: (2024)
Bridging the Gap: Enhancing LLM Performance for Low-Resource African Languages with New Benchmarks, Fine-Tuning, and Cultural Adjustments
por: Alhanai, Tuka, et al.
Publicado: (2024)
por: Alhanai, Tuka, et al.
Publicado: (2024)
ALKAFI-LLAMA3: Fine-Tuning LLMs for Precise Legal Understanding in Palestine
por: Qasem, Rabee, et al.
Publicado: (2024)
por: Qasem, Rabee, et al.
Publicado: (2024)
Filter-then-Weight: Online Data Selection and Reweighting for LLM Fine-Tuning
por: Wang, Fangxin, et al.
Publicado: (2026)
por: Wang, Fangxin, et al.
Publicado: (2026)
Stabilizing LLM Supervised Fine-Tuning via Explicit Distributional Control
por: Wang, Xinyu, et al.
Publicado: (2026)
por: Wang, Xinyu, et al.
Publicado: (2026)
One Token Away from Collapse: The Fragility of Instruction-Tuned Helpfulness
por: Potraghloo, Erfan Baghaei, et al.
Publicado: (2026)
por: Potraghloo, Erfan Baghaei, et al.
Publicado: (2026)
Neural Networks for Learnable and Scalable Influence Estimation of Instruction Fine-Tuning Data
por: Agarwal, Ishika, et al.
Publicado: (2025)
por: Agarwal, Ishika, et al.
Publicado: (2025)
CURLoRA: Stable LLM Continual Fine-Tuning and Catastrophic Forgetting Mitigation
por: Fawi, Muhammad
Publicado: (2024)
por: Fawi, Muhammad
Publicado: (2024)
Aligning Backchannel and Dialogue Context Representations via Contrastive LLM Fine-Tuning
por: Qian, Livia, et al.
Publicado: (2026)
por: Qian, Livia, et al.
Publicado: (2026)
Mitigating Training Imbalance in LLM Fine-Tuning via Selective Parameter Merging
por: Ju, Yiming, et al.
Publicado: (2024)
por: Ju, Yiming, et al.
Publicado: (2024)
LLM Maybe LongLM: Self-Extend LLM Context Window Without Tuning
por: Jin, Hongye, et al.
Publicado: (2024)
por: Jin, Hongye, et al.
Publicado: (2024)
AirLLM: Diffusion Policy-based Adaptive LoRA for Remote Fine-Tuning of LLM over the Air
por: Yang, Shiyi, et al.
Publicado: (2025)
por: Yang, Shiyi, et al.
Publicado: (2025)
LLMs Meet Finance: Fine-Tuning Foundation Models for the Open FinLLM Leaderboard
por: Rao, Varun, et al.
Publicado: (2025)
por: Rao, Varun, et al.
Publicado: (2025)
ShiftAddLLM: Accelerating Pretrained LLMs via Post-Training Multiplication-Less Reparameterization
por: You, Haoran, et al.
Publicado: (2024)
por: You, Haoran, et al.
Publicado: (2024)
Token Cleaning: Fine-Grained Data Selection for LLM Supervised Fine-Tuning
por: Pang, Jinlong, et al.
Publicado: (2025)
por: Pang, Jinlong, et al.
Publicado: (2025)
Parameter-Efficient Fine-Tuning with Discrete Fourier Transform
por: Gao, Ziqi, et al.
Publicado: (2024)
por: Gao, Ziqi, et al.
Publicado: (2024)
MoDM: Efficient Serving for Image Generation via Mixture-of-Diffusion Models
por: Xia, Yuchen, et al.
Publicado: (2025)
por: Xia, Yuchen, et al.
Publicado: (2025)
Understanding the planning of LLM agents: A survey
por: Huang, Xu, et al.
Publicado: (2024)
por: Huang, Xu, et al.
Publicado: (2024)
Proximal Supervised Fine-Tuning
por: Zhu, Wenhong, et al.
Publicado: (2025)
por: Zhu, Wenhong, et al.
Publicado: (2025)
Not All Adapters Matter: Selective Adapter Freezing for Memory-Efficient Fine-Tuning of Language Models
por: Son, Hyegang, et al.
Publicado: (2024)
por: Son, Hyegang, et al.
Publicado: (2024)
Ejemplares similares
-
LaMDA: Large Model Fine-Tuning via Spectrally Decomposed Low-Dimensional Adaptation
por: Azizi, Seyedarmin, et al.
Publicado: (2024) -
AFLoRA: Adaptive Freezing of Low Rank Adaptation in Parameter Efficient Fine-Tuning of Large Models
por: Liu, Zeyu, et al.
Publicado: (2024) -
Sphinx: Efficiently Serving Novel View Synthesis using Regression-Guided Selective Refinement
por: Xia, Yuchen, et al.
Publicado: (2025) -
Rethinking Parameter Sharing for LLM Fine-Tuning with Multiple LoRAs
por: Ban, Hao, et al.
Publicado: (2025) -
EMORL: Ensemble Multi-Objective Reinforcement Learning for Efficient and Flexible LLM Fine-Tuning
por: Kong, Lingxiao, et al.
Publicado: (2025)