A Study of Optimizations for Fine-tuning Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Singh, Arjun, Pandey, Nikhil, Shirgaonkar, Anup, Manoj, Pavan, Aski, Vijay |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Knowledge Distillation Using Frontier Open-source LLMs: Generalizability and the Role of Synthetic Data
par: Shirgaonkar, Anup, et autres
Publié: (2024)
par: Shirgaonkar, Anup, et autres
Publié: (2024)
Information Guided Regularization for Fine-tuning Language Models
par: Sharma, Mandar, et autres
Publié: (2024)
par: Sharma, Mandar, et autres
Publié: (2024)
RAG vs Fine-tuning: Pipelines, Tradeoffs, and a Case Study on Agriculture
par: Balaguer, Angels, et autres
Publié: (2024)
par: Balaguer, Angels, et autres
Publié: (2024)
Private Fine-tuning of Large Language Models with Zeroth-order Optimization
par: Tang, Xinyu, et autres
Publié: (2024)
par: Tang, Xinyu, et autres
Publié: (2024)
Fine-tuning Large Language Model for Automated Algorithm Design
par: Liu, Fei, et autres
Publié: (2025)
par: Liu, Fei, et autres
Publié: (2025)
Forgetting: A New Mechanism Towards Better Large Language Model Fine-tuning
par: Taheri, Ali, et autres
Publié: (2025)
par: Taheri, Ali, et autres
Publié: (2025)
A Survey on Federated Fine-tuning of Large Language Models
par: Wu, Yebo, et autres
Publié: (2025)
par: Wu, Yebo, et autres
Publié: (2025)
An Improved Deep Learning Model for Word Embeddings Based Clustering for Large Text Datasets
par: Sutrakar, Vijay Kumar, et autres
Publié: (2025)
par: Sutrakar, Vijay Kumar, et autres
Publié: (2025)
Fine-tuning Large Language Models for Domain-specific Machine Translation
par: Zheng, Jiawei, et autres
Publié: (2024)
par: Zheng, Jiawei, et autres
Publié: (2024)
Navigating the Designs of Privacy-Preserving Fine-tuning for Large Language Models
par: Shi, Haonan, et autres
Publié: (2025)
par: Shi, Haonan, et autres
Publié: (2025)
Fine-tuning of Large Language Models for Domain-Specific Cybersecurity Knowledge
par: Huang, Yuan
Publié: (2025)
par: Huang, Yuan
Publié: (2025)
Efficient Model Development through Fine-tuning Transfer
par: Lin, Pin-Jie, et autres
Publié: (2025)
par: Lin, Pin-Jie, et autres
Publié: (2025)
EDCO: Dynamic Curriculum Orchestration for Domain-specific Large Language Model Fine-tuning
par: Pang, Jing-Cheng, et autres
Publié: (2026)
par: Pang, Jing-Cheng, et autres
Publié: (2026)
LLASP: Fine-tuning Large Language Models for Answer Set Programming
par: Coppolillo, Erica, et autres
Publié: (2024)
par: Coppolillo, Erica, et autres
Publié: (2024)
Lisa: Lazy Safety Alignment for Large Language Models against Harmful Fine-tuning Attack
par: Huang, Tiansheng, et autres
Publié: (2024)
par: Huang, Tiansheng, et autres
Publié: (2024)
Adapting Large Language Models for Content Moderation: Pitfalls in Data Engineering and Supervised Fine-tuning
par: Ma, Huan, et autres
Publié: (2023)
par: Ma, Huan, et autres
Publié: (2023)
A Study of Backdoors in Instruction Fine-tuned Language Models
par: Raghuram, Jayaram, et autres
Publié: (2024)
par: Raghuram, Jayaram, et autres
Publié: (2024)
Fine-tuning vs. In-context Learning in Large Language Models: A Formal Language Learning Perspective
par: Ghosh, Bishwamittra, et autres
Publié: (2026)
par: Ghosh, Bishwamittra, et autres
Publié: (2026)
Harmful Fine-tuning Attacks and Defenses for Large Language Models: A Survey
par: Huang, Tiansheng, et autres
Publié: (2024)
par: Huang, Tiansheng, et autres
Publié: (2024)
End-to-End triplet loss based fine-tuning for network embedding in effective PII detection
par: Kohli, Rishika, et autres
Publié: (2025)
par: Kohli, Rishika, et autres
Publié: (2025)
Sparse is Enough in Fine-tuning Pre-trained Large Language Models
par: Song, Weixi, et autres
Publié: (2023)
par: Song, Weixi, et autres
Publié: (2023)
Efficiently Estimating Data Efficiency for Language Model Fine-tuning
par: Je, Gyung Hyun, et autres
Publié: (2025)
par: Je, Gyung Hyun, et autres
Publié: (2025)
Depth-Aware Initialization for Stable and Efficient Neural Network Training
par: Pandey, Vijay
Publié: (2025)
par: Pandey, Vijay
Publié: (2025)
SFT-GO: Supervised Fine-Tuning with Group Optimization for Large Language Models
par: Kim, Gyuhak, et autres
Publié: (2025)
par: Kim, Gyuhak, et autres
Publié: (2025)
Towards Green AI in Fine-tuning Large Language Models via Adaptive Backpropagation
par: Huang, Kai, et autres
Publié: (2023)
par: Huang, Kai, et autres
Publié: (2023)
Empirical Analysis of Efficient Fine-Tuning Methods for Large Pre-Trained Language Models
par: Doering, Nigel, et autres
Publié: (2024)
par: Doering, Nigel, et autres
Publié: (2024)
Fine-tuning Large Language Models for Entity Matching
par: Steiner, Aaron, et autres
Publié: (2024)
par: Steiner, Aaron, et autres
Publié: (2024)
Fine-tuning Large Language Models with Limited Data: A Survey and Practical Guide
par: Szep, Marton, et autres
Publié: (2024)
par: Szep, Marton, et autres
Publié: (2024)
What Makes and Breaks Safety Fine-tuning? A Mechanistic Study
par: Jain, Samyak, et autres
Publié: (2024)
par: Jain, Samyak, et autres
Publié: (2024)
Privately Learning from Graphs with Applications in Fine-tuning Large Language Models
par: Yin, Haoteng, et autres
Publié: (2024)
par: Yin, Haoteng, et autres
Publié: (2024)
Selecting Large Language Model to Fine-tune via Rectified Scaling Law
par: Lin, Haowei, et autres
Publié: (2024)
par: Lin, Haowei, et autres
Publié: (2024)
InstructAV: Instruction Fine-tuning Large Language Models for Authorship Verification
par: Hu, Yujia, et autres
Publié: (2024)
par: Hu, Yujia, et autres
Publié: (2024)
Fundamental Safety-Capability Trade-offs in Fine-tuning Large Language Models
par: Chen, Pin-Yu, et autres
Publié: (2025)
par: Chen, Pin-Yu, et autres
Publié: (2025)
Personalized Preference Fine-tuning of Diffusion Models
par: Dang, Meihua, et autres
Publié: (2025)
par: Dang, Meihua, et autres
Publié: (2025)
Exploring Memorization in Fine-tuned Language Models
par: Zeng, Shenglai, et autres
Publié: (2023)
par: Zeng, Shenglai, et autres
Publié: (2023)
A Fine-tuning Dataset and Benchmark for Large Language Models for Protein Understanding
par: Shen, Yiqing, et autres
Publié: (2024)
par: Shen, Yiqing, et autres
Publié: (2024)
Safe LoRA: the Silver Lining of Reducing Safety Risks when Fine-tuning Large Language Models
par: Hsu, Chia-Yi, et autres
Publié: (2024)
par: Hsu, Chia-Yi, et autres
Publié: (2024)
The Impact of Fine-tuning Large Language Models on Automated Program Repair
par: Macháček, Roman, et autres
Publié: (2025)
par: Macháček, Roman, et autres
Publié: (2025)
Financial Fine-tuning a Large Time Series Model
par: Fu, Xinghong, et autres
Publié: (2024)
par: Fu, Xinghong, et autres
Publié: (2024)
EpilepsyLLM: Domain-Specific Large Language Model Fine-tuned with Epilepsy Medical Knowledge
par: Zhao, Xuyang, et autres
Publié: (2024)
par: Zhao, Xuyang, et autres
Publié: (2024)
Documents similaires
-
Knowledge Distillation Using Frontier Open-source LLMs: Generalizability and the Role of Synthetic Data
par: Shirgaonkar, Anup, et autres
Publié: (2024) -
Information Guided Regularization for Fine-tuning Language Models
par: Sharma, Mandar, et autres
Publié: (2024) -
RAG vs Fine-tuning: Pipelines, Tradeoffs, and a Case Study on Agriculture
par: Balaguer, Angels, et autres
Publié: (2024) -
Private Fine-tuning of Large Language Models with Zeroth-order Optimization
par: Tang, Xinyu, et autres
Publié: (2024) -
Fine-tuning Large Language Model for Automated Algorithm Design
par: Liu, Fei, et autres
Publié: (2025)