A Study of Optimizations for Fine-tuning Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Singh, Arjun, Pandey, Nikhil, Shirgaonkar, Anup, Manoj, Pavan, Aski, Vijay |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Knowledge Distillation Using Frontier Open-source LLMs: Generalizability and the Role of Synthetic Data
di: Shirgaonkar, Anup, et al.
Pubblicazione: (2024)
di: Shirgaonkar, Anup, et al.
Pubblicazione: (2024)
Information Guided Regularization for Fine-tuning Language Models
di: Sharma, Mandar, et al.
Pubblicazione: (2024)
di: Sharma, Mandar, et al.
Pubblicazione: (2024)
RAG vs Fine-tuning: Pipelines, Tradeoffs, and a Case Study on Agriculture
di: Balaguer, Angels, et al.
Pubblicazione: (2024)
di: Balaguer, Angels, et al.
Pubblicazione: (2024)
Private Fine-tuning of Large Language Models with Zeroth-order Optimization
di: Tang, Xinyu, et al.
Pubblicazione: (2024)
di: Tang, Xinyu, et al.
Pubblicazione: (2024)
Fine-tuning Large Language Model for Automated Algorithm Design
di: Liu, Fei, et al.
Pubblicazione: (2025)
di: Liu, Fei, et al.
Pubblicazione: (2025)
Forgetting: A New Mechanism Towards Better Large Language Model Fine-tuning
di: Taheri, Ali, et al.
Pubblicazione: (2025)
di: Taheri, Ali, et al.
Pubblicazione: (2025)
A Survey on Federated Fine-tuning of Large Language Models
di: Wu, Yebo, et al.
Pubblicazione: (2025)
di: Wu, Yebo, et al.
Pubblicazione: (2025)
An Improved Deep Learning Model for Word Embeddings Based Clustering for Large Text Datasets
di: Sutrakar, Vijay Kumar, et al.
Pubblicazione: (2025)
di: Sutrakar, Vijay Kumar, et al.
Pubblicazione: (2025)
Fine-tuning Large Language Models for Domain-specific Machine Translation
di: Zheng, Jiawei, et al.
Pubblicazione: (2024)
di: Zheng, Jiawei, et al.
Pubblicazione: (2024)
Navigating the Designs of Privacy-Preserving Fine-tuning for Large Language Models
di: Shi, Haonan, et al.
Pubblicazione: (2025)
di: Shi, Haonan, et al.
Pubblicazione: (2025)
Fine-tuning of Large Language Models for Domain-Specific Cybersecurity Knowledge
di: Huang, Yuan
Pubblicazione: (2025)
di: Huang, Yuan
Pubblicazione: (2025)
Efficient Model Development through Fine-tuning Transfer
di: Lin, Pin-Jie, et al.
Pubblicazione: (2025)
di: Lin, Pin-Jie, et al.
Pubblicazione: (2025)
EDCO: Dynamic Curriculum Orchestration for Domain-specific Large Language Model Fine-tuning
di: Pang, Jing-Cheng, et al.
Pubblicazione: (2026)
di: Pang, Jing-Cheng, et al.
Pubblicazione: (2026)
LLASP: Fine-tuning Large Language Models for Answer Set Programming
di: Coppolillo, Erica, et al.
Pubblicazione: (2024)
di: Coppolillo, Erica, et al.
Pubblicazione: (2024)
Lisa: Lazy Safety Alignment for Large Language Models against Harmful Fine-tuning Attack
di: Huang, Tiansheng, et al.
Pubblicazione: (2024)
di: Huang, Tiansheng, et al.
Pubblicazione: (2024)
Adapting Large Language Models for Content Moderation: Pitfalls in Data Engineering and Supervised Fine-tuning
di: Ma, Huan, et al.
Pubblicazione: (2023)
di: Ma, Huan, et al.
Pubblicazione: (2023)
A Study of Backdoors in Instruction Fine-tuned Language Models
di: Raghuram, Jayaram, et al.
Pubblicazione: (2024)
di: Raghuram, Jayaram, et al.
Pubblicazione: (2024)
Fine-tuning vs. In-context Learning in Large Language Models: A Formal Language Learning Perspective
di: Ghosh, Bishwamittra, et al.
Pubblicazione: (2026)
di: Ghosh, Bishwamittra, et al.
Pubblicazione: (2026)
Harmful Fine-tuning Attacks and Defenses for Large Language Models: A Survey
di: Huang, Tiansheng, et al.
Pubblicazione: (2024)
di: Huang, Tiansheng, et al.
Pubblicazione: (2024)
End-to-End triplet loss based fine-tuning for network embedding in effective PII detection
di: Kohli, Rishika, et al.
Pubblicazione: (2025)
di: Kohli, Rishika, et al.
Pubblicazione: (2025)
Sparse is Enough in Fine-tuning Pre-trained Large Language Models
di: Song, Weixi, et al.
Pubblicazione: (2023)
di: Song, Weixi, et al.
Pubblicazione: (2023)
Efficiently Estimating Data Efficiency for Language Model Fine-tuning
di: Je, Gyung Hyun, et al.
Pubblicazione: (2025)
di: Je, Gyung Hyun, et al.
Pubblicazione: (2025)
Depth-Aware Initialization for Stable and Efficient Neural Network Training
di: Pandey, Vijay
Pubblicazione: (2025)
di: Pandey, Vijay
Pubblicazione: (2025)
SFT-GO: Supervised Fine-Tuning with Group Optimization for Large Language Models
di: Kim, Gyuhak, et al.
Pubblicazione: (2025)
di: Kim, Gyuhak, et al.
Pubblicazione: (2025)
Towards Green AI in Fine-tuning Large Language Models via Adaptive Backpropagation
di: Huang, Kai, et al.
Pubblicazione: (2023)
di: Huang, Kai, et al.
Pubblicazione: (2023)
Empirical Analysis of Efficient Fine-Tuning Methods for Large Pre-Trained Language Models
di: Doering, Nigel, et al.
Pubblicazione: (2024)
di: Doering, Nigel, et al.
Pubblicazione: (2024)
Fine-tuning Large Language Models for Entity Matching
di: Steiner, Aaron, et al.
Pubblicazione: (2024)
di: Steiner, Aaron, et al.
Pubblicazione: (2024)
Fine-tuning Large Language Models with Limited Data: A Survey and Practical Guide
di: Szep, Marton, et al.
Pubblicazione: (2024)
di: Szep, Marton, et al.
Pubblicazione: (2024)
What Makes and Breaks Safety Fine-tuning? A Mechanistic Study
di: Jain, Samyak, et al.
Pubblicazione: (2024)
di: Jain, Samyak, et al.
Pubblicazione: (2024)
Privately Learning from Graphs with Applications in Fine-tuning Large Language Models
di: Yin, Haoteng, et al.
Pubblicazione: (2024)
di: Yin, Haoteng, et al.
Pubblicazione: (2024)
Selecting Large Language Model to Fine-tune via Rectified Scaling Law
di: Lin, Haowei, et al.
Pubblicazione: (2024)
di: Lin, Haowei, et al.
Pubblicazione: (2024)
InstructAV: Instruction Fine-tuning Large Language Models for Authorship Verification
di: Hu, Yujia, et al.
Pubblicazione: (2024)
di: Hu, Yujia, et al.
Pubblicazione: (2024)
Fundamental Safety-Capability Trade-offs in Fine-tuning Large Language Models
di: Chen, Pin-Yu, et al.
Pubblicazione: (2025)
di: Chen, Pin-Yu, et al.
Pubblicazione: (2025)
Personalized Preference Fine-tuning of Diffusion Models
di: Dang, Meihua, et al.
Pubblicazione: (2025)
di: Dang, Meihua, et al.
Pubblicazione: (2025)
Exploring Memorization in Fine-tuned Language Models
di: Zeng, Shenglai, et al.
Pubblicazione: (2023)
di: Zeng, Shenglai, et al.
Pubblicazione: (2023)
A Fine-tuning Dataset and Benchmark for Large Language Models for Protein Understanding
di: Shen, Yiqing, et al.
Pubblicazione: (2024)
di: Shen, Yiqing, et al.
Pubblicazione: (2024)
Safe LoRA: the Silver Lining of Reducing Safety Risks when Fine-tuning Large Language Models
di: Hsu, Chia-Yi, et al.
Pubblicazione: (2024)
di: Hsu, Chia-Yi, et al.
Pubblicazione: (2024)
The Impact of Fine-tuning Large Language Models on Automated Program Repair
di: Macháček, Roman, et al.
Pubblicazione: (2025)
di: Macháček, Roman, et al.
Pubblicazione: (2025)
Financial Fine-tuning a Large Time Series Model
di: Fu, Xinghong, et al.
Pubblicazione: (2024)
di: Fu, Xinghong, et al.
Pubblicazione: (2024)
EpilepsyLLM: Domain-Specific Large Language Model Fine-tuned with Epilepsy Medical Knowledge
di: Zhao, Xuyang, et al.
Pubblicazione: (2024)
di: Zhao, Xuyang, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Knowledge Distillation Using Frontier Open-source LLMs: Generalizability and the Role of Synthetic Data
di: Shirgaonkar, Anup, et al.
Pubblicazione: (2024) -
Information Guided Regularization for Fine-tuning Language Models
di: Sharma, Mandar, et al.
Pubblicazione: (2024) -
RAG vs Fine-tuning: Pipelines, Tradeoffs, and a Case Study on Agriculture
di: Balaguer, Angels, et al.
Pubblicazione: (2024) -
Private Fine-tuning of Large Language Models with Zeroth-order Optimization
di: Tang, Xinyu, et al.
Pubblicazione: (2024) -
Fine-tuning Large Language Model for Automated Algorithm Design
di: Liu, Fei, et al.
Pubblicazione: (2025)