HFT: Half Fine-Tuning for Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Hui, Tingfeng, Zhang, Zhenyu, Wang, Shuohuan, Xu, Weiran, Sun, Yu, Wu, Hua |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Upcycling Instruction Tuning from Dense to Mixture-of-Experts via Parameter Merging
di: Hui, Tingfeng, et al.
Pubblicazione: (2024)
di: Hui, Tingfeng, et al.
Pubblicazione: (2024)
Advantageous Parameter Expansion Training Makes Better Large Language Models
di: Gu, Naibin, et al.
Pubblicazione: (2025)
di: Gu, Naibin, et al.
Pubblicazione: (2025)
Phased Instruction Fine-Tuning for Large Language Models
di: Pang, Wei, et al.
Pubblicazione: (2024)
di: Pang, Wei, et al.
Pubblicazione: (2024)
Tool-Augmented Reward Modeling
di: Li, Lei, et al.
Pubblicazione: (2023)
di: Li, Lei, et al.
Pubblicazione: (2023)
Curiosity-Driven Reinforcement Learning from Human Feedback
di: Sun, Haoran, et al.
Pubblicazione: (2025)
di: Sun, Haoran, et al.
Pubblicazione: (2025)
MA-RLHF: Reinforcement Learning from Human Feedback with Macro Actions
di: Chai, Yekun, et al.
Pubblicazione: (2024)
di: Chai, Yekun, et al.
Pubblicazione: (2024)
On Training Data Influence of GPT Models
di: Chai, Yekun, et al.
Pubblicazione: (2024)
di: Chai, Yekun, et al.
Pubblicazione: (2024)
Smaller Language Models Are Better Instruction Evolvers
di: Hui, Tingfeng, et al.
Pubblicazione: (2024)
di: Hui, Tingfeng, et al.
Pubblicazione: (2024)
NACL: A General and Effective KV Cache Eviction Framework for LLMs at Inference Time
di: Chen, Yilong, et al.
Pubblicazione: (2024)
di: Chen, Yilong, et al.
Pubblicazione: (2024)
Unveiling the Generalization Power of Fine-Tuned Large Language Models
di: Yang, Haoran, et al.
Pubblicazione: (2024)
di: Yang, Haoran, et al.
Pubblicazione: (2024)
HBO: Hierarchical Balancing Optimization for Fine-Tuning Large Language Models
di: Wang, Weixuan, et al.
Pubblicazione: (2025)
di: Wang, Weixuan, et al.
Pubblicazione: (2025)
BeamLoRA: Beam-Constraint Low-Rank Adaptation
di: Gu, Naibin, et al.
Pubblicazione: (2025)
di: Gu, Naibin, et al.
Pubblicazione: (2025)
Healing Powers of BERT: How Task-Specific Fine-Tuning Recovers Corrupted Language Models
di: Han, Shijie, et al.
Pubblicazione: (2024)
di: Han, Shijie, et al.
Pubblicazione: (2024)
Inner Thinking Transformer: Leveraging Dynamic Depth Scaling to Foster Adaptive Internal Thinking
di: Chen, Yilong, et al.
Pubblicazione: (2025)
di: Chen, Yilong, et al.
Pubblicazione: (2025)
Leveraging Conditional Mutual Information to Improve Large Language Model Fine-Tuning For Classification
di: Sivakaran, Thanushon, et al.
Pubblicazione: (2025)
di: Sivakaran, Thanushon, et al.
Pubblicazione: (2025)
Efficient Fine-Tuning of Large Language Models for Automated Medical Documentation
di: Leong, Hui Yi, et al.
Pubblicazione: (2024)
di: Leong, Hui Yi, et al.
Pubblicazione: (2024)
Autoregressive Pre-Training on Pixels and Texts
di: Chai, Yekun, et al.
Pubblicazione: (2024)
di: Chai, Yekun, et al.
Pubblicazione: (2024)
Enhancing Safety of Large Language Models via Embedding Space Separation
di: Zhao, Xu, et al.
Pubblicazione: (2026)
di: Zhao, Xu, et al.
Pubblicazione: (2026)
MeTA-LoRA: Data-Efficient Multi-Task Fine-Tuning for Large Language Models
di: Cheng, Bo, et al.
Pubblicazione: (2025)
di: Cheng, Bo, et al.
Pubblicazione: (2025)
Noise-BERT: A Unified Perturbation-Robust Framework with Noise Alignment Pre-training for Noisy Slot Filling Task
di: Zhao, Jinxu, et al.
Pubblicazione: (2024)
di: Zhao, Jinxu, et al.
Pubblicazione: (2024)
Boosting Large Language Models with Mask Fine-Tuning
di: Zhang, Mingyuan, et al.
Pubblicazione: (2025)
di: Zhang, Mingyuan, et al.
Pubblicazione: (2025)
Dynamics of Instruction Fine-Tuning for Chinese Large Language Models
di: Song, Chiyu, et al.
Pubblicazione: (2023)
di: Song, Chiyu, et al.
Pubblicazione: (2023)
Knowledge Graph-Infused Fine-Tuning for Structured Reasoning in Large Language Models
di: Zhang, Wuyang, et al.
Pubblicazione: (2025)
di: Zhang, Wuyang, et al.
Pubblicazione: (2025)
Prompting and Fine-Tuning Open-Sourced Large Language Models for Stance Classification
di: Cruickshank, Iain J., et al.
Pubblicazione: (2023)
di: Cruickshank, Iain J., et al.
Pubblicazione: (2023)
Reinforcement Fine-Tuning Powers Reasoning Capability of Multimodal Large Language Models
di: Sun, Haoyuan, et al.
Pubblicazione: (2025)
di: Sun, Haoyuan, et al.
Pubblicazione: (2025)
Impact of Fine-Tuning Methods on Memorization in Large Language Models
di: Hou, Jie, et al.
Pubblicazione: (2025)
di: Hou, Jie, et al.
Pubblicazione: (2025)
Dissecting Fine-Tuning Unlearning in Large Language Models
di: Hong, Yihuai, et al.
Pubblicazione: (2024)
di: Hong, Yihuai, et al.
Pubblicazione: (2024)
STAR: Constraint LoRA with Dynamic Active Learning for Data-Efficient Fine-Tuning of Large Language Models
di: Zhang, Linhai, et al.
Pubblicazione: (2024)
di: Zhang, Linhai, et al.
Pubblicazione: (2024)
Memorization in Fine-Tuned Large Language Models
di: Savine, Danil
Pubblicazione: (2025)
di: Savine, Danil
Pubblicazione: (2025)
DHA: Learning Decoupled-Head Attention from Transformer Checkpoints via Adaptive Heads Fusion
di: Chen, Yilong, et al.
Pubblicazione: (2024)
di: Chen, Yilong, et al.
Pubblicazione: (2024)
FinLLM-B: When Large Language Models Meet Financial Breakout Trading
di: Zhang, Kang, et al.
Pubblicazione: (2024)
di: Zhang, Kang, et al.
Pubblicazione: (2024)
SPP: Sparsity-Preserved Parameter-Efficient Fine-Tuning for Large Language Models
di: Lu, Xudong, et al.
Pubblicazione: (2024)
di: Lu, Xudong, et al.
Pubblicazione: (2024)
Efficient Tuning of Large Language Models for Knowledge-Grounded Dialogue Generation
di: Zhang, Bo, et al.
Pubblicazione: (2025)
di: Zhang, Bo, et al.
Pubblicazione: (2025)
FlowerTune: A Cross-Domain Benchmark for Federated Fine-Tuning of Large Language Models
di: Gao, Yan, et al.
Pubblicazione: (2025)
di: Gao, Yan, et al.
Pubblicazione: (2025)
Long-Short Chain-of-Thought Mixture Supervised Fine-Tuning Eliciting Efficient Reasoning in Large Language Models
di: Yu, Bin, et al.
Pubblicazione: (2025)
di: Yu, Bin, et al.
Pubblicazione: (2025)
Mixture-of-Skills: Learning to Optimize Data Usage for Fine-Tuning Large Language Models
di: Wu, Minghao, et al.
Pubblicazione: (2024)
di: Wu, Minghao, et al.
Pubblicazione: (2024)
Extend Model Merging from Fine-Tuned to Pre-Trained Large Language Models via Weight Disentanglement
di: Yu, Le, et al.
Pubblicazione: (2024)
di: Yu, Le, et al.
Pubblicazione: (2024)
Parameter-Efficient Fine-Tuning of Large Language Models using Semantic Knowledge Tuning
di: Prottasha, Nusrat Jahan, et al.
Pubblicazione: (2024)
di: Prottasha, Nusrat Jahan, et al.
Pubblicazione: (2024)
DolphCoder: Echo-Locating Code Large Language Models with Diverse and Multi-Objective Instruction Tuning
di: Wang, Yejie, et al.
Pubblicazione: (2024)
di: Wang, Yejie, et al.
Pubblicazione: (2024)
Mixture of Hidden-Dimensions Transformer
di: Chen, Yilong, et al.
Pubblicazione: (2024)
di: Chen, Yilong, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Upcycling Instruction Tuning from Dense to Mixture-of-Experts via Parameter Merging
di: Hui, Tingfeng, et al.
Pubblicazione: (2024) -
Advantageous Parameter Expansion Training Makes Better Large Language Models
di: Gu, Naibin, et al.
Pubblicazione: (2025) -
Phased Instruction Fine-Tuning for Large Language Models
di: Pang, Wei, et al.
Pubblicazione: (2024) -
Tool-Augmented Reward Modeling
di: Li, Lei, et al.
Pubblicazione: (2023) -
Curiosity-Driven Reinforcement Learning from Human Feedback
di: Sun, Haoran, et al.
Pubblicazione: (2025)