Gespeichert in:
| Hauptverfasser: | Zhang, Biao, Liu, Zhongtao, Cherry, Colin, Firat, Orhan |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | https://arxiv.org/abs/2402.17193 |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Scaling Sign Language Translation
von: Zhang, Biao, et al.
Veröffentlicht: (2024)
von: Zhang, Biao, et al.
Veröffentlicht: (2024)
Learning Dynamics of LLM Finetuning
von: Ren, Yi, et al.
Veröffentlicht: (2024)
von: Ren, Yi, et al.
Veröffentlicht: (2024)
Scaling Laws for Forgetting during Finetuning with Pretraining Data Injection
von: Bethune, Louis, et al.
Veröffentlicht: (2025)
von: Bethune, Louis, et al.
Veröffentlicht: (2025)
Towards Active Synthetic Data Generation for Finetuning Language Models
von: Kessler, Samuel, et al.
Veröffentlicht: (2025)
von: Kessler, Samuel, et al.
Veröffentlicht: (2025)
Sparse Memory Finetuning as a Low-Forgetting Alternative to LoRA and Full Finetuning
von: Gupta, Prakhar, et al.
Veröffentlicht: (2026)
von: Gupta, Prakhar, et al.
Veröffentlicht: (2026)
Predicting Emergent Capabilities by Finetuning
von: Snell, Charlie, et al.
Veröffentlicht: (2024)
von: Snell, Charlie, et al.
Veröffentlicht: (2024)
Improving Sparse Memory Finetuning
von: Goyal, Satyam, et al.
Veröffentlicht: (2026)
von: Goyal, Satyam, et al.
Veröffentlicht: (2026)
Ensembling Finetuned Language Models for Text Classification
von: Arango, Sebastian Pineda, et al.
Veröffentlicht: (2024)
von: Arango, Sebastian Pineda, et al.
Veröffentlicht: (2024)
Transfer Learning for Finetuning Large Language Models
von: Strangmann, Tobias, et al.
Veröffentlicht: (2024)
von: Strangmann, Tobias, et al.
Veröffentlicht: (2024)
ETHER: Efficient Finetuning of Large-Scale Models with Hyperplane Reflections
von: Bini, Massimo, et al.
Veröffentlicht: (2024)
von: Bini, Massimo, et al.
Veröffentlicht: (2024)
Order Independence With Finetuning
von: Brown, Katrina, et al.
Veröffentlicht: (2025)
von: Brown, Katrina, et al.
Veröffentlicht: (2025)
FlexLLM: Token-Level Co-Serving of LLM Inference and Finetuning with SLO Guarantees
von: Oliaro, Gabriele, et al.
Veröffentlicht: (2024)
von: Oliaro, Gabriele, et al.
Veröffentlicht: (2024)
Large Language Models to Diffusion Finetuning
von: Cetin, Edoardo, et al.
Veröffentlicht: (2025)
von: Cetin, Edoardo, et al.
Veröffentlicht: (2025)
Differentially Private Zeroth-Order Methods for Scalable Large Language Model Finetuning
von: Liu, Z, et al.
Veröffentlicht: (2024)
von: Liu, Z, et al.
Veröffentlicht: (2024)
Programming by Backprop: An Instruction is Worth 100 Examples When Finetuning LLMs
von: Cook, Jonathan, et al.
Veröffentlicht: (2025)
von: Cook, Jonathan, et al.
Veröffentlicht: (2025)
Transfer Learning of Tabular Data by Finetuning Large Language Models
von: Rabbani, Shourav B., et al.
Veröffentlicht: (2025)
von: Rabbani, Shourav B., et al.
Veröffentlicht: (2025)
Sparse Upcycling: Inference Inefficient Finetuning
von: Doubov, Sasha, et al.
Veröffentlicht: (2024)
von: Doubov, Sasha, et al.
Veröffentlicht: (2024)
Understanding Finetuning for Factual Knowledge Extraction
von: Ghosal, Gaurav, et al.
Veröffentlicht: (2024)
von: Ghosal, Gaurav, et al.
Veröffentlicht: (2024)
Less Finetuning, Better Retrieval: Rethinking LLM Adaptation for Biomedical Retrievers via Synthetic Data and Model Merging
von: Khattab, Sameh, et al.
Veröffentlicht: (2026)
von: Khattab, Sameh, et al.
Veröffentlicht: (2026)
Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning
von: Xie, Wanyun, et al.
Veröffentlicht: (2025)
von: Xie, Wanyun, et al.
Veröffentlicht: (2025)
Finetuning Language Models to Emit Linguistic Expressions of Uncertainty
von: Chaudhry, Arslan, et al.
Veröffentlicht: (2024)
von: Chaudhry, Arslan, et al.
Veröffentlicht: (2024)
CoBa: Convergence Balancer for Multitask Finetuning of Large Language Models
von: Gong, Zi, et al.
Veröffentlicht: (2024)
von: Gong, Zi, et al.
Veröffentlicht: (2024)
Orthogonal Finetuning Made Scalable
von: Qiu, Zeju, et al.
Veröffentlicht: (2025)
von: Qiu, Zeju, et al.
Veröffentlicht: (2025)
ReFT: Representation Finetuning for Language Models
von: Wu, Zhengxuan, et al.
Veröffentlicht: (2024)
von: Wu, Zhengxuan, et al.
Veröffentlicht: (2024)
Vanishing Gradients in Reinforcement Finetuning of Language Models
von: Razin, Noam, et al.
Veröffentlicht: (2023)
von: Razin, Noam, et al.
Veröffentlicht: (2023)
Diffusion Language Models Can Perform Many Tasks with Scaling and Instruction-Finetuning
von: Ye, Jiasheng, et al.
Veröffentlicht: (2023)
von: Ye, Jiasheng, et al.
Veröffentlicht: (2023)
Internalizing World Models via Self-Play Finetuning for Agentic RL
von: Chen, Shiqi, et al.
Veröffentlicht: (2025)
von: Chen, Shiqi, et al.
Veröffentlicht: (2025)
Covert Malicious Finetuning: Challenges in Safeguarding LLM Adaptation
von: Halawi, Danny, et al.
Veröffentlicht: (2024)
von: Halawi, Danny, et al.
Veröffentlicht: (2024)
Accurate LoRA-Finetuning Quantization of LLMs via Information Retention
von: Qin, Haotong, et al.
Veröffentlicht: (2024)
von: Qin, Haotong, et al.
Veröffentlicht: (2024)
ATLAS: Adaptive Transfer Scaling Laws for Multilingual Pretraining, Finetuning, and Decoding the Curse of Multilinguality
von: Longpre, Shayne, et al.
Veröffentlicht: (2025)
von: Longpre, Shayne, et al.
Veröffentlicht: (2025)
Orthogonal Finetuning for Direct Preference Optimization
von: Yang, Chenxu, et al.
Veröffentlicht: (2024)
von: Yang, Chenxu, et al.
Veröffentlicht: (2024)
Assessing the Portability of Parameter Matrices Trained by Parameter-Efficient Finetuning Methods
von: Sabry, Mohammed, et al.
Veröffentlicht: (2024)
von: Sabry, Mohammed, et al.
Veröffentlicht: (2024)
ApiQ: Finetuning of 2-Bit Quantized Large Language Model
von: Liao, Baohao, et al.
Veröffentlicht: (2024)
von: Liao, Baohao, et al.
Veröffentlicht: (2024)
MuonAll: Muon Variant for Efficient Finetuning of Large Language Models
von: Page, Saurabh, et al.
Veröffentlicht: (2025)
von: Page, Saurabh, et al.
Veröffentlicht: (2025)
The Finetuner's Fallacy: When to Pretrain with Your Finetuning Data
von: Baek, Christina, et al.
Veröffentlicht: (2026)
von: Baek, Christina, et al.
Veröffentlicht: (2026)
Efficient Reinforcement Finetuning via Adaptive Curriculum Learning
von: Shi, Taiwei, et al.
Veröffentlicht: (2025)
von: Shi, Taiwei, et al.
Veröffentlicht: (2025)
LLM-CXR: Instruction-Finetuned LLM for CXR Image Understanding and Generation
von: Lee, Suhyeon, et al.
Veröffentlicht: (2023)
von: Lee, Suhyeon, et al.
Veröffentlicht: (2023)
Learning Rate Scaling across LoRA Ranks and Transfer to Full Finetuning
von: Chen, Nan, et al.
Veröffentlicht: (2026)
von: Chen, Nan, et al.
Veröffentlicht: (2026)
Generalizable and Stable Finetuning of Pretrained Language Models on Low-Resource Texts
von: Somayajula, Sai Ashish, et al.
Veröffentlicht: (2024)
von: Somayajula, Sai Ashish, et al.
Veröffentlicht: (2024)
PLoP: Precise LoRA Placement for Efficient Finetuning of Large Models
von: Hayou, Soufiane, et al.
Veröffentlicht: (2025)
von: Hayou, Soufiane, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Scaling Sign Language Translation
von: Zhang, Biao, et al.
Veröffentlicht: (2024) -
Learning Dynamics of LLM Finetuning
von: Ren, Yi, et al.
Veröffentlicht: (2024) -
Scaling Laws for Forgetting during Finetuning with Pretraining Data Injection
von: Bethune, Louis, et al.
Veröffentlicht: (2025) -
Towards Active Synthetic Data Generation for Finetuning Language Models
von: Kessler, Samuel, et al.
Veröffentlicht: (2025) -
Sparse Memory Finetuning as a Low-Forgetting Alternative to LoRA and Full Finetuning
von: Gupta, Prakhar, et al.
Veröffentlicht: (2026)