Teaching LLMs How to Learn with Contextual Fine-Tuning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Choi, Younwoo, Asif, Muhammad Adil, Han, Ziwen, Willes, John, Krishnan, Rahul G. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning
par: Krishnan, Ranganath, et autres
Publié: (2024)
par: Krishnan, Ranganath, et autres
Publié: (2024)
RefusalGuard: Geometry-Preserving Fine-Tuning for Safety in LLMs
par: Asif, Sadia, et autres
Publié: (2026)
par: Asif, Sadia, et autres
Publié: (2026)
Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs
par: Giordani, Jeremiah
Publié: (2025)
par: Giordani, Jeremiah
Publié: (2025)
Personalized Adaptation via In-Context Preference Learning
par: Lau, Allison, et autres
Publié: (2024)
par: Lau, Allison, et autres
Publié: (2024)
Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning
par: Khadangi, Afshin, et autres
Publié: (2025)
par: Khadangi, Afshin, et autres
Publié: (2025)
Calibration Collapse Under Sycophancy Fine-Tuning: How Reward Hacking Breaks Uncertainty Quantification in LLMs
par: Sahoo, Subramanyam
Publié: (2026)
par: Sahoo, Subramanyam
Publié: (2026)
Fine-Tuning or Retrieval? Comparing Knowledge Injection in LLMs
par: Ovadia, Oded, et autres
Publié: (2023)
par: Ovadia, Oded, et autres
Publié: (2023)
L-TUNING: Synchronized Label Tuning for Prompt and Prefix in LLMs
par: Kowsher, Md., et autres
Publié: (2023)
par: Kowsher, Md., et autres
Publié: (2023)
CURLoRA: Stable LLM Continual Fine-Tuning and Catastrophic Forgetting Mitigation
par: Fawi, Muhammad
Publié: (2024)
par: Fawi, Muhammad
Publié: (2024)
EBFT: Effective and Block-Wise Fine-Tuning for Sparse LLMs
par: Guo, Song, et autres
Publié: (2024)
par: Guo, Song, et autres
Publié: (2024)
Towards Understanding Fine-Tuning Mechanisms of LLMs via Circuit Analysis
par: Wang, Xu, et autres
Publié: (2025)
par: Wang, Xu, et autres
Publié: (2025)
Fine-Tuning LLMs for Report Summarization: Analysis on Supervised and Unsupervised Data
par: Rallapalli, Swati, et autres
Publié: (2025)
par: Rallapalli, Swati, et autres
Publié: (2025)
Hallucination Detection in LLMs: Fast and Memory-Efficient Fine-Tuned Models
par: Arteaga, Gabriel Y., et autres
Publié: (2024)
par: Arteaga, Gabriel Y., et autres
Publié: (2024)
LLMem: Estimating GPU Memory Usage for Fine-Tuning Pre-Trained LLMs
par: Kim, Taeho, et autres
Publié: (2024)
par: Kim, Taeho, et autres
Publié: (2024)
ALKAFI-LLAMA3: Fine-Tuning LLMs for Precise Legal Understanding in Palestine
par: Qasem, Rabee, et autres
Publié: (2024)
par: Qasem, Rabee, et autres
Publié: (2024)
Prompting and Fine-Tuning of Small LLMs for Length-Controllable Telephone Call Summarization
par: Thulke, David, et autres
Publié: (2024)
par: Thulke, David, et autres
Publié: (2024)
Direct Alignment of Draft Model for Speculative Decoding with Chat-Fine-Tuned LLMs
par: Goel, Raghavv, et autres
Publié: (2024)
par: Goel, Raghavv, et autres
Publié: (2024)
Supervised Fine-Tuning as Inverse Reinforcement Learning
par: Sun, Hao
Publié: (2024)
par: Sun, Hao
Publié: (2024)
Show Me How It's Done: The Role of Explanations in Fine-Tuning Language Models
par: Ballout, Mohamad, et autres
Publié: (2024)
par: Ballout, Mohamad, et autres
Publié: (2024)
Towards Understanding the Fragility of Multilingual LLMs against Fine-Tuning Attacks
par: Poppi, Samuele, et autres
Publié: (2024)
par: Poppi, Samuele, et autres
Publié: (2024)
Diversity as a Reward: Fine-Tuning LLMs on a Mixture of Domain-Undetermined Data
par: Ling, Zhenqing, et autres
Publié: (2025)
par: Ling, Zhenqing, et autres
Publié: (2025)
Deconfounded Causality-aware Parameter-Efficient Fine-Tuning for Problem-Solving Improvement of LLMs
par: Wang, Ruoyu, et autres
Publié: (2024)
par: Wang, Ruoyu, et autres
Publié: (2024)
Long Exposure: Accelerating Parameter-Efficient Fine-Tuning for LLMs under Shadowy Sparsity
par: Wang, Tuowei, et autres
Publié: (2025)
par: Wang, Tuowei, et autres
Publié: (2025)
NeuronTune: Fine-Grained Neuron Modulation for Balanced Safety-Utility Alignment in LLMs
par: Pan, Birong, et autres
Publié: (2025)
par: Pan, Birong, et autres
Publié: (2025)
LLMs Meet Finance: Fine-Tuning Foundation Models for the Open FinLLM Leaderboard
par: Rao, Varun, et autres
Publié: (2025)
par: Rao, Varun, et autres
Publié: (2025)
ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs
par: Wang, Zige, et autres
Publié: (2025)
par: Wang, Zige, et autres
Publié: (2025)
Position-Aware Parameter Efficient Fine-Tuning Approach for Reducing Positional Bias in LLMs
par: Zhang, Zheng, et autres
Publié: (2024)
par: Zhang, Zheng, et autres
Publié: (2024)
Get more for less: Principled Data Selection for Warming Up Fine-Tuning in LLMs
par: Kang, Feiyang, et autres
Publié: (2024)
par: Kang, Feiyang, et autres
Publié: (2024)
SVFT: Parameter-Efficient Fine-Tuning with Singular Vectors
par: Lingam, Vijay, et autres
Publié: (2024)
par: Lingam, Vijay, et autres
Publié: (2024)
QLESS: A Quantized Approach for Data Valuation and Selection in Large Language Model Fine-Tuning
par: Ananta, Moses, et autres
Publié: (2025)
par: Ananta, Moses, et autres
Publié: (2025)
Fine-Tuning Language Models with Reward Learning on Policy
par: Lang, Hao, et autres
Publié: (2024)
par: Lang, Hao, et autres
Publié: (2024)
Examining Gender and Power on Wikipedia Through Face and Politeness
par: Soubki, Adil, et autres
Publié: (2024)
par: Soubki, Adil, et autres
Publié: (2024)
Sparse but Critical: A Token-Level Analysis of Distributional Shifts in RLVR Fine-Tuning of LLMs
par: Meng, Haoming, et autres
Publié: (2026)
par: Meng, Haoming, et autres
Publié: (2026)
AutoPEFT: Automatic Configuration Search for Parameter-Efficient Fine-Tuning
par: Zhou, Han, et autres
Publié: (2023)
par: Zhou, Han, et autres
Publié: (2023)
Proximal Supervised Fine-Tuning
par: Zhu, Wenhong, et autres
Publié: (2025)
par: Zhu, Wenhong, et autres
Publié: (2025)
Why Fine-Tuning Encourages Hallucinations and How to Fix It
par: Kaplan, Guy, et autres
Publié: (2026)
par: Kaplan, Guy, et autres
Publié: (2026)
LinguaMap: Which Layers of LLMs Speak Your Language and How to Tune Them?
par: Tamo, J. Ben, et autres
Publié: (2026)
par: Tamo, J. Ben, et autres
Publié: (2026)
LoRA Fine-Tuning Without GPUs: A CPU-Efficient Meta-Generation Framework for LLMs
par: Arabpour, Reza, et autres
Publié: (2025)
par: Arabpour, Reza, et autres
Publié: (2025)
GSQ-Tuning: Group-Shared Exponents Integer in Fully Quantized Training for LLMs On-Device Fine-tuning
par: Zhou, Sifan, et autres
Publié: (2025)
par: Zhou, Sifan, et autres
Publié: (2025)
SPARC: Subspace-Aware Prompt Adaptation for Robust Continual Learning in LLMs
par: Jayasuriya, Dinithi, et autres
Publié: (2025)
par: Jayasuriya, Dinithi, et autres
Publié: (2025)
Documents similaires
-
Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning
par: Krishnan, Ranganath, et autres
Publié: (2024) -
RefusalGuard: Geometry-Preserving Fine-Tuning for Safety in LLMs
par: Asif, Sadia, et autres
Publié: (2026) -
Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs
par: Giordani, Jeremiah
Publié: (2025) -
Personalized Adaptation via In-Context Preference Learning
par: Lau, Allison, et autres
Publié: (2024) -
Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning
par: Khadangi, Afshin, et autres
Publié: (2025)