Selective Self-Rehearsal: A Fine-Tuning Approach to Improve Generalization in Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gupta, Sonam, Nandwani, Yatin, Yehudai, Asaf, Mishra, Mayank, Pandey, Gaurav, Raghu, Dinesh, Joshi, Sachindra |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Selective Self-to-Supervised Fine-Tuning for Generalization in Large Language Models
par: Gupta, Sonam, et autres
Publié: (2025)
par: Gupta, Sonam, et autres
Publié: (2025)
Systematic Knowledge Injection into Large Language Models via Diverse Augmentation for Domain-Specific RAG
par: Bhushan, Kushagra, et autres
Publié: (2025)
par: Bhushan, Kushagra, et autres
Publié: (2025)
BRAIn: Bayesian Reward-conditioned Amortized Inference for natural language generation from feedback
par: Pandey, Gaurav, et autres
Publié: (2024)
par: Pandey, Gaurav, et autres
Publié: (2024)
Few shot chain-of-thought driven reasoning to prompt LLMs for open ended medical question answering
par: Nachane, Saeel Sandeep, et autres
Publié: (2024)
par: Nachane, Saeel Sandeep, et autres
Publié: (2024)
ToolWeave: Structured Synthesis of Complex Multi-Turn Tool-Calling Dialogues
par: Khandelwal, Dinesh, et autres
Publié: (2026)
par: Khandelwal, Dinesh, et autres
Publié: (2026)
When LLMs are Unfit Use FastFit: Fast and Effective Text Classification with Many Classes
par: Yehudai, Asaf, et autres
Publié: (2024)
par: Yehudai, Asaf, et autres
Publié: (2024)
Mediocrity is the key for LLM as a Judge Anchor Selection
par: Don-Yehiya, Shachar, et autres
Publié: (2026)
par: Don-Yehiya, Shachar, et autres
Publié: (2026)
Teaching Values to Machines: Simulating Human-Like Behavior in LLMs
par: Yehudai, Asaf, et autres
Publié: (2026)
par: Yehudai, Asaf, et autres
Publié: (2026)
When Fine-Tuning Fails: Lessons from MS MARCO Passage Ranking
par: Pande, Manu, et autres
Publié: (2025)
par: Pande, Manu, et autres
Publié: (2025)
A Nurse is Blue and Elephant is Rugby: Cross Domain Alignment in Large Language Models Reveal Human-like Patterns
par: Yehudai, Asaf, et autres
Publié: (2024)
par: Yehudai, Asaf, et autres
Publié: (2024)
Mitigating Catastrophic Forgetting in Large Language Models with Self-Synthesized Rehearsal
par: Huang, Jianheng, et autres
Publié: (2024)
par: Huang, Jianheng, et autres
Publié: (2024)
Agentic CLEAR: Automating Multi-Level Evaluation of LLM Agents
par: Yehudai, Asaf, et autres
Publié: (2026)
par: Yehudai, Asaf, et autres
Publié: (2026)
Efficient Response Generation Strategy Selection for Fine-Tuning Large Language Models Through Self-Aligned Perplexity
par: Ren, Xuan, et autres
Publié: (2025)
par: Ren, Xuan, et autres
Publié: (2025)
Improving Narrative Classification and Explanation via Fine Tuned Language Models
par: Tyagi, Rishit, et autres
Publié: (2025)
par: Tyagi, Rishit, et autres
Publié: (2025)
Applying Intrinsic Debiasing on Downstream Tasks: Challenges and Considerations for Machine Translation
par: Iluz, Bar, et autres
Publié: (2024)
par: Iluz, Bar, et autres
Publié: (2024)
See, Think, Learn: A Self-Taught Multimodal Reasoner
par: Sharma, Sourabh, et autres
Publié: (2025)
par: Sharma, Sourabh, et autres
Publié: (2025)
Diverse In-Context Example Selection After Decomposing Programs and Aligned Utterances Improves Semantic Parsing
par: Kothyari, Mayank, et autres
Publié: (2025)
par: Kothyari, Mayank, et autres
Publié: (2025)
WildIFEval: Instruction Following in the Wild
par: Lior, Gili, et autres
Publié: (2025)
par: Lior, Gili, et autres
Publié: (2025)
Guided Query Refinement: Multimodal Hybrid Retrieval with Test-Time Optimization
par: Uzan, Omri, et autres
Publié: (2025)
par: Uzan, Omri, et autres
Publié: (2025)
QLESS: A Quantized Approach for Data Valuation and Selection in Large Language Model Fine-Tuning
par: Ananta, Moses, et autres
Publié: (2025)
par: Ananta, Moses, et autres
Publié: (2025)
Unveiling the Generalization Power of Fine-Tuned Large Language Models
par: Yang, Haoran, et autres
Publié: (2024)
par: Yang, Haoran, et autres
Publié: (2024)
Improving Large Language Models with Concept-Aware Fine-Tuning
par: Chen, Michael K., et autres
Publié: (2025)
par: Chen, Michael K., et autres
Publié: (2025)
Systematic Diagnosis of Brittle Reasoning in Large Language Models
par: Parupudi, V. S. Raghu
Publié: (2025)
par: Parupudi, V. S. Raghu
Publié: (2025)
Enhancing Large Language Model Reasoning via Selective Critical Token Fine-Tuning
par: Ruan, Zhiwen, et autres
Publié: (2025)
par: Ruan, Zhiwen, et autres
Publié: (2025)
IA2: Alignment with ICL Activations Improves Supervised Fine-Tuning
par: Mishra, Aayush, et autres
Publié: (2025)
par: Mishra, Aayush, et autres
Publié: (2025)
Leveraging Conditional Mutual Information to Improve Large Language Model Fine-Tuning For Classification
par: Sivakaran, Thanushon, et autres
Publié: (2025)
par: Sivakaran, Thanushon, et autres
Publié: (2025)
Improved Supervised Fine-Tuning for Large Language Models to Mitigate Catastrophic Forgetting
par: Ding, Fei, et autres
Publié: (2025)
par: Ding, Fei, et autres
Publié: (2025)
Improving Linguistic Diversity of Large Language Models with Possibility Exploration Fine-Tuning
par: Mai, Long, et autres
Publié: (2024)
par: Mai, Long, et autres
Publié: (2024)
Multi-Lingual Development & Programming Languages Interoperability: An Empirical Study
par: Cherny-Shahar, Tsvi, et autres
Publié: (2024)
par: Cherny-Shahar, Tsvi, et autres
Publié: (2024)
Curating Stopwords in Marathi: A TF-IDF Approach for Improved Text Analysis and Information Retrieval
par: Chavan, Rohan, et autres
Publié: (2024)
par: Chavan, Rohan, et autres
Publié: (2024)
ReLeVAnT: Relevance Lexical Vectors for Accurate Legal Text Classification
par: Gakhar, Ishaan, et autres
Publié: (2026)
par: Gakhar, Ishaan, et autres
Publié: (2026)
Will it Merge? On The Causes of Model Mergeability
par: Rahamim, Adir, et autres
Publié: (2026)
par: Rahamim, Adir, et autres
Publié: (2026)
HFT: Half Fine-Tuning for Large Language Models
par: Hui, Tingfeng, et autres
Publié: (2024)
par: Hui, Tingfeng, et autres
Publié: (2024)
Take the essence and discard the dross: A Rethinking on Data Selection for Fine-Tuning Large Language Models
par: Liu, Ziche, et autres
Publié: (2024)
par: Liu, Ziche, et autres
Publié: (2024)
Fine-Tuning Qwen 2.5 3B for Realistic Movie Dialogue Generation
par: Gupta, Kartik
Publié: (2025)
par: Gupta, Kartik
Publié: (2025)
Memorization in Fine-Tuned Large Language Models
par: Savine, Danil
Publié: (2025)
par: Savine, Danil
Publié: (2025)
PoliTune: Analyzing the Impact of Data Selection and Fine-Tuning on Economic and Political Biases in Large Language Models
par: Agiza, Ahmed, et autres
Publié: (2024)
par: Agiza, Ahmed, et autres
Publié: (2024)
Fine-Tuning Improves Information Conveyance in Language Models
par: Cheng, Yuwei, et autres
Publié: (2026)
par: Cheng, Yuwei, et autres
Publié: (2026)
Dynamics of Instruction Fine-Tuning for Chinese Large Language Models
par: Song, Chiyu, et autres
Publié: (2023)
par: Song, Chiyu, et autres
Publié: (2023)
LiFT: Does Instruction Fine-Tuning Improve In-Context Learning for Longitudinal Modelling by Large Language Models?
par: Ali, Iqra, et autres
Publié: (2026)
par: Ali, Iqra, et autres
Publié: (2026)
Documents similaires
-
Selective Self-to-Supervised Fine-Tuning for Generalization in Large Language Models
par: Gupta, Sonam, et autres
Publié: (2025) -
Systematic Knowledge Injection into Large Language Models via Diverse Augmentation for Domain-Specific RAG
par: Bhushan, Kushagra, et autres
Publié: (2025) -
BRAIn: Bayesian Reward-conditioned Amortized Inference for natural language generation from feedback
par: Pandey, Gaurav, et autres
Publié: (2024) -
Few shot chain-of-thought driven reasoning to prompt LLMs for open ended medical question answering
par: Nachane, Saeel Sandeep, et autres
Publié: (2024) -
ToolWeave: Structured Synthesis of Complex Multi-Turn Tool-Calling Dialogues
par: Khandelwal, Dinesh, et autres
Publié: (2026)