Two-stage LLM Fine-tuning with Less Specialization and More Generalization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Yihan, Si, Si, Li, Daliang, Lukasik, Michal, Yu, Felix, Hsieh, Cho-Jui, Dhillon, Inderjit S, Kumar, Sanjiv |
|---|---|
| Format: | Preprint |
| Publié: |
2022
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LoRA Done RITE: Robust Invariant Transformation Equilibration for LoRA Optimization
par: Yen, Jui-Nan, et autres
Publié: (2024)
par: Yen, Jui-Nan, et autres
Publié: (2024)
Large Language Models are Interpretable Learners
par: Wang, Ruochen, et autres
Publié: (2024)
par: Wang, Ruochen, et autres
Publié: (2024)
On the Loss of Context-awareness in General Instruction Fine-tuning
par: Wang, Yihan, et autres
Publié: (2024)
par: Wang, Yihan, et autres
Publié: (2024)
GroupDPO: Memory efficient Group-wise Direct Preference Optimization
par: Leng, Jixuan, et autres
Publié: (2026)
par: Leng, Jixuan, et autres
Publié: (2026)
TRACT: Regression-Aware Fine-tuning Meets Chain-of-Thought Reasoning for LLM-as-a-Judge
par: Chiang, Cheng-Han, et autres
Publié: (2025)
par: Chiang, Cheng-Han, et autres
Publié: (2025)
Regression-aware Inference with LLMs
par: Lukasik, Michal, et autres
Publié: (2024)
par: Lukasik, Michal, et autres
Publié: (2024)
Sparse MeZO: Less Parameters for Better Performance in Zeroth-Order LLM Fine-Tuning
par: Liu, Yong, et autres
Publié: (2024)
par: Liu, Yong, et autres
Publié: (2024)
LLM-guided Hierarchical Search for End-to-end Reasoning Intensive Retrieval
par: Gupta, Nilesh, et autres
Publié: (2025)
par: Gupta, Nilesh, et autres
Publié: (2025)
Solving for X and Beyond: Can Large Language Models Solve Complex Math Problems with More-Than-Two Unknowns?
par: Kao, Kuei-Chun, et autres
Publié: (2024)
par: Kao, Kuei-Chun, et autres
Publié: (2024)
LASER: Attention with Exponential Transformation
par: Duvvuri, Sai Surya, et autres
Publié: (2024)
par: Duvvuri, Sai Surya, et autres
Publié: (2024)
Scalable In-context Ranking with Generative Models
par: Gupta, Nilesh, et autres
Publié: (2025)
par: Gupta, Nilesh, et autres
Publié: (2025)
Defending LLMs against Jailbreaking Attacks via Backtranslation
par: Wang, Yihan, et autres
Publié: (2024)
par: Wang, Yihan, et autres
Publié: (2024)
An Efficient Rehearsal Scheme for Catastrophic Forgetting Mitigation during Multi-stage Fine-tuning
par: Bai, Andrew, et autres
Publié: (2024)
par: Bai, Andrew, et autres
Publié: (2024)
Explain Less, Understand More: Jargon Detection via Personalized Parameter-Efficient Fine-tuning
par: Wu, Bohao, et autres
Publié: (2025)
par: Wu, Bohao, et autres
Publié: (2025)
The Harder The Better: Maintaining Supervised Fine-tuning Generalization with Less but Harder Data
par: Shang, Zhaoyang, et autres
Publié: (2025)
par: Shang, Zhaoyang, et autres
Publié: (2025)
Fine-Grained Activation Steering: Steering Less, Achieving More
par: Feng, Zijian, et autres
Publié: (2026)
par: Feng, Zijian, et autres
Publié: (2026)
More Aligned, Less Diverse? Analyzing the Grammar and Lexicon of Two Generations of LLMs
par: Gude, Adrián, et autres
Publié: (2026)
par: Gude, Adrián, et autres
Publié: (2026)
Data-efficient LLM Fine-tuning for Code Generation
par: Lv, Weijie, et autres
Publié: (2025)
par: Lv, Weijie, et autres
Publié: (2025)
Accelerating Large Language Model Pretraining via LFR Pedagogy: Learn, Focus, and Review
par: Prakriya, Neha, et autres
Publié: (2024)
par: Prakriya, Neha, et autres
Publié: (2024)
Evaluating LLMs in the Context of a Functional Programming Course: A Comprehensive Study
par: Zhang, Yihan, et autres
Publié: (2026)
par: Zhang, Yihan, et autres
Publié: (2026)
Memento: Fine-tuning LLM Agents without Fine-tuning LLMs
par: Zhou, Huichi, et autres
Publié: (2025)
par: Zhou, Huichi, et autres
Publié: (2025)
DrAttack: Prompt Decomposition and Reconstruction Makes Powerful LLM Jailbreakers
par: Li, Xirui, et autres
Publié: (2024)
par: Li, Xirui, et autres
Publié: (2024)
Learning Less Is More: Premature Upper-Layer Attention Specialization Hurts Language Model Pretraining
par: Zhu, Jinchang, et autres
Publié: (2026)
par: Zhu, Jinchang, et autres
Publié: (2026)
ClawEnvKit: Automatic Environment Generation for Claw-Like Agents
par: Li, Xirui, et autres
Publié: (2026)
par: Li, Xirui, et autres
Publié: (2026)
More Haste, Less Speed: Weaker Single-Layer Watermark Improves Distortion-Free Watermark Ensembles
par: Chen, Ruibo, et autres
Publié: (2026)
par: Chen, Ruibo, et autres
Publié: (2026)
Sell More, Play Less: Benchmarking LLM Realistic Selling Skill
par: Su, Xuanbo, et autres
Publié: (2026)
par: Su, Xuanbo, et autres
Publié: (2026)
NeurIPS 2023 LLM Efficiency Fine-tuning Competition
par: Saroufim, Mark, et autres
Publié: (2025)
par: Saroufim, Mark, et autres
Publié: (2025)
Less is More: Parameter-Efficient Selection of Intermediate Tasks for Transfer Learning
par: Schulte, David, et autres
Publié: (2024)
par: Schulte, David, et autres
Publié: (2024)
Less for More: Enhanced Feedback-aligned Mixed LLMs for Molecule Caption Generation and Fine-Grained NLI Evaluation
par: Gkoumas, Dimitris, et autres
Publié: (2024)
par: Gkoumas, Dimitris, et autres
Publié: (2024)
KInIT at SemEval-2024 Task 8: Fine-tuned LLMs for Multilingual Machine-Generated Text Detection
par: Spiegel, Michal, et autres
Publié: (2024)
par: Spiegel, Michal, et autres
Publié: (2024)
Code Less, Align More: Efficient LLM Fine-tuning for Code Generation with Data Pruning
par: Tsai, Yun-Da, et autres
Publié: (2024)
par: Tsai, Yun-Da, et autres
Publié: (2024)
A General Framework to Enhance Fine-tuning-based LLM Unlearning
par: Ren, Jie, et autres
Publié: (2025)
par: Ren, Jie, et autres
Publié: (2025)
More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning
par: Shafiei, Mohammadamin, et autres
Publié: (2025)
par: Shafiei, Mohammadamin, et autres
Publié: (2025)
CLUE: Concept-Level Uncertainty Estimation for Large Language Models
par: Wang, Yu-Hsiang, et autres
Publié: (2024)
par: Wang, Yu-Hsiang, et autres
Publié: (2024)
Less is More: Improving LLM Reasoning with Minimal Test-Time Intervention
par: Yang, Zhen, et autres
Publié: (2025)
par: Yang, Zhen, et autres
Publié: (2025)
LoFiT: Localized Fine-tuning on LLM Representations
par: Yin, Fangcong, et autres
Publié: (2024)
par: Yin, Fangcong, et autres
Publié: (2024)
Mechanistic Fine-tuning for In-context Learning
par: Cho, Hakaze, et autres
Publié: (2025)
par: Cho, Hakaze, et autres
Publié: (2025)
LIMO: Less is More for Reasoning
par: Ye, Yixin, et autres
Publié: (2025)
par: Ye, Yixin, et autres
Publié: (2025)
Less LLM, More Documents: Searching for Improved RAG
par: Ning, Jingjie, et autres
Publié: (2025)
par: Ning, Jingjie, et autres
Publié: (2025)
Less is More: Improving LLM Alignment via Preference Data Selection
par: Deng, Xun, et autres
Publié: (2025)
par: Deng, Xun, et autres
Publié: (2025)
Documents similaires
-
LoRA Done RITE: Robust Invariant Transformation Equilibration for LoRA Optimization
par: Yen, Jui-Nan, et autres
Publié: (2024) -
Large Language Models are Interpretable Learners
par: Wang, Ruochen, et autres
Publié: (2024) -
On the Loss of Context-awareness in General Instruction Fine-tuning
par: Wang, Yihan, et autres
Publié: (2024) -
GroupDPO: Memory efficient Group-wise Direct Preference Optimization
par: Leng, Jixuan, et autres
Publié: (2026) -
TRACT: Regression-Aware Fine-tuning Meets Chain-of-Thought Reasoning for LLM-as-a-Judge
par: Chiang, Cheng-Han, et autres
Publié: (2025)