Instruction Fine-Tuning: Does Prompt Loss Matter?
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Huerta-Enochian, Mathew, Ko, Seung Yong |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SignBLEU: Automatic Evaluation of Multi-channel Sign Language Translation
par: Kim, Jung-Ho, et autres
Publié: (2024)
par: Kim, Jung-Ho, et autres
Publié: (2024)
On the Effect of Instruction Tuning Loss on Generalization
par: Chatterjee, Anwoy, et autres
Publié: (2025)
par: Chatterjee, Anwoy, et autres
Publié: (2025)
G-Loss: Graph-Guided Fine-Tuning of Language Models
par: Sharma, Aditya, et autres
Publié: (2026)
par: Sharma, Aditya, et autres
Publié: (2026)
Selective Prompting Tuning for Personalized Conversations with LLMs
par: Huang, Qiushi, et autres
Publié: (2024)
par: Huang, Qiushi, et autres
Publié: (2024)
Fine-Tuning a Time Series Foundation Model with Wasserstein Loss
par: Chernov, Andrei
Publié: (2024)
par: Chernov, Andrei
Publié: (2024)
M$^2$PT: Multimodal Prompt Tuning for Zero-shot Instruction Learning
par: Wang, Taowen, et autres
Publié: (2024)
par: Wang, Taowen, et autres
Publié: (2024)
Neural Networks for Learnable and Scalable Influence Estimation of Instruction Fine-Tuning Data
par: Agarwal, Ishika, et autres
Publié: (2025)
par: Agarwal, Ishika, et autres
Publié: (2025)
Fine-Tuning and Prompt Optimization: Two Great Steps that Work Better Together
par: Soylu, Dilara, et autres
Publié: (2024)
par: Soylu, Dilara, et autres
Publié: (2024)
Prompting and Fine-Tuning of Small LLMs for Length-Controllable Telephone Call Summarization
par: Thulke, David, et autres
Publié: (2024)
par: Thulke, David, et autres
Publié: (2024)
Fine-Tune an SLM or Prompt an LLM? The Case of Generating Low-Code Workflows
par: Ayala, Orlando Marquez, et autres
Publié: (2025)
par: Ayala, Orlando Marquez, et autres
Publié: (2025)
The Right Time Matters: Data Arrangement Affects Zero-Shot Generalization in Instruction Tuning
par: He, Bingxiang, et autres
Publié: (2024)
par: He, Bingxiang, et autres
Publié: (2024)
Learning Rate Matters: Vanilla LoRA May Suffice for LLM Fine-tuning
par: Lee, Yu-Ang, et autres
Publié: (2026)
par: Lee, Yu-Ang, et autres
Publié: (2026)
Contrastive Instruction Tuning
par: Yan, Tianyi Lorena, et autres
Publié: (2024)
par: Yan, Tianyi Lorena, et autres
Publié: (2024)
Not All Adapters Matter: Selective Adapter Freezing for Memory-Efficient Fine-Tuning of Language Models
par: Son, Hyegang, et autres
Publié: (2024)
par: Son, Hyegang, et autres
Publié: (2024)
LongForm: Effective Instruction Tuning with Reverse Instructions
par: Köksal, Abdullatif, et autres
Publié: (2023)
par: Köksal, Abdullatif, et autres
Publié: (2023)
Generative Representational Instruction Tuning
par: Muennighoff, Niklas, et autres
Publié: (2024)
par: Muennighoff, Niklas, et autres
Publié: (2024)
Instruction Tuning with Human Curriculum
par: Lee, Bruce W., et autres
Publié: (2023)
par: Lee, Bruce W., et autres
Publié: (2023)
ARES: Alternating Reinforcement Learning and Supervised Fine-Tuning for Enhanced Multi-Modal Chain-of-Thought Reasoning Through Diverse AI Feedback
par: Byun, Ju-Seung, et autres
Publié: (2024)
par: Byun, Ju-Seung, et autres
Publié: (2024)
DynaPrompt: Dynamic Test-Time Prompt Tuning
par: Xiao, Zehao, et autres
Publié: (2025)
par: Xiao, Zehao, et autres
Publié: (2025)
Enhancing and Assessing Instruction-Following with Fine-Grained Instruction Variants
par: Yang, Jiuding, et autres
Publié: (2024)
par: Yang, Jiuding, et autres
Publié: (2024)
Proximal Supervised Fine-Tuning
par: Zhu, Wenhong, et autres
Publié: (2025)
par: Zhu, Wenhong, et autres
Publié: (2025)
Instruction Mining: Instruction Data Selection for Tuning Large Language Models
par: Cao, Yihan, et autres
Publié: (2023)
par: Cao, Yihan, et autres
Publié: (2023)
Efficient Prompt Tuning by Multi-Space Projection and Prompt Fusion
par: Lan, Pengxiang, et autres
Publié: (2024)
par: Lan, Pengxiang, et autres
Publié: (2024)
What Makes Good Data for Alignment? A Comprehensive Study of Automatic Data Selection in Instruction Tuning
par: Liu, Wei, et autres
Publié: (2023)
par: Liu, Wei, et autres
Publié: (2023)
Subgraph-level Universal Prompt Tuning
par: Lee, Junhyun, et autres
Publié: (2024)
par: Lee, Junhyun, et autres
Publié: (2024)
Parameter Efficient Instruction Tuning: An Empirical Study
par: He, Pengfei
Publié: (2024)
par: He, Pengfei
Publié: (2024)
The Best Instruction-Tuning Data are Those That Fit
par: Zhang, Dylan, et autres
Publié: (2025)
par: Zhang, Dylan, et autres
Publié: (2025)
Order-Independence Without Fine Tuning
par: McIlroy-Young, Reid, et autres
Publié: (2024)
par: McIlroy-Young, Reid, et autres
Publié: (2024)
Model Editing by Standard Fine-Tuning
par: Gangadhar, Govind, et autres
Publié: (2024)
par: Gangadhar, Govind, et autres
Publié: (2024)
Selective Reflection-Tuning: Student-Selected Data Recycling for LLM Instruction-Tuning
par: Li, Ming, et autres
Publié: (2024)
par: Li, Ming, et autres
Publié: (2024)
Checkpoint-GCG: Auditing and Attacking Fine-Tuning-Based Prompt Injection Defenses
par: Yang, Xiaoxue, et autres
Publié: (2025)
par: Yang, Xiaoxue, et autres
Publié: (2025)
Improved Baselines with Visual Instruction Tuning
par: Liu, Haotian, et autres
Publié: (2023)
par: Liu, Haotian, et autres
Publié: (2023)
Sparse MeZO: Less Parameters for Better Performance in Zeroth-Order LLM Fine-Tuning
par: Liu, Yong, et autres
Publié: (2024)
par: Liu, Yong, et autres
Publié: (2024)
Plug and Play with Prompts: A Prompt Tuning Approach for Controlling Text Generation
par: Ajwani, Rohan Deepak, et autres
Publié: (2024)
par: Ajwani, Rohan Deepak, et autres
Publié: (2024)
Hard Prompts Made Interpretable: Sparse Entropy Regularization for Prompt Tuning with RL
par: Choi, Yunseon, et autres
Publié: (2024)
par: Choi, Yunseon, et autres
Publié: (2024)
Multilingual Instruction Tuning With Just a Pinch of Multilinguality
par: Shaham, Uri, et autres
Publié: (2024)
par: Shaham, Uri, et autres
Publié: (2024)
SMART: Submodular Data Mixture Strategy for Instruction Tuning
par: Renduchintala, H S V N S Kowndinya, et autres
Publié: (2024)
par: Renduchintala, H S V N S Kowndinya, et autres
Publié: (2024)
LESS: Selecting Influential Data for Targeted Instruction Tuning
par: Xia, Mengzhou, et autres
Publié: (2024)
par: Xia, Mengzhou, et autres
Publié: (2024)
MathScale: Scaling Instruction Tuning for Mathematical Reasoning
par: Tang, Zhengyang, et autres
Publié: (2024)
par: Tang, Zhengyang, et autres
Publié: (2024)
Instruction Tuning for Large Language Models: A Survey
par: Zhang, Shengyu, et autres
Publié: (2023)
par: Zhang, Shengyu, et autres
Publié: (2023)
Documents similaires
-
SignBLEU: Automatic Evaluation of Multi-channel Sign Language Translation
par: Kim, Jung-Ho, et autres
Publié: (2024) -
On the Effect of Instruction Tuning Loss on Generalization
par: Chatterjee, Anwoy, et autres
Publié: (2025) -
G-Loss: Graph-Guided Fine-Tuning of Language Models
par: Sharma, Aditya, et autres
Publié: (2026) -
Selective Prompting Tuning for Personalized Conversations with LLMs
par: Huang, Qiushi, et autres
Publié: (2024) -
Fine-Tuning a Time Series Foundation Model with Wasserstein Loss
par: Chernov, Andrei
Publié: (2024)