The Long-Term Effects of Data Selection in LLM Fine-Tuning
Fuente:
arXiv
Guardado en:
| Autores principales: | Yang, Yuxin, Zeng, Aoxiong, Yang, Xiangquan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Towards Specialized Generalists: A Multi-Task MoE-LoRA Framework for Domain-Specific LLM Adaptation
por: Yang, Yuxin, et al.
Publicado: (2026)
por: Yang, Yuxin, et al.
Publicado: (2026)
Disentangling Task Conflicts in Multi-Task LoRA via Orthogonal Gradient Projection
por: Yang, Ziyu, et al.
Publicado: (2026)
por: Yang, Ziyu, et al.
Publicado: (2026)
One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning
por: Chen, Xinrui, et al.
Publicado: (2026)
por: Chen, Xinrui, et al.
Publicado: (2026)
LENSLLM: Unveiling Fine-Tuning Dynamics for LLM Selection
por: Zeng, Xinyue, et al.
Publicado: (2025)
por: Zeng, Xinyue, et al.
Publicado: (2025)
Selection of LLM Fine-Tuning Data based on Orthogonal Rules
por: Li, Xiaomin, et al.
Publicado: (2024)
por: Li, Xiaomin, et al.
Publicado: (2024)
Filter-then-Weight: Online Data Selection and Reweighting for LLM Fine-Tuning
por: Wang, Fangxin, et al.
Publicado: (2026)
por: Wang, Fangxin, et al.
Publicado: (2026)
Mitigating Training Imbalance in LLM Fine-Tuning via Selective Parameter Merging
por: Ju, Yiming, et al.
Publicado: (2024)
por: Ju, Yiming, et al.
Publicado: (2024)
MobiLLM: Enabling LLM Fine-Tuning on the Mobile Device via Server Assisted Side Tuning
por: Li, Liang, et al.
Publicado: (2025)
por: Li, Liang, et al.
Publicado: (2025)
What Matters in LLM-generated Data: Diversity and Its Effect on Model Fine-Tuning
por: Zhu, Yuchang, et al.
Publicado: (2025)
por: Zhu, Yuchang, et al.
Publicado: (2025)
Memory-Efficient Fine-Tuning of Transformers via Token Selection
por: Simoulin, Antoine, et al.
Publicado: (2025)
por: Simoulin, Antoine, et al.
Publicado: (2025)
Identification and Estimation of Long-Term Treatment Effects with Monotone Missing
por: Yang, Qinwei, et al.
Publicado: (2025)
por: Yang, Qinwei, et al.
Publicado: (2025)
FT-Dojo: Towards Autonomous LLM Fine-Tuning with Language Agents
por: Li, Qizheng, et al.
Publicado: (2026)
por: Li, Qizheng, et al.
Publicado: (2026)
Data Selection for LLM Alignment Using Fine-Grained Preferences
por: Zhang, Jia, et al.
Publicado: (2025)
por: Zhang, Jia, et al.
Publicado: (2025)
Open-World Reinforcement Learning over Long Short-Term Imagination
por: Li, Jiajian, et al.
Publicado: (2024)
por: Li, Jiajian, et al.
Publicado: (2024)
Data Difficulty and the Generalization--Extrapolation Tradeoff in LLM Fine-Tuning
por: Liu, Siyuan, et al.
Publicado: (2026)
por: Liu, Siyuan, et al.
Publicado: (2026)
ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs
por: Wang, Zige, et al.
Publicado: (2025)
por: Wang, Zige, et al.
Publicado: (2025)
Offline Exploration-Aware Fine-Tuning for Long-Chain Mathematical Reasoning
por: Mu, Yongyu, et al.
Publicado: (2026)
por: Mu, Yongyu, et al.
Publicado: (2026)
Communication-Aware Knowledge Distillation for Federated LLM Fine-Tuning over Wireless Networks
por: Zhang, Xinlu, et al.
Publicado: (2025)
por: Zhang, Xinlu, et al.
Publicado: (2025)
Selective Reflection-Tuning: Student-Selected Data Recycling for LLM Instruction-Tuning
por: Li, Ming, et al.
Publicado: (2024)
por: Li, Ming, et al.
Publicado: (2024)
Resource-Efficient Federated Fine-Tuning Large Language Models for Heterogeneous Data
por: Liu, Jun, et al.
Publicado: (2025)
por: Liu, Jun, et al.
Publicado: (2025)
Fed MobiLLM: Efficient Federated LLM Fine-Tuning over Heterogeneous Mobile Devices via Server Assisted Side-Tuning
por: Yang, Xingke, et al.
Publicado: (2025)
por: Yang, Xingke, et al.
Publicado: (2025)
D3: Diversity, Difficulty, and Dependability-Aware Data Selection for Sample-Efficient LLM Instruction Tuning
por: Zhang, Jia, et al.
Publicado: (2025)
por: Zhang, Jia, et al.
Publicado: (2025)
Dissecting Fine-Tuning Unlearning in Large Language Models
por: Hong, Yihuai, et al.
Publicado: (2024)
por: Hong, Yihuai, et al.
Publicado: (2024)
LCSB: Layer-Cyclic Selective Backpropagation for Memory-Efficient On-Device LLM Fine-Tuning
por: Park, Juneyoung, et al.
Publicado: (2026)
por: Park, Juneyoung, et al.
Publicado: (2026)
PAE MobiLLM: Privacy-Aware and Efficient LLM Fine-Tuning on the Mobile Device via Additive Side-Tuning
por: Yang, Xingke, et al.
Publicado: (2025)
por: Yang, Xingke, et al.
Publicado: (2025)
Alignment Dynamics in LLM Fine-Tuning
por: Huang, Yuhan, et al.
Publicado: (2026)
por: Huang, Yuhan, et al.
Publicado: (2026)
PRISM: Preference-Aware Influence Function Based Data Selection Method for Efficient Fine-Tuning
por: Lin, Qihao, et al.
Publicado: (2026)
por: Lin, Qihao, et al.
Publicado: (2026)
Combining Experimental and Observational Data for Identification and Estimation of Long-Term Causal Effects
por: Ghassami, AmirEmad, et al.
Publicado: (2022)
por: Ghassami, AmirEmad, et al.
Publicado: (2022)
LLM Zeroth-Order Fine-Tuning is an Inference Workload
por: Li, Zelin, et al.
Publicado: (2026)
por: Li, Zelin, et al.
Publicado: (2026)
Influence-Preserving Proxies for Gradient-Based Data Selection in LLM Fine-tuning
por: Chen, Sirui, et al.
Publicado: (2026)
por: Chen, Sirui, et al.
Publicado: (2026)
Long-Term Fairness with Unknown Dynamics
por: Yin, Tongxin, et al.
Publicado: (2023)
por: Yin, Tongxin, et al.
Publicado: (2023)
Policy Learning for Balancing Short-Term and Long-Term Rewards
por: Wu, Peng, et al.
Publicado: (2024)
por: Wu, Peng, et al.
Publicado: (2024)
LUNE: Efficient LLM Unlearning via LoRA Fine-Tuning with Negative Examples
por: Liu, Yezi, et al.
Publicado: (2025)
por: Liu, Yezi, et al.
Publicado: (2025)
Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning
por: Cong, Peizhuang, et al.
Publicado: (2025)
por: Cong, Peizhuang, et al.
Publicado: (2025)
Diagnosing Capability Gaps in Fine-Tuning Data
por: Taghanaki, Saeid Asgari, et al.
Publicado: (2026)
por: Taghanaki, Saeid Asgari, et al.
Publicado: (2026)
GD-FPS: Growth-Driven Feedforward Parameter Selection for Efficient Fine-Tuning
por: Yang, Kenneth, et al.
Publicado: (2025)
por: Yang, Kenneth, et al.
Publicado: (2025)
LEAD: Iterative Data Selection for Efficient LLM Instruction Tuning
por: Lin, Xiaotian, et al.
Publicado: (2025)
por: Lin, Xiaotian, et al.
Publicado: (2025)
RLLTE: Long-Term Evolution Project of Reinforcement Learning
por: Yuan, Mingqi, et al.
Publicado: (2023)
por: Yuan, Mingqi, et al.
Publicado: (2023)
AsFT: Anchoring Safety During LLM Fine-Tuning Within Narrow Safety Basin
por: Yang, Shuo, et al.
Publicado: (2025)
por: Yang, Shuo, et al.
Publicado: (2025)
From Instance Selection to Fixed-Pool Data Recipe Search for Supervised Fine-Tuning
por: Wu, Haodong, et al.
Publicado: (2026)
por: Wu, Haodong, et al.
Publicado: (2026)
Ejemplares similares
-
Towards Specialized Generalists: A Multi-Task MoE-LoRA Framework for Domain-Specific LLM Adaptation
por: Yang, Yuxin, et al.
Publicado: (2026) -
Disentangling Task Conflicts in Multi-Task LoRA via Orthogonal Gradient Projection
por: Yang, Ziyu, et al.
Publicado: (2026) -
One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning
por: Chen, Xinrui, et al.
Publicado: (2026) -
LENSLLM: Unveiling Fine-Tuning Dynamics for LLM Selection
por: Zeng, Xinyue, et al.
Publicado: (2025) -
Selection of LLM Fine-Tuning Data based on Orthogonal Rules
por: Li, Xiaomin, et al.
Publicado: (2024)