Selection of LLM Fine-Tuning Data based on Orthogonal Rules
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Xiaomin, Gao, Mingye, Zhang, Zhiwei, Yue, Chang, Hu, Hong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Filter-then-Weight: Online Data Selection and Reweighting for LLM Fine-Tuning
por: Wang, Fangxin, et al.
Publicado: (2026)
por: Wang, Fangxin, et al.
Publicado: (2026)
Parameter Efficient Quasi-Orthogonal Fine-Tuning via Givens Rotation
por: Ma, Xinyu, et al.
Publicado: (2024)
por: Ma, Xinyu, et al.
Publicado: (2024)
RuleR: Improving LLM Controllability by Rule-based Data Recycling
por: Li, Ming, et al.
Publicado: (2024)
por: Li, Ming, et al.
Publicado: (2024)
Selective Reflection-Tuning: Student-Selected Data Recycling for LLM Instruction-Tuning
por: Li, Ming, et al.
Publicado: (2024)
por: Li, Ming, et al.
Publicado: (2024)
Mitigating Training Imbalance in LLM Fine-Tuning via Selective Parameter Merging
por: Ju, Yiming, et al.
Publicado: (2024)
por: Ju, Yiming, et al.
Publicado: (2024)
AirLLM: Diffusion Policy-based Adaptive LoRA for Remote Fine-Tuning of LLM over the Air
por: Yang, Shiyi, et al.
Publicado: (2025)
por: Yang, Shiyi, et al.
Publicado: (2025)
Get more for less: Principled Data Selection for Warming Up Fine-Tuning in LLMs
por: Kang, Feiyang, et al.
Publicado: (2024)
por: Kang, Feiyang, et al.
Publicado: (2024)
Linear Chain Transformation: Expanding Optimization Dynamics for Fine-Tuning Large Language Models
por: Wang, Yulong, et al.
Publicado: (2024)
por: Wang, Yulong, et al.
Publicado: (2024)
PoliTune: Analyzing the Impact of Data Selection and Fine-Tuning on Economic and Political Biases in Large Language Models
por: Agiza, Ahmed, et al.
Publicado: (2024)
por: Agiza, Ahmed, et al.
Publicado: (2024)
ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs
por: Wang, Zige, et al.
Publicado: (2025)
por: Wang, Zige, et al.
Publicado: (2025)
Influential Language Data Selection via Gradient Trajectory Pursuit
por: Deng, Zhiwei, et al.
Publicado: (2024)
por: Deng, Zhiwei, et al.
Publicado: (2024)
ROSE: A Reward-Oriented Data Selection Framework for LLM Task-Specific Instruction Tuning
por: Wu, Yang, et al.
Publicado: (2024)
por: Wu, Yang, et al.
Publicado: (2024)
MMICT: Boosting Multi-Modal Fine-Tuning with In-Context Examples
por: Chen, Tao, et al.
Publicado: (2023)
por: Chen, Tao, et al.
Publicado: (2023)
QLESS: A Quantized Approach for Data Valuation and Selection in Large Language Model Fine-Tuning
por: Ananta, Moses, et al.
Publicado: (2025)
por: Ananta, Moses, et al.
Publicado: (2025)
Understanding the Performance and Estimating the Cost of LLM Fine-Tuning
por: Xia, Yuchen, et al.
Publicado: (2024)
por: Xia, Yuchen, et al.
Publicado: (2024)
Boosting Large Language Models with Mask Fine-Tuning
por: Zhang, Mingyuan, et al.
Publicado: (2025)
por: Zhang, Mingyuan, et al.
Publicado: (2025)
Uncertainty-Aware Gradient Signal-to-Noise Data Selection for Instruction Tuning
por: Yuan, Zhihang, et al.
Publicado: (2026)
por: Yuan, Zhihang, et al.
Publicado: (2026)
Improving Data Efficiency for LLM Reinforcement Fine-tuning Through Difficulty-targeted Online Data Selection and Rollout Replay
por: Sun, Yifan, et al.
Publicado: (2025)
por: Sun, Yifan, et al.
Publicado: (2025)
SEAL: Safety-enhanced Aligned LLM Fine-tuning via Bilevel Data Selection
por: Shen, Han, et al.
Publicado: (2024)
por: Shen, Han, et al.
Publicado: (2024)
OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference
por: Shin, Seungjun, et al.
Publicado: (2025)
por: Shin, Seungjun, et al.
Publicado: (2025)
Fine-Tuning is Subgraph Search: A New Lens on Learning Dynamics
por: Li, Yueyan, et al.
Publicado: (2025)
por: Li, Yueyan, et al.
Publicado: (2025)
Parameter-Efficient Fine-Tuning with Discrete Fourier Transform
por: Gao, Ziqi, et al.
Publicado: (2024)
por: Gao, Ziqi, et al.
Publicado: (2024)
MSSR: Memory-Aware Adaptive Replay for Continual LLM Fine-Tuning
por: Lu, Yiyang, et al.
Publicado: (2026)
por: Lu, Yiyang, et al.
Publicado: (2026)
Stabilizing LLM Supervised Fine-Tuning via Explicit Distributional Control
por: Wang, Xinyu, et al.
Publicado: (2026)
por: Wang, Xinyu, et al.
Publicado: (2026)
Rethinking Parameter Sharing for LLM Fine-Tuning with Multiple LoRAs
por: Ban, Hao, et al.
Publicado: (2025)
por: Ban, Hao, et al.
Publicado: (2025)
SelectIT: Selective Instruction Tuning for LLMs via Uncertainty-Aware Self-Reflection
por: Liu, Liangxin, et al.
Publicado: (2024)
por: Liu, Liangxin, et al.
Publicado: (2024)
Beyond the 80/20 Rule: High-Entropy Minority Tokens Drive Effective Reinforcement Learning for LLM Reasoning
por: Wang, Shenzhi, et al.
Publicado: (2025)
por: Wang, Shenzhi, et al.
Publicado: (2025)
Outlier-weighed Layerwise Sampling for LLM Fine-tuning
por: Li, Pengxiang, et al.
Publicado: (2024)
por: Li, Pengxiang, et al.
Publicado: (2024)
LLM Maybe LongLM: Self-Extend LLM Context Window Without Tuning
por: Jin, Hongye, et al.
Publicado: (2024)
por: Jin, Hongye, et al.
Publicado: (2024)
TAGCOS: Task-agnostic Gradient Clustered Coreset Selection for Instruction Tuning Data
por: Zhang, Jipeng, et al.
Publicado: (2024)
por: Zhang, Jipeng, et al.
Publicado: (2024)
CURLoRA: Stable LLM Continual Fine-Tuning and Catastrophic Forgetting Mitigation
por: Fawi, Muhammad
Publicado: (2024)
por: Fawi, Muhammad
Publicado: (2024)
Fine-Tune an SLM or Prompt an LLM? The Case of Generating Low-Code Workflows
por: Ayala, Orlando Marquez, et al.
Publicado: (2025)
por: Ayala, Orlando Marquez, et al.
Publicado: (2025)
Aligning Backchannel and Dialogue Context Representations via Contrastive LLM Fine-Tuning
por: Qian, Livia, et al.
Publicado: (2026)
por: Qian, Livia, et al.
Publicado: (2026)
Routing with Generated Data: Annotation-Free LLM Skill Estimation and Expert Selection
por: Niu, Tianyi, et al.
Publicado: (2026)
por: Niu, Tianyi, et al.
Publicado: (2026)
Q-SFT: Q-Learning for Language Models via Supervised Fine-Tuning
por: Hong, Joey, et al.
Publicado: (2024)
por: Hong, Joey, et al.
Publicado: (2024)
Order-Independence Without Fine Tuning
por: McIlroy-Young, Reid, et al.
Publicado: (2024)
por: McIlroy-Young, Reid, et al.
Publicado: (2024)
A Scalable Multi-LLM Collaboration System with Retrieval-based Selection and Exploration-Exploitation-Driven Enhancement
por: Tang, Shengji, et al.
Publicado: (2025)
por: Tang, Shengji, et al.
Publicado: (2025)
Diversity as a Reward: Fine-Tuning LLMs on a Mixture of Domain-Undetermined Data
por: Ling, Zhenqing, et al.
Publicado: (2025)
por: Ling, Zhenqing, et al.
Publicado: (2025)
DataSciBench: An LLM Agent Benchmark for Data Science
por: Zhang, Dan, et al.
Publicado: (2025)
por: Zhang, Dan, et al.
Publicado: (2025)
LESS: Selecting Influential Data for Targeted Instruction Tuning
por: Xia, Mengzhou, et al.
Publicado: (2024)
por: Xia, Mengzhou, et al.
Publicado: (2024)
Ejemplares similares
-
Filter-then-Weight: Online Data Selection and Reweighting for LLM Fine-Tuning
por: Wang, Fangxin, et al.
Publicado: (2026) -
Parameter Efficient Quasi-Orthogonal Fine-Tuning via Givens Rotation
por: Ma, Xinyu, et al.
Publicado: (2024) -
RuleR: Improving LLM Controllability by Rule-based Data Recycling
por: Li, Ming, et al.
Publicado: (2024) -
Selective Reflection-Tuning: Student-Selected Data Recycling for LLM Instruction-Tuning
por: Li, Ming, et al.
Publicado: (2024) -
Mitigating Training Imbalance in LLM Fine-Tuning via Selective Parameter Merging
por: Ju, Yiming, et al.
Publicado: (2024)