Fine-Tuning Attention Modules Only: Enhancing Weight Disentanglement in Task Arithmetic
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Jin, Ruochen, Hou, Bojian, Xiao, Jiancong, Su, Weijie, Shen, Li |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Restoring Calibration for Aligned Large Language Models: A Calibration-Aware Fine-Tuning Approach
von: Xiao, Jiancong, et al.
Veröffentlicht: (2025)
von: Xiao, Jiancong, et al.
Veröffentlicht: (2025)
A Semantic-Sampling Framework for Evaluating Calibration in Open-Ended Question Answering
von: Wang, Zhanliang, et al.
Veröffentlicht: (2026)
von: Wang, Zhanliang, et al.
Veröffentlicht: (2026)
ICAFS: Inter-Client-Aware Feature Selection for Vertical Federated Learning
von: Jin, Ruochen, et al.
Veröffentlicht: (2025)
von: Jin, Ruochen, et al.
Veröffentlicht: (2025)
Bridging the Gap: Rademacher Complexity in Robust and Standard Generalization
von: Xiao, Jiancong, et al.
Veröffentlicht: (2024)
von: Xiao, Jiancong, et al.
Veröffentlicht: (2024)
Preserving Diversity in Supervised Fine-Tuning of Large Language Models
von: Li, Ziniu, et al.
Veröffentlicht: (2024)
von: Li, Ziniu, et al.
Veröffentlicht: (2024)
Distilling Linearized Behavior into Non-Linear Fine-Tuning for Effective Task Arithmetic
von: Sommariva, Thomas, et al.
Veröffentlicht: (2026)
von: Sommariva, Thomas, et al.
Veröffentlicht: (2026)
Theoretical Tensions in RLHF: Reconciling Empirical Success with Inconsistencies in Social Choice Theory
von: Xiao, Jiancong, et al.
Veröffentlicht: (2025)
von: Xiao, Jiancong, et al.
Veröffentlicht: (2025)
Fundamental Limits of Game-Theoretic LLM Alignment: Smith Consistency and Preference Matching
von: Shi, Zhekun, et al.
Veröffentlicht: (2025)
von: Shi, Zhekun, et al.
Veröffentlicht: (2025)
Layer-Aware Task Arithmetic: Disentangling Task-Specific and Instruction-Following Knowledge
von: Chen, Yan-Lun, et al.
Veröffentlicht: (2025)
von: Chen, Yan-Lun, et al.
Veröffentlicht: (2025)
Leveraging Submodule Linearity Enhances Task Arithmetic Performance in LLMs
von: Dai, Rui, et al.
Veröffentlicht: (2025)
von: Dai, Rui, et al.
Veröffentlicht: (2025)
BitDelta: Your Fine-Tune May Only Be Worth One Bit
von: Liu, James, et al.
Veröffentlicht: (2024)
von: Liu, James, et al.
Veröffentlicht: (2024)
Supervised Fine-Tuning Achieve Rapid Task Adaption Via Alternating Attention Head Activation Patterns
von: Zhao, Yang, et al.
Veröffentlicht: (2024)
von: Zhao, Yang, et al.
Veröffentlicht: (2024)
On the Algorithmic Bias of Aligning Large Language Models with RLHF: Preference Collapse and Matching Regularization
von: Xiao, Jiancong, et al.
Veröffentlicht: (2024)
von: Xiao, Jiancong, et al.
Veröffentlicht: (2024)
Task Addition and Weight Disentanglement in Closed-Vocabulary Models
von: Hazimeh, Adam, et al.
Veröffentlicht: (2025)
von: Hazimeh, Adam, et al.
Veröffentlicht: (2025)
Statistical Impossibility and Possibility of Aligning LLMs with Human Preferences: From Condorcet Paradox to Nash Equilibrium
von: Liu, Kaizhao, et al.
Veröffentlicht: (2025)
von: Liu, Kaizhao, et al.
Veröffentlicht: (2025)
Efficient Online RL Fine Tuning with Offline Pre-trained Policy Only
von: Xiao, Wei, et al.
Veröffentlicht: (2025)
von: Xiao, Wei, et al.
Veröffentlicht: (2025)
Traces Propagation: Memory-Efficient and Scalable Forward-Only Learning in Spiking Neural Networks
von: Pes, Lorenzo, et al.
Veröffentlicht: (2025)
von: Pes, Lorenzo, et al.
Veröffentlicht: (2025)
Fairness-Aware Estimation of Graphical Models
von: Zhou, Zhuoping, et al.
Veröffentlicht: (2024)
von: Zhou, Zhuoping, et al.
Veröffentlicht: (2024)
Task-Adaptive Parameter-Efficient Fine-Tuning for Weather Foundation Models
von: Cao, Shilei, et al.
Veröffentlicht: (2025)
von: Cao, Shilei, et al.
Veröffentlicht: (2025)
On Fairness of Task Arithmetic: The Role of Task Vectors
von: Naganuma, Hiroki, et al.
Veröffentlicht: (2025)
von: Naganuma, Hiroki, et al.
Veröffentlicht: (2025)
FL-TAC: Enhanced Fine-Tuning in Federated Learning via Low-Rank, Task-Specific Adapter Clustering
von: Ping, Siqi, et al.
Veröffentlicht: (2024)
von: Ping, Siqi, et al.
Veröffentlicht: (2024)
Active Fine-Tuning of Multi-Task Policies
von: Bagatella, Marco, et al.
Veröffentlicht: (2024)
von: Bagatella, Marco, et al.
Veröffentlicht: (2024)
Fine-Tuning Topics through Weighting Aspect Keywords
von: Nazari, Ali, et al.
Veröffentlicht: (2025)
von: Nazari, Ali, et al.
Veröffentlicht: (2025)
Adaptive and Fine-grained Module-wise Expert Pruning for Efficient LoRA-MoE Fine-Tuning
von: Li, Weihang, et al.
Veröffentlicht: (2026)
von: Li, Weihang, et al.
Veröffentlicht: (2026)
Theoretical Insights into Fine-Tuning Attention Mechanism: Generalization and Optimization
von: Yao, Xinhao, et al.
Veröffentlicht: (2024)
von: Yao, Xinhao, et al.
Veröffentlicht: (2024)
Continual Learning with Query-Only Attention
von: Bekal, Gautham, et al.
Veröffentlicht: (2025)
von: Bekal, Gautham, et al.
Veröffentlicht: (2025)
Magnitude-Modulated Equivariant Adapter for Parameter-Efficient Fine-Tuning of Equivariant Graph Neural Networks
von: Jin, Dian, et al.
Veröffentlicht: (2025)
von: Jin, Dian, et al.
Veröffentlicht: (2025)
From Parameters to Data: A Task-Parameter-Guided Fine-Tuning Pipeline for Efficient LLM Alignment
von: Chen, Hao, et al.
Veröffentlicht: (2026)
von: Chen, Hao, et al.
Veröffentlicht: (2026)
Implicit Federated In-context Learning For Task-Specific LLM Fine-Tuning
von: Li, Dongcheng, et al.
Veröffentlicht: (2025)
von: Li, Dongcheng, et al.
Veröffentlicht: (2025)
Steering Language Models with Weight Arithmetic
von: Fierro, Constanza, et al.
Veröffentlicht: (2025)
von: Fierro, Constanza, et al.
Veröffentlicht: (2025)
MentalChat16K: A Benchmark Dataset for Conversational Mental Health Assistance
von: Xu, Jia, et al.
Veröffentlicht: (2025)
von: Xu, Jia, et al.
Veröffentlicht: (2025)
Offline RL by Reward-Weighted Fine-Tuning for Conversation Optimization
von: Mukherjee, Subhojyoti, et al.
Veröffentlicht: (2025)
von: Mukherjee, Subhojyoti, et al.
Veröffentlicht: (2025)
Quantum-Enhanced Multi-Task Learning with Learnable Weighting for Pharmacokinetic and Toxicity Prediction
von: Zhang, Han, et al.
Veröffentlicht: (2025)
von: Zhang, Han, et al.
Veröffentlicht: (2025)
SMoA: Spectrum Modulation Adapter for Parameter-Efficient Fine-Tuning
von: Liu, Yongkang, et al.
Veröffentlicht: (2026)
von: Liu, Yongkang, et al.
Veröffentlicht: (2026)
The 'Sure' Trap: Multi-Scale Poisoning Analysis of Stealthy Compliance-Only Backdoors in Fine-Tuned Large Language Models
von: Tan, Yuting, et al.
Veröffentlicht: (2025)
von: Tan, Yuting, et al.
Veröffentlicht: (2025)
Online Reward-Weighted Fine-Tuning of Flow Matching with Wasserstein Regularization
von: Fan, Jiajun, et al.
Veröffentlicht: (2025)
von: Fan, Jiajun, et al.
Veröffentlicht: (2025)
Continual Fine-Tuning with Provably Accurate and Parameter-Free Task Retrieval
von: Le, Hang Thi-Thuy, et al.
Veröffentlicht: (2026)
von: Le, Hang Thi-Thuy, et al.
Veröffentlicht: (2026)
LASPA: Language Agnostic Speaker Disentanglement with Prefix-Tuned Cross-Attention
von: Menon, Aditya Srinivas, et al.
Veröffentlicht: (2025)
von: Menon, Aditya Srinivas, et al.
Veröffentlicht: (2025)
Uniformly Stable Algorithms for Adversarial Training and Beyond
von: Xiao, Jiancong, et al.
Veröffentlicht: (2024)
von: Xiao, Jiancong, et al.
Veröffentlicht: (2024)
Multi-Task Model Merging via Adaptive Weight Disentanglement
von: Xiong, Feng, et al.
Veröffentlicht: (2024)
von: Xiong, Feng, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Restoring Calibration for Aligned Large Language Models: A Calibration-Aware Fine-Tuning Approach
von: Xiao, Jiancong, et al.
Veröffentlicht: (2025) -
A Semantic-Sampling Framework for Evaluating Calibration in Open-Ended Question Answering
von: Wang, Zhanliang, et al.
Veröffentlicht: (2026) -
ICAFS: Inter-Client-Aware Feature Selection for Vertical Federated Learning
von: Jin, Ruochen, et al.
Veröffentlicht: (2025) -
Bridging the Gap: Rademacher Complexity in Robust and Standard Generalization
von: Xiao, Jiancong, et al.
Veröffentlicht: (2024) -
Preserving Diversity in Supervised Fine-Tuning of Large Language Models
von: Li, Ziniu, et al.
Veröffentlicht: (2024)