Leveraging Submodule Linearity Enhances Task Arithmetic Performance in LLMs
Fuente:
arXiv
Saved in:
| Main Authors: | Dai, Rui, Hu, Sile, Shen, Xu, Zhang, Yonggang, Tian, Xinmei, Ye, Jieping |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Interpreting and Improving Large Language Models in Arithmetic Calculation
by: Zhang, Wei, et al.
Published: (2024)
by: Zhang, Wei, et al.
Published: (2024)
Robust Training of Federated Models with Extremely Label Deficiency
by: Zhang, Yonggang, et al.
Published: (2024)
by: Zhang, Yonggang, et al.
Published: (2024)
Fine-Tuning Attention Modules Only: Enhancing Weight Disentanglement in Task Arithmetic
by: Jin, Ruochen, et al.
Published: (2024)
by: Jin, Ruochen, et al.
Published: (2024)
TokenSqueeze: Performance-Preserving Compression for Reasoning LLMs
by: Zhang, Yuxiang, et al.
Published: (2025)
by: Zhang, Yuxiang, et al.
Published: (2025)
Distilling Linearized Behavior into Non-Linear Fine-Tuning for Effective Task Arithmetic
by: Sommariva, Thomas, et al.
Published: (2026)
by: Sommariva, Thomas, et al.
Published: (2026)
Beyond Task Vectors: Selective Task Arithmetic Based on Importance Metrics
by: Bowen, Tian, et al.
Published: (2024)
by: Bowen, Tian, et al.
Published: (2024)
Per-parameter Task Arithmetic for Unlearning in Large Language Models
by: Cai, Chengyi, et al.
Published: (2026)
by: Cai, Chengyi, et al.
Published: (2026)
On Fairness of Task Arithmetic: The Role of Task Vectors
by: Naganuma, Hiroki, et al.
Published: (2025)
by: Naganuma, Hiroki, et al.
Published: (2025)
Principled Understanding of Generalization for Generative Transformer Models in Arithmetic Reasoning Tasks
by: Xu, Xingcheng, et al.
Published: (2024)
by: Xu, Xingcheng, et al.
Published: (2024)
CATA: Continual Machine Unlearning via Conflict-Averse Task Arithmetic
by: Lin, Shen, et al.
Published: (2026)
by: Lin, Shen, et al.
Published: (2026)
FedImpro: Measuring and Improving Client Update in Federated Learning
by: Tang, Zhenheng, et al.
Published: (2024)
by: Tang, Zhenheng, et al.
Published: (2024)
Boosting Fair Classifier Generalization through Adaptive Priority Reweighing
by: Hu, Zhihao, et al.
Published: (2023)
by: Hu, Zhihao, et al.
Published: (2023)
Conformalized Interval Arithmetic with Symmetric Calibration
by: Luo, Rui, et al.
Published: (2024)
by: Luo, Rui, et al.
Published: (2024)
Latte: Transfering LLMs` Latent-level Knowledge for Few-shot Tabular Learning
by: Shi, Ruxue, et al.
Published: (2025)
by: Shi, Ruxue, et al.
Published: (2025)
Task Vector Bases: A Unified and Scalable Framework for Compressed Task Arithmetic
by: Zeng, Siqi, et al.
Published: (2025)
by: Zeng, Siqi, et al.
Published: (2025)
Enhancing One-Shot Federated Learning Through Data and Ensemble Co-Boosting
by: Dai, Rong, et al.
Published: (2024)
by: Dai, Rong, et al.
Published: (2024)
MOSS: Self-Evolution through Source-Level Rewriting in Autonomous Agent Systems
by: Cai, Qianshu, et al.
Published: (2026)
by: Cai, Qianshu, et al.
Published: (2026)
LPCD: Unified Framework from Layer-Wise to Submodule Quantization
by: Ichikawa, Yuma, et al.
Published: (2025)
by: Ichikawa, Yuma, et al.
Published: (2025)
RevOrder: A Novel Method for Enhanced Arithmetic in Language Models
by: Shen, Si, et al.
Published: (2024)
by: Shen, Si, et al.
Published: (2024)
Language Models Do Hard Arithmetic Tasks Easily and Hardly Do Easy Arithmetic Tasks
by: Gambardella, Andrew, et al.
Published: (2024)
by: Gambardella, Andrew, et al.
Published: (2024)
Task Arithmetic Through The Lens Of One-Shot Federated Learning
by: Tao, Zhixu Silvia, et al.
Published: (2024)
by: Tao, Zhixu Silvia, et al.
Published: (2024)
Differentiation of Multi-objective Data-driven Decision Pipeline
by: Li, Peng, et al.
Published: (2024)
by: Li, Peng, et al.
Published: (2024)
HRP: High-Rank Preheating for Superior LoRA Initialization
by: Chen, Yuzhu, et al.
Published: (2025)
by: Chen, Yuzhu, et al.
Published: (2025)
Provable In-Context Vector Arithmetic via Retrieving Task Concepts
by: Bu, Dake, et al.
Published: (2025)
by: Bu, Dake, et al.
Published: (2025)
Localize-and-Stitch: Efficient Model Merging via Sparse Task Arithmetic
by: He, Yifei, et al.
Published: (2024)
by: He, Yifei, et al.
Published: (2024)
One Model for All Tasks: Leveraging Efficient World Models in Multi-Task Planning
by: Pu, Yuan, et al.
Published: (2025)
by: Pu, Yuan, et al.
Published: (2025)
SAC-KG: Exploiting Large Language Models as Skilled Automatic Constructors for Domain Knowledge Graphs
by: Chen, Hanzhu, et al.
Published: (2024)
by: Chen, Hanzhu, et al.
Published: (2024)
Leveraging Semi-Supervised Learning to Enhance Data Mining for Image Classification under Limited Labeled Data
by: Shen, Aoran, et al.
Published: (2024)
by: Shen, Aoran, et al.
Published: (2024)
Towards Enhanced RAC Accessibility: Leveraging Datasets and LLMs
by: Sepulveda, Edison Jair Bejarano, et al.
Published: (2024)
by: Sepulveda, Edison Jair Bejarano, et al.
Published: (2024)
Towards Theoretical Understandings of Self-Consuming Generative Models
by: Fu, Shi, et al.
Published: (2024)
by: Fu, Shi, et al.
Published: (2024)
Leveraging Auxiliary Task Relevance for Enhanced Bearing Fault Diagnosis through Curriculum Meta-learning
by: Wang, Jinze, et al.
Published: (2024)
by: Wang, Jinze, et al.
Published: (2024)
Enhancing Bandit Algorithms with LLMs for Time-varying User Preferences in Streaming Recommendations
by: Shen, Chenglei, et al.
Published: (2026)
by: Shen, Chenglei, et al.
Published: (2026)
Cluster-Based Client Selection for Dependent Multi-Task Federated Learning in Edge Computing
by: Luo, Jieping, et al.
Published: (2025)
by: Luo, Jieping, et al.
Published: (2025)
Layer-Aware Task Arithmetic: Disentangling Task-Specific and Instruction-Following Knowledge
by: Chen, Yan-Lun, et al.
Published: (2025)
by: Chen, Yan-Lun, et al.
Published: (2025)
Enhancing Target-unspecific Tasks through a Features Matrix
by: Cui, Fangming, et al.
Published: (2025)
by: Cui, Fangming, et al.
Published: (2025)
Using GPUs And LLMs Can Be Satisfying for Nonlinear Real Arithmetic Problems
by: Brix, Christopher, et al.
Published: (2026)
by: Brix, Christopher, et al.
Published: (2026)
MaskPro: Linear-Space Probabilistic Learning for Strict (N:M)-Sparsity on LLMs
by: Sun, Yan, et al.
Published: (2025)
by: Sun, Yan, et al.
Published: (2025)
SC2Arena and StarEvolve: Benchmark and Self-Improvement Framework for LLMs in Complex Decision-Making Tasks
by: Shen, Pengbo, et al.
Published: (2025)
by: Shen, Pengbo, et al.
Published: (2025)
TrajCogn: Leveraging LLMs for Cognizing Movement Patterns and Travel Purposes from Trajectories
by: Zhou, Zeyu, et al.
Published: (2024)
by: Zhou, Zeyu, et al.
Published: (2024)
AutoTriton: Automatic Triton Programming with Reinforcement Learning in LLMs
by: Li, Shangzhan, et al.
Published: (2025)
by: Li, Shangzhan, et al.
Published: (2025)
Similar Items
-
Interpreting and Improving Large Language Models in Arithmetic Calculation
by: Zhang, Wei, et al.
Published: (2024) -
Robust Training of Federated Models with Extremely Label Deficiency
by: Zhang, Yonggang, et al.
Published: (2024) -
Fine-Tuning Attention Modules Only: Enhancing Weight Disentanglement in Task Arithmetic
by: Jin, Ruochen, et al.
Published: (2024) -
TokenSqueeze: Performance-Preserving Compression for Reasoning LLMs
by: Zhang, Yuxiang, et al.
Published: (2025) -
Distilling Linearized Behavior into Non-Linear Fine-Tuning for Effective Task Arithmetic
by: Sommariva, Thomas, et al.
Published: (2026)