Is Parameter Collision Hindering Continual Learning in LLMs?
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yang, Shuo, Ning, Kun-Peng, Liu, Yu-Yang, Yao, Jia-Yu, Tian, Yong-Hong, Song, Yi-Bing, Yuan, Li |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PiCO: Peer Review in LLMs based on the Consistency Optimization
par: Ning, Kun-Peng, et autres
Publié: (2024)
par: Ning, Kun-Peng, et autres
Publié: (2024)
Sparse Orthogonal Parameters Tuning for Continual Learning
par: Ning, Kun-Peng, et autres
Publié: (2024)
par: Ning, Kun-Peng, et autres
Publié: (2024)
Off-Policy Value-Based Reinforcement Learning for Large Language Models
par: Wang, Peng-Yuan, et autres
Publié: (2026)
par: Wang, Peng-Yuan, et autres
Publié: (2026)
Towards Self-Improvement of LLMs via MCTS: Leveraging Stepwise Knowledge with Curriculum Preference Learning
par: Wang, Xiyao, et autres
Publié: (2024)
par: Wang, Xiyao, et autres
Publié: (2024)
Toward Self-Improvement of LLMs via Imagination, Searching, and Criticizing
par: Tian, Ye, et autres
Publié: (2024)
par: Tian, Ye, et autres
Publié: (2024)
GNSP: Gradient Null Space Projection for Preserving Cross-Modal Alignment in VLMs Continual Learning
par: Peng, Tiantian, et autres
Publié: (2025)
par: Peng, Tiantian, et autres
Publié: (2025)
Supervised Learning and Large Language Model Benchmarks on Mental Health Datasets: Cognitive Distortions and Suicidal Risks in Chinese Social Media
par: Qi, Hongzhi, et autres
Publié: (2023)
par: Qi, Hongzhi, et autres
Publié: (2023)
Do LLMs Overcome Shortcut Learning? An Evaluation of Shortcut Challenges in Large Language Models
par: Yuan, Yu, et autres
Publié: (2024)
par: Yuan, Yu, et autres
Publié: (2024)
DOTS: Learning to Reason Dynamically in LLMs via Optimal Reasoning Trajectories Search
par: Yue, Murong, et autres
Publié: (2024)
par: Yue, Murong, et autres
Publié: (2024)
Step-DPO: Step-wise Preference Optimization for Long-chain Reasoning of LLMs
par: Lai, Xin, et autres
Publié: (2024)
par: Lai, Xin, et autres
Publié: (2024)
Do LLMs Recognize Your Preferences? Evaluating Personalized Preference Following in LLMs
par: Zhao, Siyan, et autres
Publié: (2025)
par: Zhao, Siyan, et autres
Publié: (2025)
Long Exposure: Accelerating Parameter-Efficient Fine-Tuning for LLMs under Shadowy Sparsity
par: Wang, Tuowei, et autres
Publié: (2025)
par: Wang, Tuowei, et autres
Publié: (2025)
GRASP: Replace Redundant Layers with Adaptive Singular Parameters for Efficient Model Compression
par: Liu, Kainan, et autres
Publié: (2024)
par: Liu, Kainan, et autres
Publié: (2024)
In-context Continual Learning Assisted by an External Continual Learner
par: Momeni, Saleh, et autres
Publié: (2024)
par: Momeni, Saleh, et autres
Publié: (2024)
Parameter-Efficient Fine-Tuning via Circular Convolution
par: Chen, Aochuan, et autres
Publié: (2024)
par: Chen, Aochuan, et autres
Publié: (2024)
ProxSparse: Regularized Learning of Semi-Structured Sparsity Masks for Pretrained LLMs
par: Liu, Hongyi, et autres
Publié: (2025)
par: Liu, Hongyi, et autres
Publié: (2025)
Flux Attention: Context-Aware Hybrid Attention for Efficient LLMs Inference
par: Qiu, Quantong, et autres
Publié: (2026)
par: Qiu, Quantong, et autres
Publié: (2026)
Position-Aware Parameter Efficient Fine-Tuning Approach for Reducing Positional Bias in LLMs
par: Zhang, Zheng, et autres
Publié: (2024)
par: Zhang, Zheng, et autres
Publié: (2024)
Examining Reasoning LLMs-as-Judges in Non-Verifiable LLM Post-Training
par: Liu, Yixin, et autres
Publié: (2026)
par: Liu, Yixin, et autres
Publié: (2026)
Basis Sharing: Cross-Layer Parameter Sharing for Large Language Model Compression
par: Wang, Jingcun, et autres
Publié: (2024)
par: Wang, Jingcun, et autres
Publié: (2024)
Parameter Importance is Not Static: Evolving Parameter Isolation for Supervised Fine-Tuning
par: Lin, Zekai, et autres
Publié: (2026)
par: Lin, Zekai, et autres
Publié: (2026)
ExpertWeaver: Unlocking the Inherent MoE in Dense LLMs with GLU Activation Patterns
par: Zhao, Ziyu, et autres
Publié: (2026)
par: Zhao, Ziyu, et autres
Publié: (2026)
BWArea Model: Learning World Model, Inverse Dynamics, and Policy for Controllable Language Generation
par: Jia, Chengxing, et autres
Publié: (2024)
par: Jia, Chengxing, et autres
Publié: (2024)
CP-Prompt: Composition-Based Cross-modal Prompting for Domain-Incremental Continual Learning
par: Feng, Yu, et autres
Publié: (2024)
par: Feng, Yu, et autres
Publié: (2024)
RigorLLM: Resilient Guardrails for Large Language Models against Undesired Content
par: Yuan, Zhuowen, et autres
Publié: (2024)
par: Yuan, Zhuowen, et autres
Publié: (2024)
Can we Soft Prompt LLMs for Graph Learning Tasks?
par: Liu, Zheyuan, et autres
Publié: (2024)
par: Liu, Zheyuan, et autres
Publié: (2024)
GSQ-Tuning: Group-Shared Exponents Integer in Fully Quantized Training for LLMs On-Device Fine-tuning
par: Zhou, Sifan, et autres
Publié: (2025)
par: Zhou, Sifan, et autres
Publié: (2025)
Pruning Weights but Not Truth: Safeguarding Truthfulness While Pruning LLMs
par: Fu, Yao, et autres
Publié: (2025)
par: Fu, Yao, et autres
Publié: (2025)
RLVR Training of LLMs Does Not Improve Thinking Ability for General QA: Evaluation Method and a Simple Solution
par: Li, Kaiyuan, et autres
Publié: (2026)
par: Li, Kaiyuan, et autres
Publié: (2026)
SVFit: Parameter-Efficient Fine-Tuning of Large Pre-Trained Models Using Singular Values
par: Sun, Chengwei, et autres
Publié: (2024)
par: Sun, Chengwei, et autres
Publié: (2024)
KeepKV: Achieving Periodic Lossless KV Cache Compression for Efficient LLM Inference
par: Tian, Yuxuan, et autres
Publié: (2025)
par: Tian, Yuxuan, et autres
Publié: (2025)
Lifelong and Continual Learning Dialogue Systems
par: Mazumder, Sahisnu, et autres
Publié: (2022)
par: Mazumder, Sahisnu, et autres
Publié: (2022)
QET: Enhancing Quantized LLM Parameters and KV cache Compression through Element Substitution and Residual Clustering
par: Wang, Yanshu, et autres
Publié: (2024)
par: Wang, Yanshu, et autres
Publié: (2024)
AI-Enhanced Cognitive Behavioral Therapy: Deep Learning and Large Language Models for Extracting Cognitive Pathways from Social Media Texts
par: Jiang, Meng, et autres
Publié: (2024)
par: Jiang, Meng, et autres
Publié: (2024)
Iterative Nash Policy Optimization: Aligning LLMs with General Preferences via No-Regret Learning
par: Zhang, Yuheng, et autres
Publié: (2024)
par: Zhang, Yuheng, et autres
Publié: (2024)
Graph-Based Spectral Decomposition for Parameter Coordination in Language Model Fine-Tuning
par: Zhang, Hanlu, et autres
Publié: (2025)
par: Zhang, Hanlu, et autres
Publié: (2025)
Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training
par: Yang, Kailai, et autres
Publié: (2025)
par: Yang, Kailai, et autres
Publié: (2025)
Enhancing the Code Reasoning Capabilities of LLMs via Consistency-based Reinforcement Learning
par: Qin, Zhanyue, et autres
Publié: (2026)
par: Qin, Zhanyue, et autres
Publié: (2026)
Twilight: Adaptive Attention Sparsity with Hierarchical Top-$p$ Pruning
par: Lin, Chaofan, et autres
Publié: (2025)
par: Lin, Chaofan, et autres
Publié: (2025)
Diffusion LMs Can Approximate Optimal Infilling Lengths Implicitly
par: Liu, Hengchang, et autres
Publié: (2026)
par: Liu, Hengchang, et autres
Publié: (2026)
Documents similaires
-
PiCO: Peer Review in LLMs based on the Consistency Optimization
par: Ning, Kun-Peng, et autres
Publié: (2024) -
Sparse Orthogonal Parameters Tuning for Continual Learning
par: Ning, Kun-Peng, et autres
Publié: (2024) -
Off-Policy Value-Based Reinforcement Learning for Large Language Models
par: Wang, Peng-Yuan, et autres
Publié: (2026) -
Towards Self-Improvement of LLMs via MCTS: Leveraging Stepwise Knowledge with Curriculum Preference Learning
par: Wang, Xiyao, et autres
Publié: (2024) -
Toward Self-Improvement of LLMs via Imagination, Searching, and Criticizing
par: Tian, Ye, et autres
Publié: (2024)