DATA: Decomposed Attention-based Task Adaptation for Rehearsal-Free Continual Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Liao, Huanxuan, He, Shizhu, Hao, Yupu, Zhao, Jun, Liu, Kang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
SparK: Query-Aware Unstructured Sparsity with Recoverable KV Cache Channel Pruning
por: Liao, Huanxuan, et al.
Publicado: (2025)
por: Liao, Huanxuan, et al.
Publicado: (2025)
Dynamic Parametric Retrieval Augmented Generation for Test-time Knowledge Enhancement
por: Tan, Yuqiao, et al.
Publicado: (2025)
por: Tan, Yuqiao, et al.
Publicado: (2025)
ResAdapt: Adaptive Resolution for Efficient Multimodal Reasoning
por: Liao, Huanxuan, et al.
Publicado: (2026)
por: Liao, Huanxuan, et al.
Publicado: (2026)
Beyond Hard and Soft: Hybrid Context Compression for Balancing Local and Global Information Retention
por: Liao, Huanxuan, et al.
Publicado: (2025)
por: Liao, Huanxuan, et al.
Publicado: (2025)
From $P(y|x)$ to $P(y)$: Investigating Reinforcement Learning in Pre-train Space
por: Tan, Yuqiao, et al.
Publicado: (2026)
por: Tan, Yuqiao, et al.
Publicado: (2026)
PromptDSI: Prompt-based Rehearsal-free Continual Learning for Document Retrieval
por: Huynh, Tuan-Luc, et al.
Publicado: (2024)
por: Huynh, Tuan-Luc, et al.
Publicado: (2024)
DESIRE: Dynamic Knowledge Consolidation for Rehearsal-Free Continual Learning
por: Guo, Haiyang, et al.
Publicado: (2024)
por: Guo, Haiyang, et al.
Publicado: (2024)
LLaSA: Large Language and Structured Data Assistant
por: Xu, Yao, et al.
Publicado: (2024)
por: Xu, Yao, et al.
Publicado: (2024)
Shuttle Between the Instructions and the Parameters of Large Language Models
por: Sun, Wangtao, et al.
Publicado: (2025)
por: Sun, Wangtao, et al.
Publicado: (2025)
3DS: Medical Domain Adaptation of LLMs via Decomposed Difficulty-based Data Selection
por: Ding, Hongxin, et al.
Publicado: (2024)
por: Ding, Hongxin, et al.
Publicado: (2024)
MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning
por: Feng, Zhaopeng, et al.
Publicado: (2025)
por: Feng, Zhaopeng, et al.
Publicado: (2025)
Keep Rehearsing and Refining: Lifelong Learning Vehicle Routing under Continually Drifting Tasks
por: Pei, Jiyuan, et al.
Publicado: (2026)
por: Pei, Jiyuan, et al.
Publicado: (2026)
$\textit{SKIntern}$: Internalizing Symbolic Knowledge for Distilling Better CoT Capabilities into Small Language Models
por: Liao, Huanxuan, et al.
Publicado: (2024)
por: Liao, Huanxuan, et al.
Publicado: (2024)
Decomposing Attention To Find Context-Sensitive Neurons
por: Gibson, Alex
Publicado: (2025)
por: Gibson, Alex
Publicado: (2025)
MTL-LoRA: Low-Rank Adaptation for Multi-Task Learning
por: Yang, Yaming, et al.
Publicado: (2024)
por: Yang, Yaming, et al.
Publicado: (2024)
DSLR: Diversity Enhancement and Structure Learning for Rehearsal-based Graph Continual Learning
por: Choi, Seungyoon, et al.
Publicado: (2024)
por: Choi, Seungyoon, et al.
Publicado: (2024)
ExpNote: Black-box Large Language Models are Better Task Solvers with Experience Notebook
por: Sun, Wangtao, et al.
Publicado: (2023)
por: Sun, Wangtao, et al.
Publicado: (2023)
LaMDA: Large Model Fine-Tuning via Spectrally Decomposed Low-Dimensional Adaptation
por: Azizi, Seyedarmin, et al.
Publicado: (2024)
por: Azizi, Seyedarmin, et al.
Publicado: (2024)
EDoRA: Efficient Weight-Decomposed Low-Rank Adaptation via Singular Value Decomposition
por: Nasiri, Hamid, et al.
Publicado: (2025)
por: Nasiri, Hamid, et al.
Publicado: (2025)
REP: Resource-Efficient Prompting for Rehearsal-Free Continual Learning
por: Jeon, Sungho, et al.
Publicado: (2024)
por: Jeon, Sungho, et al.
Publicado: (2024)
Decomposing Representation Space into Interpretable Subspaces with Unsupervised Learning
por: Huang, Xinting, et al.
Publicado: (2025)
por: Huang, Xinting, et al.
Publicado: (2025)
PROL : Rehearsal Free Continual Learning in Streaming Data via Prompt Online Learning
por: Ma'sum, M. Anwar, et al.
Publicado: (2025)
por: Ma'sum, M. Anwar, et al.
Publicado: (2025)
The Zero-Step Thinking: An Empirical Study of Mode Selection as Harder Early Exit in Reasoning Models
por: Tan, Yuqiao, et al.
Publicado: (2025)
por: Tan, Yuqiao, et al.
Publicado: (2025)
Neural Incompatibility: The Unbridgeable Gap of Cross-Scale Parametric Knowledge Transfer in Large Language Models
por: Tan, Yuqiao, et al.
Publicado: (2025)
por: Tan, Yuqiao, et al.
Publicado: (2025)
Mixtures of SubExperts for Large Language Continual Learning
por: Kang, Haeyong
Publicado: (2025)
por: Kang, Haeyong
Publicado: (2025)
Selective Self-Rehearsal: A Fine-Tuning Approach to Improve Generalization in Large Language Models
por: Gupta, Sonam, et al.
Publicado: (2024)
por: Gupta, Sonam, et al.
Publicado: (2024)
Task-Stratified Knowledge Scaling Laws for Post-Training Quantized Large Language Models
por: Zhou, Chenxi, et al.
Publicado: (2025)
por: Zhou, Chenxi, et al.
Publicado: (2025)
GaLore$+$: Boosting Low-Rank Adaptation for LLMs with Cross-Head Projection
por: Liao, Xutao, et al.
Publicado: (2024)
por: Liao, Xutao, et al.
Publicado: (2024)
Continual Diffuser (CoD): Mastering Continual Offline Reinforcement Learning with Experience Rehearsal
por: Hu, Jifeng, et al.
Publicado: (2024)
por: Hu, Jifeng, et al.
Publicado: (2024)
HOP to the Next Tasks and Domains for Continual Learning in NLP
por: Michieli, Umberto, et al.
Publicado: (2024)
por: Michieli, Umberto, et al.
Publicado: (2024)
Neural-Symbolic Collaborative Distillation: Advancing Small Language Models for Complex Reasoning Tasks
por: Liao, Huanxuan, et al.
Publicado: (2024)
por: Liao, Huanxuan, et al.
Publicado: (2024)
CASCADE: Case-Based Continual Adaptation for Large Language Models During Deployment
por: Guo, Siyuan, et al.
Publicado: (2026)
por: Guo, Siyuan, et al.
Publicado: (2026)
InfLLM-V2: Dense-Sparse Switchable Attention for Seamless Short-to-Long Adaptation
por: Zhao, Weilin, et al.
Publicado: (2025)
por: Zhao, Weilin, et al.
Publicado: (2025)
Decomposing and Measuring Evaluation Awareness
por: Li, Changling, et al.
Publicado: (2026)
por: Li, Changling, et al.
Publicado: (2026)
SPARC: Subspace-Aware Prompt Adaptation for Robust Continual Learning in LLMs
por: Jayasuriya, Dinithi, et al.
Publicado: (2025)
por: Jayasuriya, Dinithi, et al.
Publicado: (2025)
A Survey of LLM $\times$ DATA
por: Zhou, Xuanhe, et al.
Publicado: (2025)
por: Zhou, Xuanhe, et al.
Publicado: (2025)
More Expressive Attention with Negative Weights
por: Lv, Ang, et al.
Publicado: (2024)
por: Lv, Ang, et al.
Publicado: (2024)
RLAC: Reinforcement Learning with Adversarial Critic for Free-Form Generation Tasks
por: Wu, Mian, et al.
Publicado: (2025)
por: Wu, Mian, et al.
Publicado: (2025)
From Instance Training to Instruction Learning: Task Adapters Generation from Instructions
por: Liao, Huanxuan, et al.
Publicado: (2024)
por: Liao, Huanxuan, et al.
Publicado: (2024)
FOREVER: Forgetting Curve-Inspired Memory Replay for Language Model Continual Learning
por: Feng, Yujie, et al.
Publicado: (2026)
por: Feng, Yujie, et al.
Publicado: (2026)
Ejemplares similares
-
SparK: Query-Aware Unstructured Sparsity with Recoverable KV Cache Channel Pruning
por: Liao, Huanxuan, et al.
Publicado: (2025) -
Dynamic Parametric Retrieval Augmented Generation for Test-time Knowledge Enhancement
por: Tan, Yuqiao, et al.
Publicado: (2025) -
ResAdapt: Adaptive Resolution for Efficient Multimodal Reasoning
por: Liao, Huanxuan, et al.
Publicado: (2026) -
Beyond Hard and Soft: Hybrid Context Compression for Balancing Local and Global Information Retention
por: Liao, Huanxuan, et al.
Publicado: (2025) -
From $P(y|x)$ to $P(y)$: Investigating Reinforcement Learning in Pre-train Space
por: Tan, Yuqiao, et al.
Publicado: (2026)