Towards a General Framework for Continual Learning with Pre-training
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Liyuan, Xie, Jingyi, Zhang, Xingxing, Su, Hang, Zhu, Jun |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
HiDe-PET: Continual Learning via Hierarchical Decomposition of Parameter-Efficient Tuning
par: Wang, Liyuan, et autres
Publié: (2024)
par: Wang, Liyuan, et autres
Publié: (2024)
A Comprehensive Survey of Continual Learning: Theory, Method and Application
par: Wang, Liyuan, et autres
Publié: (2023)
par: Wang, Liyuan, et autres
Publié: (2023)
PEAC: Unsupervised Pre-training for Cross-Embodiment Reinforcement Learning
par: Ying, Chengyang, et autres
Publié: (2024)
par: Ying, Chengyang, et autres
Publié: (2024)
Safety Alignment as Continual Learning: Mitigating the Alignment Tax via Orthogonal Gradient Projection
par: Sun, Guanglong, et autres
Publié: (2026)
par: Sun, Guanglong, et autres
Publié: (2026)
SLCA++: Unleash the Power of Sequential Fine-tuning for Continual Learning with Pre-training
par: Zhang, Gengwei, et autres
Publié: (2024)
par: Zhang, Gengwei, et autres
Publié: (2024)
Generative Large-Scale Pre-trained Models for Automated Ad Bidding Optimization
par: Lei, Yu, et autres
Publié: (2025)
par: Lei, Yu, et autres
Publié: (2025)
S-STE: Continuous Pruning Function for Efficient 2:4 Sparse Pre-training
par: Hu, Yuezhou, et autres
Publié: (2024)
par: Hu, Yuezhou, et autres
Publié: (2024)
CLDyB: Towards Dynamic Benchmarking for Continual Learning with Pre-trained Models
par: Chen, Shengzhuang, et autres
Publié: (2025)
par: Chen, Shengzhuang, et autres
Publié: (2025)
Caption, Create, Continue: Continual Learning with Pre-trained Generative Vision-Language Models
par: Solomon, Indu, et autres
Publié: (2024)
par: Solomon, Indu, et autres
Publié: (2024)
Fourier Controller Networks for Real-Time Decision-Making in Embodied Learning
par: Tan, Hengkai, et autres
Publié: (2024)
par: Tan, Hengkai, et autres
Publié: (2024)
ManiBox: Enhancing Embodied Spatial Generalization via Scalable Simulation Data Generations
par: Tan, Hengkai, et autres
Publié: (2024)
par: Tan, Hengkai, et autres
Publié: (2024)
Aligning Diffusion Behaviors with Q-functions for Efficient Continuous Control
par: Chen, Huayu, et autres
Publié: (2024)
par: Chen, Huayu, et autres
Publié: (2024)
WirelessGPT: A Generative Pre-trained Multi-task Learning Framework for Wireless Communication
par: Yang, Tingting, et autres
Publié: (2025)
par: Yang, Tingting, et autres
Publié: (2025)
Towards Pre-trained Graph Condensation via Optimal Transport
par: Yan, Yeyu, et autres
Publié: (2025)
par: Yan, Yeyu, et autres
Publié: (2025)
MUON+: Towards More Effective Muon via One Additional Normalization Step for LLM Pre-training
par: Zhang, Ruijie, et autres
Publié: (2026)
par: Zhang, Ruijie, et autres
Publié: (2026)
PACE: Pretrained Audio Continual Learning
par: Li, Chang, et autres
Publié: (2026)
par: Li, Chang, et autres
Publié: (2026)
Continual-NExT: A Unified Comprehension And Generation Continual Learning Framework
par: Qiao, Jingyang, et autres
Publié: (2026)
par: Qiao, Jingyang, et autres
Publié: (2026)
Practical Continual Forgetting for Pre-trained Vision Models
par: Zhao, Hongbo, et autres
Publié: (2025)
par: Zhao, Hongbo, et autres
Publié: (2025)
On the Usage of Continual Learning for Out-of-Distribution Generalization in Pre-trained Language Models of Code
par: Weyssow, Martin, et autres
Publié: (2023)
par: Weyssow, Martin, et autres
Publié: (2023)
Do Pre-trained Models Benefit Equally in Continual Learning?
par: Lee, Kuan-Ying, et autres
Publié: (2022)
par: Lee, Kuan-Ying, et autres
Publié: (2022)
Accelerating Transformer Pre-training with 2:4 Sparsity
par: Hu, Yuezhou, et autres
Publié: (2024)
par: Hu, Yuezhou, et autres
Publié: (2024)
On the Blessing of Pre-training in Weak-to-Strong Generalization
par: Yao, Wei, et autres
Publié: (2026)
par: Yao, Wei, et autres
Publié: (2026)
Towards the Worst-case Robustness of Large Language Models
par: Chen, Huanran, et autres
Publié: (2025)
par: Chen, Huanran, et autres
Publié: (2025)
NetMamba+: A Framework of Pre-trained Models for Efficient and Accurate Network Traffic Classification
par: Wang, Tongze, et autres
Publié: (2026)
par: Wang, Tongze, et autres
Publié: (2026)
Self-Expansion of Pre-trained Models with Mixture of Adapters for Continual Learning
par: Wang, Huiyi, et autres
Publié: (2024)
par: Wang, Huiyi, et autres
Publié: (2024)
Toward Guidance-Free AR Visual Generation via Condition Contrastive Alignment
par: Chen, Huayu, et autres
Publié: (2024)
par: Chen, Huayu, et autres
Publié: (2024)
Beyond Cosine Decay: On the effectiveness of Infinite Learning Rate Schedule for Continual Pre-training
par: Singh, Vaibhav, et autres
Publié: (2025)
par: Singh, Vaibhav, et autres
Publié: (2025)
Bidirectional Generative Pre-training for Improving Healthcare Time-series Representation Learning
par: Song, Ziyang, et autres
Publié: (2024)
par: Song, Ziyang, et autres
Publié: (2024)
Towards Safe Reinforcement Learning via Constraining Conditional Value-at-Risk
par: Ying, Chengyang, et autres
Publié: (2022)
par: Ying, Chengyang, et autres
Publié: (2022)
C-LoRA: Continual Low-Rank Adaptation for Pre-trained Models
par: Zhang, Xin, et autres
Publié: (2025)
par: Zhang, Xin, et autres
Publié: (2025)
Transfer Learning with Pre-trained Conditional Generative Models
par: Yamaguchi, Shin'ya, et autres
Publié: (2022)
par: Yamaguchi, Shin'ya, et autres
Publié: (2022)
Realistic Continual Learning Approach using Pre-trained Models
par: Nasri, Nadia, et autres
Publié: (2024)
par: Nasri, Nadia, et autres
Publié: (2024)
Graph Generative Pre-trained Transformer
par: Chen, Xiaohui, et autres
Publié: (2025)
par: Chen, Xiaohui, et autres
Publié: (2025)
Task Aware Dreamer for Task Generalization in Reinforcement Learning
par: Ying, Chengyang, et autres
Publié: (2023)
par: Ying, Chengyang, et autres
Publié: (2023)
Timer: Generative Pre-trained Transformers Are Large Time Series Models
par: Liu, Yong, et autres
Publié: (2024)
par: Liu, Yong, et autres
Publié: (2024)
MIPS: a Multimodal Infinite Polymer Sequence Pre-training Framework for Polymer Property Prediction
par: Wang, Jiaxi, et autres
Publié: (2025)
par: Wang, Jiaxi, et autres
Publié: (2025)
RelPrism: A Multi-Faceted Pre-training Framework with Self-Generated Tasks for Relational Databases
par: Yang, Jinyu, et autres
Publié: (2026)
par: Yang, Jinyu, et autres
Publié: (2026)
An Efficient Replay for Class-Incremental Learning with Pre-trained Models
par: Yin, Weimin, et autres
Publié: (2024)
par: Yin, Weimin, et autres
Publié: (2024)
Continual Learning with Pre-Trained Models: A Survey
par: Zhou, Da-Wei, et autres
Publié: (2024)
par: Zhou, Da-Wei, et autres
Publié: (2024)
GraphControl: Adding Conditional Control to Universal Graph Pre-trained Models for Graph Domain Transfer Learning
par: Zhu, Yun, et autres
Publié: (2023)
par: Zhu, Yun, et autres
Publié: (2023)
Documents similaires
-
HiDe-PET: Continual Learning via Hierarchical Decomposition of Parameter-Efficient Tuning
par: Wang, Liyuan, et autres
Publié: (2024) -
A Comprehensive Survey of Continual Learning: Theory, Method and Application
par: Wang, Liyuan, et autres
Publié: (2023) -
PEAC: Unsupervised Pre-training for Cross-Embodiment Reinforcement Learning
par: Ying, Chengyang, et autres
Publié: (2024) -
Safety Alignment as Continual Learning: Mitigating the Alignment Tax via Orthogonal Gradient Projection
par: Sun, Guanglong, et autres
Publié: (2026) -
SLCA++: Unleash the Power of Sequential Fine-tuning for Continual Learning with Pre-training
par: Zhang, Gengwei, et autres
Publié: (2024)