Unlocking Continual Learning Abilities in Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Du, Wenyu, Cheng, Shuang, Luo, Tongxu, Qiu, Zihan, Huang, Zeyu, Cheung, Ka Chun, Cheng, Reynold, Fu, Jie |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Stacking Your Transformers: A Closer Look at Model Growth for Efficient LLM Pre-Training
par: Du, Wenyu, et autres
Publié: (2024)
par: Du, Wenyu, et autres
Publié: (2024)
Unlocking Emergent Modularity in Large Language Models
par: Qiu, Zihan, et autres
Publié: (2023)
par: Qiu, Zihan, et autres
Publié: (2023)
Towards Understanding Fine-Tuning Mechanisms of LLMs via Circuit Analysis
par: Wang, Xu, et autres
Publié: (2025)
par: Wang, Xu, et autres
Publié: (2025)
Learning from Failures in Multi-Attempt Reinforcement Learning
par: Chung, Stephen, et autres
Publié: (2025)
par: Chung, Stephen, et autres
Publié: (2025)
Improving Interactive Diagnostic Ability of a Large Language Model Agent Through Clinical Experience Learning
par: Sun, Zhoujian, et autres
Publié: (2025)
par: Sun, Zhoujian, et autres
Publié: (2025)
LogicGame: Benchmarking Rule-Based Reasoning Abilities of Large Language Models
par: Gui, Jiayi, et autres
Publié: (2024)
par: Gui, Jiayi, et autres
Publié: (2024)
Adaptive Ability Decomposing for Unlocking Large Reasoning Model Effective Reinforcement Learning
par: Chen, Zhipeng, et autres
Publié: (2026)
par: Chen, Zhipeng, et autres
Publié: (2026)
DiffuSpec: Unlocking Diffusion Language Models for Speculative Decoding
par: Li, Guanghao, et autres
Publié: (2025)
par: Li, Guanghao, et autres
Publié: (2025)
Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models
par: Liu, Zeyu, et autres
Publié: (2025)
par: Liu, Zeyu, et autres
Publié: (2025)
Understanding Emergent Abilities of Language Models from the Loss Perspective
par: Du, Zhengxiao, et autres
Publié: (2024)
par: Du, Zhengxiao, et autres
Publié: (2024)
Emergent Abilities of Large Language Models under Continued Pretraining for Language Adaptation
par: Elhady, Ahmed, et autres
Publié: (2025)
par: Elhady, Ahmed, et autres
Publié: (2025)
Continual Learning Using Only Large Language Model Prompting
par: Qiu, Jiabao, et autres
Publié: (2024)
par: Qiu, Jiabao, et autres
Publié: (2024)
Post-hoc Reward Calibration: A Case Study on Length Bias
par: Huang, Zeyu, et autres
Publié: (2024)
par: Huang, Zeyu, et autres
Publié: (2024)
Eliciting Causal Abilities in Large Language Models for Reasoning Tasks
par: Wang, Yajing, et autres
Publié: (2024)
par: Wang, Yajing, et autres
Publié: (2024)
UloRL:An Ultra-Long Output Reinforcement Learning Approach for Advancing Large Language Models' Reasoning Abilities
par: Du, Dong, et autres
Publié: (2025)
par: Du, Dong, et autres
Publié: (2025)
Legal Documents Drafting with Fine-Tuned Pre-Trained Large Language Model
par: Lin, Chun-Hsien, et autres
Publié: (2024)
par: Lin, Chun-Hsien, et autres
Publié: (2024)
Hallucination Detection with Small Language Models
par: Cheung, Ming
Publié: (2025)
par: Cheung, Ming
Publié: (2025)
Blending Supervised and Reinforcement Fine-Tuning with Prefix Sampling
par: Huang, Zeyu, et autres
Publié: (2025)
par: Huang, Zeyu, et autres
Publié: (2025)
Unlocking the Potential of Model Merging for Low-Resource Languages
par: Tao, Mingxu, et autres
Publié: (2024)
par: Tao, Mingxu, et autres
Publié: (2024)
A Closer Look into Mixture-of-Experts in Large Language Models
par: Lo, Ka Man, et autres
Publié: (2024)
par: Lo, Ka Man, et autres
Publié: (2024)
Conversational Disease Diagnosis via External Planner-Controlled Large Language Models
par: Sun, Zhoujian, et autres
Publié: (2024)
par: Sun, Zhoujian, et autres
Publié: (2024)
RoleLLM: Benchmarking, Eliciting, and Enhancing Role-Playing Abilities of Large Language Models
par: Wang, Zekun Moore, et autres
Publié: (2023)
par: Wang, Zekun Moore, et autres
Publié: (2023)
Chinese ModernBERT with Whole-Word Masking
par: Zhao, Zeyu, et autres
Publié: (2025)
par: Zhao, Zeyu, et autres
Publié: (2025)
Orca: Enhancing Role-Playing Abilities of Large Language Models by Integrating Personality Traits
par: Huang, Yuxuan
Publié: (2024)
par: Huang, Yuxuan
Publié: (2024)
Safe Inputs but Unsafe Output: Benchmarking Cross-modality Safety Alignment of Large Vision-Language Model
par: Wang, Siyin, et autres
Publié: (2024)
par: Wang, Siyin, et autres
Publié: (2024)
Thinker: Learning to Think Fast and Slow
par: Chung, Stephen, et autres
Publié: (2025)
par: Chung, Stephen, et autres
Publié: (2025)
Understanding the Dilemma of Unlearning for Large Language Models
par: Zhang, Qingjie, et autres
Publié: (2025)
par: Zhang, Qingjie, et autres
Publié: (2025)
From Drafts to Answers: Unlocking LLM Potential via Aggregation Fine-Tuning
par: Li, Yafu, et autres
Publié: (2025)
par: Li, Yafu, et autres
Publié: (2025)
FinDABench: Benchmarking Financial Data Analysis Ability of Large Language Models
par: Liu, Shu, et autres
Publié: (2024)
par: Liu, Shu, et autres
Publié: (2024)
Learning to Compress: Unlocking the Potential of Large Language Models for Text Representation
par: Zhang, Yeqin, et autres
Publié: (2025)
par: Zhang, Yeqin, et autres
Publié: (2025)
Step-by-Step Mastery: Enhancing Soft Constraint Following Ability of Large Language Models
par: Ren, Qingyu, et autres
Publié: (2025)
par: Ren, Qingyu, et autres
Publié: (2025)
LogicBench: Towards Systematic Evaluation of Logical Reasoning Ability of Large Language Models
par: Parmar, Mihir, et autres
Publié: (2024)
par: Parmar, Mihir, et autres
Publié: (2024)
Segment Policy Optimization: Effective Segment-Level Credit Assignment in RL for Large Language Models
par: Guo, Yiran, et autres
Publié: (2025)
par: Guo, Yiran, et autres
Publié: (2025)
Do Large Language Models Need a Content Delivery Network?
par: Cheng, Yihua, et autres
Publié: (2024)
par: Cheng, Yihua, et autres
Publié: (2024)
Making Pre-trained Language Models Better Continual Few-Shot Relation Extractors
par: Ma, Shengkun, et autres
Publié: (2024)
par: Ma, Shengkun, et autres
Publié: (2024)
ROPO: Robust Preference Optimization for Large Language Models
par: Liang, Xize, et autres
Publié: (2024)
par: Liang, Xize, et autres
Publié: (2024)
Counting Ability of Large Language Models and Impact of Tokenization
par: Zhang, Xiang, et autres
Publié: (2024)
par: Zhang, Xiang, et autres
Publié: (2024)
BitDecoding: Unlocking Tensor Cores for Long-Context LLMs with Low-Bit KV Cache
par: Du, Dayou, et autres
Publié: (2025)
par: Du, Dayou, et autres
Publié: (2025)
ZeroTuning: Unlocking the Initial Token's Power to Enhance Large Language Models Without Training
par: Han, Feijiang, et autres
Publié: (2025)
par: Han, Feijiang, et autres
Publié: (2025)
Exposing Numeracy Gaps: A Benchmark to Evaluate Fundamental Numerical Abilities in Large Language Models
par: Li, Haoyang, et autres
Publié: (2025)
par: Li, Haoyang, et autres
Publié: (2025)
Documents similaires
-
Stacking Your Transformers: A Closer Look at Model Growth for Efficient LLM Pre-Training
par: Du, Wenyu, et autres
Publié: (2024) -
Unlocking Emergent Modularity in Large Language Models
par: Qiu, Zihan, et autres
Publié: (2023) -
Towards Understanding Fine-Tuning Mechanisms of LLMs via Circuit Analysis
par: Wang, Xu, et autres
Publié: (2025) -
Learning from Failures in Multi-Attempt Reinforcement Learning
par: Chung, Stephen, et autres
Publié: (2025) -
Improving Interactive Diagnostic Ability of a Large Language Model Agent Through Clinical Experience Learning
par: Sun, Zhoujian, et autres
Publié: (2025)