Curriculum Learning for LLM Pretraining: An Analysis of Learning Dynamics
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Elgaar, Mohamed, Amiri, Hadi |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
HuCurl: Human-induced Curriculum Discovery
par: Elgaar, Mohamed, et autres
Publié: (2023)
par: Elgaar, Mohamed, et autres
Publié: (2023)
Linguistic Blind Spots in Clinical Decision Extraction
par: Elgaar, Mohamed, et autres
Publié: (2026)
par: Elgaar, Mohamed, et autres
Publié: (2026)
FairFlow: Mitigating Dataset Biases through Undecided Learning
par: Cheng, Jiali, et autres
Publié: (2025)
par: Cheng, Jiali, et autres
Publié: (2025)
Fine-Grained Graph Generation through Latent Mixture Scheduling
par: Vakil, Nidhi, et autres
Publié: (2026)
par: Vakil, Nidhi, et autres
Publié: (2026)
MU-Bench: A Multitask Multimodal Benchmark for Machine Unlearning
par: Cheng, Jiali, et autres
Publié: (2024)
par: Cheng, Jiali, et autres
Publié: (2024)
How Learning Rate Decay Wastes Your Best Data in Curriculum-Based LLM Pretraining
par: Luo, Kairong, et autres
Publié: (2025)
par: Luo, Kairong, et autres
Publié: (2025)
CogniVoice: Multimodal and Multilingual Fusion Networks for Mild Cognitive Impairment Assessment from Spontaneous Speech
par: Cheng, Jiali, et autres
Publié: (2024)
par: Cheng, Jiali, et autres
Publié: (2024)
Reinforcement Learning in Switching Non-Stationary Markov Decision Processes: Algorithms and Convergence Analysis
par: Amiri, Mohsen, et autres
Publié: (2025)
par: Amiri, Mohsen, et autres
Publié: (2025)
Linguistic Blind Spots of Large Language Models
par: Cheng, Jiali, et autres
Publié: (2025)
par: Cheng, Jiali, et autres
Publié: (2025)
Tool Unlearning for Tool-Augmented LLMs
par: Cheng, Jiali, et autres
Publié: (2025)
par: Cheng, Jiali, et autres
Publié: (2025)
Dual-Criterion Curriculum Learning: Application to Temporal Data
par: Abel, Gaspard, et autres
Publié: (2026)
par: Abel, Gaspard, et autres
Publié: (2026)
Natural Learning
par: Fanaee-T, Hadi
Publié: (2024)
par: Fanaee-T, Hadi
Publié: (2024)
Unveil Multi-Picture Descriptions for Multilingual Mild Cognitive Impairment Detection via Contrastive Learning
par: Qi, Kristin, et autres
Publié: (2025)
par: Qi, Kristin, et autres
Publié: (2025)
Curriculum Abductive Learning
par: Hu, Wen-Chao, et autres
Publié: (2025)
par: Hu, Wen-Chao, et autres
Publié: (2025)
Speech Unlearning
par: Cheng, Jiali, et autres
Publié: (2025)
par: Cheng, Jiali, et autres
Publié: (2025)
Sensi: Learn One Thing at a Time -- Curriculum-Based Test-Time Learning for LLM Game Agents
par: Arjmandi, Mohsen
Publié: (2026)
par: Arjmandi, Mohsen
Publié: (2026)
Curriculum Learning for Safety Alignment
par: Kumar, Sandeep, et autres
Publié: (2026)
par: Kumar, Sandeep, et autres
Publié: (2026)
Causally Aligned Curriculum Learning
par: Li, Mingxuan, et autres
Publié: (2025)
par: Li, Mingxuan, et autres
Publié: (2025)
PTCL: Pseudo-Label Temporal Curriculum Learning for Label-Limited Dynamic Graph
par: Zhang, Shengtao, et autres
Publié: (2025)
par: Zhang, Shengtao, et autres
Publié: (2025)
MedDec: A Dataset for Extracting Medical Decisions from Discharge Summaries
par: Elgaar, Mohamed, et autres
Publié: (2024)
par: Elgaar, Mohamed, et autres
Publié: (2024)
Learning to Play Blackjack: A Curriculum Learning Perspective
par: Alasti, Amirreza, et autres
Publié: (2026)
par: Alasti, Amirreza, et autres
Publié: (2026)
Probabilistic Curriculum Learning for Goal-Based Reinforcement Learning
par: Salt, Llewyn, et autres
Publié: (2025)
par: Salt, Llewyn, et autres
Publié: (2025)
MathMixup: Boosting LLM Mathematical Reasoning with Difficulty-Controllable Data Synthesis and Curriculum Learning
par: Li, Xuchen, et autres
Publié: (2026)
par: Li, Xuchen, et autres
Publié: (2026)
CurES: From Gradient Analysis to Efficient Curriculum Learning for Reasoning LLMs
par: Zeng, Yongcheng, et autres
Publié: (2025)
par: Zeng, Yongcheng, et autres
Publié: (2025)
Learning Versatile Skills with Curriculum Masking
par: Tang, Yao, et autres
Publié: (2024)
par: Tang, Yao, et autres
Publié: (2024)
The Implicit Curriculum: Learning Dynamics in RL with Verifiable Rewards
par: Huang, Yu, et autres
Publié: (2026)
par: Huang, Yu, et autres
Publié: (2026)
Hardness-Aware Dynamic Curriculum Learning for Robust Multimodal Emotion Recognition with Missing Modalities
par: Liu, Rui, et autres
Publié: (2025)
par: Liu, Rui, et autres
Publié: (2025)
CLUTR: Curriculum Learning via Unsupervised Task Representation Learning
par: Azad, Abdus Salam, et autres
Publié: (2022)
par: Azad, Abdus Salam, et autres
Publié: (2022)
Training-Free Geospatial Place Representation Learning from Large-Scale Point-of-Interest Graph Data
par: Hashemi, Mohammad, et autres
Publié: (2025)
par: Hashemi, Mohammad, et autres
Publié: (2025)
AI Learning Algorithms: Deep Learning, Hybrid Models, and Large-Scale Model Integration
par: Golilarz, Noorbakhsh Amiri, et autres
Publié: (2024)
par: Golilarz, Noorbakhsh Amiri, et autres
Publié: (2024)
Understanding Machine Unlearning Through the Lens of Mode Connectivity
par: Cheng, Jiali, et autres
Publié: (2025)
par: Cheng, Jiali, et autres
Publié: (2025)
MultiDelete for Multimodal Machine Unlearning
par: Cheng, Jiali, et autres
Publié: (2023)
par: Cheng, Jiali, et autres
Publié: (2023)
Self-Evolving Curriculum for LLM Reasoning
par: Chen, Xiaoyin, et autres
Publié: (2025)
par: Chen, Xiaoyin, et autres
Publié: (2025)
Curriculum Guided Personalized Subgraph Federated Learning
par: Kang, Minku, et autres
Publié: (2025)
par: Kang, Minku, et autres
Publié: (2025)
Enhancing Spatio-temporal Quantile Forecasting with Curriculum Learning: Lessons Learned
par: Yin, Du, et autres
Publié: (2024)
par: Yin, Du, et autres
Publié: (2024)
LingGen: Scalable Multi-Attribute Linguistic Control via Power-Law Masking
par: Elgaar, Mohamed, et autres
Publié: (2024)
par: Elgaar, Mohamed, et autres
Publié: (2024)
Linguistically-Controlled Paraphrase Generation
par: Elgaar, Mohamed, et autres
Publié: (2024)
par: Elgaar, Mohamed, et autres
Publié: (2024)
Curriculum-enhanced GroupDRO: Challenging the Norm of Avoiding Curriculum Learning in Subpopulation Shift Setups
par: Barbalau, Antonio
Publié: (2024)
par: Barbalau, Antonio
Publié: (2024)
Curriculum Reinforcement Learning from Easy to Hard Tasks Improves LLM Reasoning
par: Parashar, Shubham, et autres
Publié: (2025)
par: Parashar, Shubham, et autres
Publié: (2025)
Learning Transferable Sensor Models via Language-Informed Pretraining
par: Chen, Yuliang, et autres
Publié: (2026)
par: Chen, Yuliang, et autres
Publié: (2026)
Documents similaires
-
HuCurl: Human-induced Curriculum Discovery
par: Elgaar, Mohamed, et autres
Publié: (2023) -
Linguistic Blind Spots in Clinical Decision Extraction
par: Elgaar, Mohamed, et autres
Publié: (2026) -
FairFlow: Mitigating Dataset Biases through Undecided Learning
par: Cheng, Jiali, et autres
Publié: (2025) -
Fine-Grained Graph Generation through Latent Mixture Scheduling
par: Vakil, Nidhi, et autres
Publié: (2026) -
MU-Bench: A Multitask Multimodal Benchmark for Machine Unlearning
par: Cheng, Jiali, et autres
Publié: (2024)