Mid-Training of Large Language Models: A Survey
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Mo, Kaixiang, Shi, Yuxin, Weng, Weiwei, Zhou, Zhiqiang, Liu, Shuman, Zhang, Haibo, Zeng, Anxiang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Decomposing and Steering Functional Metacognition in Large Language Models
par: Li, Yanshi, et autres
Publié: (2026)
par: Li, Yanshi, et autres
Publié: (2026)
A Survey on LLM Mid-Training
par: Tu, Chengying, et autres
Publié: (2025)
par: Tu, Chengying, et autres
Publié: (2025)
Compass-Embedding v4: Robust Contrastive Learning for Multilingual E-commerce Embeddings
par: Ueareeworakul, Pakorn, et autres
Publié: (2025)
par: Ueareeworakul, Pakorn, et autres
Publié: (2025)
Large-Scale Diverse Synthesis for Mid-Training
par: Zhang, Xuemiao, et autres
Publié: (2025)
par: Zhang, Xuemiao, et autres
Publié: (2025)
Towards Reliable Evaluation of Large Language Models for Multilingual and Multimodal E-Commerce Applications
par: Xie, Shuyi, et autres
Publié: (2025)
par: Xie, Shuyi, et autres
Publié: (2025)
A Survey on the Honesty of Large Language Models
par: Li, Siheng, et autres
Publié: (2024)
par: Li, Siheng, et autres
Publié: (2024)
Optimal Transport-Based Token Weighting scheme for Enhanced Preference Optimization
par: Li, Meng, et autres
Publié: (2025)
par: Li, Meng, et autres
Publié: (2025)
On the Interplay of Pre-Training, Mid-Training, and RL on Reasoning Language Models
par: Zhang, Charlie, et autres
Publié: (2025)
par: Zhang, Charlie, et autres
Publié: (2025)
A Survey on Training-free Alignment of Large Language Models
par: Pan, Birong, et autres
Publié: (2025)
par: Pan, Birong, et autres
Publié: (2025)
A Comprehensive Survey of Large Language Models and Multimodal Large Language Models in Medicine
par: Xiao, Hanguang, et autres
Publié: (2024)
par: Xiao, Hanguang, et autres
Publié: (2024)
Attention Heads of Large Language Models: A Survey
par: Zheng, Zifan, et autres
Publié: (2024)
par: Zheng, Zifan, et autres
Publié: (2024)
Improving Automatic Summarization of Radiology Reports through Mid-Training of Large Language Models
par: Lyu, Mengxian, et autres
Publié: (2026)
par: Lyu, Mengxian, et autres
Publié: (2026)
Data Management For Training Large Language Models: A Survey
par: Wang, Zige, et autres
Publié: (2023)
par: Wang, Zige, et autres
Publié: (2023)
Continuous Self-Improvement of Large Language Models by Test-time Training with Verifier-Driven Sample Selection
par: Moradi, Mohammad Mahdi, et autres
Publié: (2025)
par: Moradi, Mohammad Mahdi, et autres
Publié: (2025)
Can Large Language Models Understand Preferences in Personalized Recommendation?
par: Tan, Zhaoxuan, et autres
Publié: (2025)
par: Tan, Zhaoxuan, et autres
Publié: (2025)
A Survey on Employing Large Language Models for Text-to-SQL Tasks
par: Shi, Liang, et autres
Publié: (2024)
par: Shi, Liang, et autres
Publié: (2024)
Compass-Thinker-7B Technical Report
par: Zeng, Anxiang, et autres
Publié: (2025)
par: Zeng, Anxiang, et autres
Publié: (2025)
A Survey of Context Engineering for Large Language Models
par: Mei, Lingrui, et autres
Publié: (2025)
par: Mei, Lingrui, et autres
Publié: (2025)
Towards Efficient and Effective Alignment of Large Language Models
par: Jiang, Yuxin
Publié: (2025)
par: Jiang, Yuxin
Publié: (2025)
Mathematical Language Models: A Survey
par: Liu, Wentao, et autres
Publié: (2023)
par: Liu, Wentao, et autres
Publié: (2023)
A Survey on Efficient Large Language Model Training: From Data-centric Perspectives
par: Luo, Junyu, et autres
Publié: (2025)
par: Luo, Junyu, et autres
Publié: (2025)
A Survey of Large Language Models
par: Zhao, Wayne Xin, et autres
Publié: (2023)
par: Zhao, Wayne Xin, et autres
Publié: (2023)
Probing Causality Manipulation of Large Language Models
par: Zhang, Chenyang, et autres
Publié: (2024)
par: Zhang, Chenyang, et autres
Publié: (2024)
Large Language Models in Bioinformatics: A Survey
par: Wang, Zhenyu, et autres
Publié: (2025)
par: Wang, Zhenyu, et autres
Publié: (2025)
A Survey of Uncertainty Estimation Methods on Large Language Models
par: Xia, Zhiqiu, et autres
Publié: (2025)
par: Xia, Zhiqiu, et autres
Publié: (2025)
Large Language Models Meet Legal Artificial Intelligence: A Survey
par: Hou, Zhitian, et autres
Publié: (2025)
par: Hou, Zhitian, et autres
Publié: (2025)
Harnessing Large Language Models as Post-hoc Correctors
par: Zhong, Zhiqiang, et autres
Publié: (2024)
par: Zhong, Zhiqiang, et autres
Publié: (2024)
Language Modeling Using Tensor Trains
par: Su, Zhan, et autres
Publié: (2024)
par: Su, Zhan, et autres
Publié: (2024)
Personality Alignment of Large Language Models
par: Zhu, Minjun, et autres
Publié: (2024)
par: Zhu, Minjun, et autres
Publié: (2024)
Scale-Distribution Decoupling: Enabling Stable and Effective Training of Large Language Models
par: Wang, Ya, et autres
Publié: (2025)
par: Wang, Ya, et autres
Publié: (2025)
The Real, the Better: Aligning Large Language Models with Online Human Behaviors
par: Jiang, Guanying, et autres
Publié: (2024)
par: Jiang, Guanying, et autres
Publié: (2024)
Large Language Models for Subjective Language Understanding: A Survey
par: Song, Changhao, et autres
Publié: (2025)
par: Song, Changhao, et autres
Publié: (2025)
A Survey on Large Language Models with Multilingualism: Recent Advances and New Frontiers
par: Huang, Kaiyu, et autres
Publié: (2024)
par: Huang, Kaiyu, et autres
Publié: (2024)
A Survey of Inductive Reasoning for Large Language Models
par: Chen, Kedi, et autres
Publié: (2025)
par: Chen, Kedi, et autres
Publié: (2025)
A Survey on Data Synthesis and Augmentation for Large Language Models
par: Wang, Ke, et autres
Publié: (2024)
par: Wang, Ke, et autres
Publié: (2024)
Towards Training A Chinese Large Language Model for Anesthesiology
par: Wang, Zhonghai, et autres
Publié: (2024)
par: Wang, Zhonghai, et autres
Publié: (2024)
Measuring the Impact of Lexical Training Data Coverage on Hallucination Detection in Large Language Models
par: Zhang, Shuo, et autres
Publié: (2025)
par: Zhang, Shuo, et autres
Publié: (2025)
Hybrid Alignment Training for Large Language Models
par: Wang, Chenglong, et autres
Publié: (2024)
par: Wang, Chenglong, et autres
Publié: (2024)
Logical Reasoning in Large Language Models: A Survey
par: Liu, Hanmeng, et autres
Publié: (2025)
par: Liu, Hanmeng, et autres
Publié: (2025)
Large Language Model Safety: A Holistic Survey
par: Shi, Dan, et autres
Publié: (2024)
par: Shi, Dan, et autres
Publié: (2024)
Documents similaires
-
Decomposing and Steering Functional Metacognition in Large Language Models
par: Li, Yanshi, et autres
Publié: (2026) -
A Survey on LLM Mid-Training
par: Tu, Chengying, et autres
Publié: (2025) -
Compass-Embedding v4: Robust Contrastive Learning for Multilingual E-commerce Embeddings
par: Ueareeworakul, Pakorn, et autres
Publié: (2025) -
Large-Scale Diverse Synthesis for Mid-Training
par: Zhang, Xuemiao, et autres
Publié: (2025) -
Towards Reliable Evaluation of Large Language Models for Multilingual and Multimodal E-Commerce Applications
par: Xie, Shuyi, et autres
Publié: (2025)