MaP: A Unified Framework for Reliable Evaluation of Pre-training Dynamics
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Jiapeng, Tian, Changxin, Chen, Kunlong, Liu, Ziqi, Mao, Jiaxin, Zhao, Wayne Xin, Zhang, Zhiqiang, Zhou, Jun |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
WSM: Decay-Free Learning Rate Schedule via Checkpoint Merging for LLM Pre-training
par: Tian, Changxin, et autres
Publié: (2025)
par: Tian, Changxin, et autres
Publié: (2025)
MergeMix: Optimizing Mid-Training Data Mixtures via Learnable Model Merging
par: Wang, Jiapeng, et autres
Publié: (2026)
par: Wang, Jiapeng, et autres
Publié: (2026)
Towards Greater Leverage: Scaling Laws for Efficient Mixture-of-Experts Language Models
par: Tian, Changxin, et autres
Publié: (2025)
par: Tian, Changxin, et autres
Publié: (2025)
Arrows of Math Reasoning Data Synthesis for Large Language Models: Diversity, Complexity and Correctness
par: Chen, Sirui, et autres
Publié: (2025)
par: Chen, Sirui, et autres
Publié: (2025)
SuperValid: Capability-Aligned OOD Validation for Generalizable Downstream Scaling
par: Sun, Quanen, et autres
Publié: (2026)
par: Sun, Quanen, et autres
Publié: (2026)
Towards Effective and Efficient Continual Pre-training of Large Language Models
par: Chen, Jie, et autres
Publié: (2024)
par: Chen, Jie, et autres
Publié: (2024)
MustoeLab/Publications: msDMS-MaP DOI
par: Khoa, et autres
Publié: (2026)
par: Khoa, et autres
Publié: (2026)
H-MaP: An Iterative and Hybrid Sequential Manipulation Planner
par: Cicek, Berk, et autres
Publié: (2024)
par: Cicek, Berk, et autres
Publié: (2024)
An Integrated Data Processing Framework for Pretraining Foundation Models
par: Sun, Yiding, et autres
Publié: (2024)
par: Sun, Yiding, et autres
Publié: (2024)
BOSE: A Systematic Evaluation Method Optimized for Base Models
par: Luan, Hongzhi, et autres
Publié: (2025)
par: Luan, Hongzhi, et autres
Publié: (2025)
ReasoningLM: Enabling Structural Subgraph Reasoning in Pre-trained Language Models for Question Answering over Knowledge Graph
par: Jiang, Jinhao, et autres
Publié: (2023)
par: Jiang, Jinhao, et autres
Publié: (2023)
Can Small Language Models be Good Reasoners for Sequential Recommendation?
par: Wang, Yuling, et autres
Publié: (2024)
par: Wang, Yuling, et autres
Publié: (2024)
From $P(y|x)$ to $P(y)$: Investigating Reinforcement Learning in Pre-train Space
par: Tan, Yuqiao, et autres
Publié: (2026)
par: Tan, Yuqiao, et autres
Publié: (2026)
Multi-domain Knowledge Graph Collaborative Pre-training and Prompt Tuning for Diverse Downstream Tasks
par: Zhang, Yichi, et autres
Publié: (2024)
par: Zhang, Yichi, et autres
Publié: (2024)
Entropy-Guided Token Dropout: Training Autoregressive Language Models with Limited Domain Data
par: Wang, Jiapeng, et autres
Publié: (2025)
par: Wang, Jiapeng, et autres
Publié: (2025)
Investigating the Pre-Training Dynamics of In-Context Learning: Task Recognition vs. Task Learning
par: Wang, Xiaolei, et autres
Publié: (2024)
par: Wang, Xiaolei, et autres
Publié: (2024)
MaP-AVR: A Meta-Action Planner for Agents Leveraging Vision Language Models and Retrieval-Augmented Generation
par: Guo, Zhenglong, et autres
Publié: (2025)
par: Guo, Zhenglong, et autres
Publié: (2025)
G-MAP: General Memory-Augmented Pre-trained Language Model for Domain Tasks
par: Wan, Zhongwei, et autres
Publié: (2022)
par: Wan, Zhongwei, et autres
Publié: (2022)
Re$^{\text{2}}$MaP: Macro Placement by Recursively Prototyping and Packing Tree-based Relocating
par: Shi, Yunqi, et autres
Publié: (2025)
par: Shi, Yunqi, et autres
Publié: (2025)
Noise-BERT: A Unified Perturbation-Robust Framework with Noise Alignment Pre-training for Noisy Slot Filling Task
par: Zhao, Jinxu, et autres
Publié: (2024)
par: Zhao, Jinxu, et autres
Publié: (2024)
SEOE: A Scalable and Reliable Semantic Evaluation Framework for Open Domain Event Detection
par: Lu, Yi-Fan, et autres
Publié: (2025)
par: Lu, Yi-Fan, et autres
Publié: (2025)
Effectiveness of Pre-training for Few-shot Intent Classification
par: Zhang, Haode, et autres
Publié: (2021)
par: Zhang, Haode, et autres
Publié: (2021)
MAQInstruct: Instruction-based Unified Event Relation Extraction
par: Xu, Jun, et autres
Publié: (2025)
par: Xu, Jun, et autres
Publié: (2025)
Unlocking General Long Chain-of-Thought Reasoning Capabilities of Large Language Models via Representation Engineering
par: Tang, Xinyu, et autres
Publié: (2025)
par: Tang, Xinyu, et autres
Publié: (2025)
Velocitune: A Velocity-based Dynamic Domain Reweighting Method for Continual Pre-training
par: Luo, Zheheng, et autres
Publié: (2024)
par: Luo, Zheheng, et autres
Publié: (2024)
Can Pre-training Indicators Reliably Predict Fine-tuning Outcomes of LLMs?
par: Zeng, Hansi, et autres
Publié: (2025)
par: Zeng, Hansi, et autres
Publié: (2025)
RV-Syn: Rational and Verifiable Mathematical Reasoning Data Synthesis based on Structured Function Library
par: Wang, Jiapeng, et autres
Publié: (2025)
par: Wang, Jiapeng, et autres
Publié: (2025)
ChatUIE: Exploring Chat-based Unified Information Extraction using Large Language Models
par: Xu, Jun, et autres
Publié: (2024)
par: Xu, Jun, et autres
Publié: (2024)
Towards High Data Efficiency in Reinforcement Learning with Verifiable Reward
par: Tang, Xinyu, et autres
Publié: (2025)
par: Tang, Xinyu, et autres
Publié: (2025)
Revealing the Learning Dynamics of Long-Context Continual Pre-training
par: Liang, Yupu, et autres
Publié: (2026)
par: Liang, Yupu, et autres
Publié: (2026)
Rethinking Sample Polarity in Reinforcement Learning with Verifiable Rewards
par: Tang, Xinyu, et autres
Publié: (2025)
par: Tang, Xinyu, et autres
Publié: (2025)
Enhancing Cross-task Transfer of Large Language Models via Activation Steering
par: Tang, Xinyu, et autres
Publié: (2025)
par: Tang, Xinyu, et autres
Publié: (2025)
Parallel Structures in Pre-training Data Yield In-Context Learning
par: Chen, Yanda, et autres
Publié: (2024)
par: Chen, Yanda, et autres
Publié: (2024)
The Journey Matters: Average Parameter Count over Pre-training Unifies Sparse and Dense Scaling Laws
par: Jin, Tian, et autres
Publié: (2025)
par: Jin, Tian, et autres
Publié: (2025)
Evaluating Discourse Cohesion in Pre-trained Language Models
par: He, Jie, et autres
Publié: (2025)
par: He, Jie, et autres
Publié: (2025)
VERITAS: A Unified Approach to Reliability Evaluation
par: Ramamurthy, Rajkumar, et autres
Publié: (2024)
par: Ramamurthy, Rajkumar, et autres
Publié: (2024)
ArbGraph: Conflict-Aware Evidence Arbitration for Reliable Long-Form Retrieval-Augmented Generation
par: Niu, Qingying, et autres
Publié: (2026)
par: Niu, Qingying, et autres
Publié: (2026)
Visually Guided Generative Text-Layout Pre-training for Document Intelligence
par: Mao, Zhiming, et autres
Publié: (2024)
par: Mao, Zhiming, et autres
Publié: (2024)
Tree of Reviews: A Tree-based Dynamic Iterative Retrieval Framework for Multi-hop Question Answering
par: Jiapeng, Li, et autres
Publié: (2024)
par: Jiapeng, Li, et autres
Publié: (2024)
Evaluation Agent: Efficient and Promptable Evaluation Framework for Visual Generative Models
par: Zhang, Fan, et autres
Publié: (2024)
par: Zhang, Fan, et autres
Publié: (2024)
Documents similaires
-
WSM: Decay-Free Learning Rate Schedule via Checkpoint Merging for LLM Pre-training
par: Tian, Changxin, et autres
Publié: (2025) -
MergeMix: Optimizing Mid-Training Data Mixtures via Learnable Model Merging
par: Wang, Jiapeng, et autres
Publié: (2026) -
Towards Greater Leverage: Scaling Laws for Efficient Mixture-of-Experts Language Models
par: Tian, Changxin, et autres
Publié: (2025) -
Arrows of Math Reasoning Data Synthesis for Large Language Models: Diversity, Complexity and Correctness
par: Chen, Sirui, et autres
Publié: (2025) -
SuperValid: Capability-Aligned OOD Validation for Generalizable Downstream Scaling
par: Sun, Quanen, et autres
Publié: (2026)