Guardado en:
| Autores principales: | Feng, Tao, Zhang, Haozhen, Lei, Zijie, Han, Pengrui, Patwary, Mostofa, Shoeybi, Mohammad, Catanzaro, Bryan, You, Jiaxuan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2507.10540 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Maximize Your Data's Potential: Enhancing LLM Accuracy with Two-Phase Pretraining
por: Feng, Steven, et al.
Publicado: (2024)
por: Feng, Steven, et al.
Publicado: (2024)
AcademicEval: Live Long-Context LLM Benchmark
por: Zhang, Haozhen, et al.
Publicado: (2025)
por: Zhang, Haozhen, et al.
Publicado: (2025)
Nemotron-CC-Math: A 133 Billion-Token-Scale High Quality Math Pretraining Dataset
por: Mahabadi, Rabeeh Karimi, et al.
Publicado: (2025)
por: Mahabadi, Rabeeh Karimi, et al.
Publicado: (2025)
Front-Loading Reasoning: The Synergy between Pretraining and Post-Training Data
por: Akter, Syeda Nahida, et al.
Publicado: (2025)
por: Akter, Syeda Nahida, et al.
Publicado: (2025)
Reuse, Don't Retrain: A Recipe for Continued Pretraining of Language Models
por: Parmar, Jupinder, et al.
Publicado: (2024)
por: Parmar, Jupinder, et al.
Publicado: (2024)
RLP: Reinforcement as a Pretraining Objective
por: Hatamizadeh, Ali, et al.
Publicado: (2025)
por: Hatamizadeh, Ali, et al.
Publicado: (2025)
Prismatic Synthesis: Gradient-based Data Diversification Boosts Generalization in LLM Reasoning
por: Jung, Jaehun, et al.
Publicado: (2025)
por: Jung, Jaehun, et al.
Publicado: (2025)
On Data Engineering for Scaling LLM Terminal Capabilities
por: Pi, Renjie, et al.
Publicado: (2026)
por: Pi, Renjie, et al.
Publicado: (2026)
Compact Language Models via Pruning and Knowledge Distillation
por: Muralidharan, Saurav, et al.
Publicado: (2024)
por: Muralidharan, Saurav, et al.
Publicado: (2024)
Retro-Search: Exploring Untaken Paths for Deeper and Efficient Reasoning
por: Lu, Ximing, et al.
Publicado: (2025)
por: Lu, Ximing, et al.
Publicado: (2025)
Data, Data Everywhere: A Guide for Pretraining Dataset Construction
por: Parmar, Jupinder, et al.
Publicado: (2024)
por: Parmar, Jupinder, et al.
Publicado: (2024)
Nemotron-CrossThink: Scaling Self-Learning beyond Math Reasoning
por: Akter, Syeda Nahida, et al.
Publicado: (2025)
por: Akter, Syeda Nahida, et al.
Publicado: (2025)
Router-R1: Teaching LLMs Multi-Round Routing and Aggregation via Reinforcement Learning
por: Zhang, Haozhen, et al.
Publicado: (2025)
por: Zhang, Haozhen, et al.
Publicado: (2025)
GraphPlanner: Graph Memory-Augmented Agentic Routing for Multi-Agent LLMs
por: Feng, Tao, et al.
Publicado: (2026)
por: Feng, Tao, et al.
Publicado: (2026)
Multi-Agent Evolve: LLM Self-Improve through Co-evolution
por: Chen, Yixing, et al.
Publicado: (2025)
por: Chen, Yixing, et al.
Publicado: (2025)
MIND: Math Informed syNthetic Dialogues for Pretraining LLMs
por: Akter, Syeda Nahida, et al.
Publicado: (2024)
por: Akter, Syeda Nahida, et al.
Publicado: (2024)
Graph of Records: Boosting Retrieval Augmented Generation for Long-context Summarization with Graphs
por: Zhang, Haozhen, et al.
Publicado: (2024)
por: Zhang, Haozhen, et al.
Publicado: (2024)
RankRAG: Unifying Context Ranking with Retrieval-Augmented Generation in LLMs
por: Yu, Yue, et al.
Publicado: (2024)
por: Yu, Yue, et al.
Publicado: (2024)
Nemotron-CC: Transforming Common Crawl into a Refined Long-Horizon Pretraining Dataset
por: Su, Dan, et al.
Publicado: (2024)
por: Su, Dan, et al.
Publicado: (2024)
ChatQA 2: Bridging the Gap to Proprietary LLMs in Long Context and RAG Capabilities
por: Xu, Peng, et al.
Publicado: (2024)
por: Xu, Peng, et al.
Publicado: (2024)
R1-Ranker: Teaching LLM Rankers to Reason
por: Feng, Tao, et al.
Publicado: (2025)
por: Feng, Tao, et al.
Publicado: (2025)
Paper Copilot: A Self-Evolving and Efficient LLM System for Personalized Academic Assistance
por: Lin, Guanyu, et al.
Publicado: (2024)
por: Lin, Guanyu, et al.
Publicado: (2024)
AceMath: Advancing Frontier Math Reasoning with Post-Training and Reward Modeling
por: Liu, Zihan, et al.
Publicado: (2024)
por: Liu, Zihan, et al.
Publicado: (2024)
GMTRouter: Personalized LLM Router over Multi-turn User Interactions
por: Xie, Encheng, et al.
Publicado: (2025)
por: Xie, Encheng, et al.
Publicado: (2025)
LLM Pruning and Distillation in Practice: The Minitron Approach
por: Sreenivas, Sharath Turuvekere, et al.
Publicado: (2024)
por: Sreenivas, Sharath Turuvekere, et al.
Publicado: (2024)
GraphEval: A Lightweight Graph-Based LLM Framework for Idea Evaluation
por: Feng, Tao, et al.
Publicado: (2025)
por: Feng, Tao, et al.
Publicado: (2025)
PersonalizedRouter: Personalized LLM Routing via Graph-based User Preference Modeling
por: Dai, Zhongjie, et al.
Publicado: (2025)
por: Dai, Zhongjie, et al.
Publicado: (2025)
Thought-Retriever: Don't Just Retrieve Raw Data, Retrieve Thoughts for Memory-Augmented Agentic Systems
por: Feng, Tao, et al.
Publicado: (2026)
por: Feng, Tao, et al.
Publicado: (2026)
Upcycling Large Language Models into Mixture of Experts
por: He, Ethan, et al.
Publicado: (2024)
por: He, Ethan, et al.
Publicado: (2024)
AceReason-Nemotron 1.1: Advancing Math and Code Reasoning through SFT and RL Synergy
por: Liu, Zihan, et al.
Publicado: (2025)
por: Liu, Zihan, et al.
Publicado: (2025)
RAVEN: In-Context Learning with Retrieval-Augmented Encoder-Decoder Language Models
por: Huang, Jie, et al.
Publicado: (2023)
por: Huang, Jie, et al.
Publicado: (2023)
MM-Embed: Universal Multimodal Retrieval with Multimodal LLMs
por: Lin, Sheng-Chieh, et al.
Publicado: (2024)
por: Lin, Sheng-Chieh, et al.
Publicado: (2024)
NV-Embed: Improved Techniques for Training LLMs as Generalist Embedding Models
por: Lee, Chankyu, et al.
Publicado: (2024)
por: Lee, Chankyu, et al.
Publicado: (2024)
ChatQA: Surpassing GPT-4 on Conversational QA and RAG
por: Liu, Zihan, et al.
Publicado: (2024)
por: Liu, Zihan, et al.
Publicado: (2024)
RouteProfile: Graph-Based Profiling for Cold-Start LLM Routing
por: Xu, Jingjun, et al.
Publicado: (2026)
por: Xu, Jingjun, et al.
Publicado: (2026)
InstructRetro: Instruction Tuning post Retrieval-Augmented Pretraining
por: Wang, Boxin, et al.
Publicado: (2023)
por: Wang, Boxin, et al.
Publicado: (2023)
LRanker: LLM Ranker for Massive Candidates
por: Feng, Tao, et al.
Publicado: (2026)
por: Feng, Tao, et al.
Publicado: (2026)
From 128K to 4M: Efficient Training of Ultra-Long Context Large Language Models
por: Xu, Chejian, et al.
Publicado: (2025)
por: Xu, Chejian, et al.
Publicado: (2025)
AceReason-Nemotron: Advancing Math and Code Reasoning through Reinforcement Learning
por: Chen, Yang, et al.
Publicado: (2025)
por: Chen, Yang, et al.
Publicado: (2025)
ODIN: Disentangled Reward Mitigates Hacking in RLHF
por: Chen, Lichang, et al.
Publicado: (2024)
por: Chen, Lichang, et al.
Publicado: (2024)
Ejemplares similares
-
Maximize Your Data's Potential: Enhancing LLM Accuracy with Two-Phase Pretraining
por: Feng, Steven, et al.
Publicado: (2024) -
AcademicEval: Live Long-Context LLM Benchmark
por: Zhang, Haozhen, et al.
Publicado: (2025) -
Nemotron-CC-Math: A 133 Billion-Token-Scale High Quality Math Pretraining Dataset
por: Mahabadi, Rabeeh Karimi, et al.
Publicado: (2025) -
Front-Loading Reasoning: The Synergy between Pretraining and Post-Training Data
por: Akter, Syeda Nahida, et al.
Publicado: (2025) -
Reuse, Don't Retrain: A Recipe for Continued Pretraining of Language Models
por: Parmar, Jupinder, et al.
Publicado: (2024)