Guardado en:
| Autores principales: | Ji, Yunjie, Tian, Xiaoyu, Zhao, Sitong, Wang, Haotian, Chen, Shuaiting, Peng, Yiping, Zhao, Han, Li, Xiangang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2505.08311 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Think Twice: Enhancing LLM Reasoning by Scaling Multi-round Test-time Thinking
por: Tian, Xiaoyu, et al.
Publicado: (2025)
por: Tian, Xiaoyu, et al.
Publicado: (2025)
DeepDistill: Enhancing LLM Reasoning Capabilities via Large-Scale Difficulty-Graded Data Training
por: Tian, Xiaoyu, et al.
Publicado: (2025)
por: Tian, Xiaoyu, et al.
Publicado: (2025)
Leveraging Reasoning Model Answers to Enhance Non-Reasoning Model Capability
por: Wang, Haotian, et al.
Publicado: (2025)
por: Wang, Haotian, et al.
Publicado: (2025)
1.4 Million Open-Source Distilled Reasoning Dataset to Empower Large Language Model Training
por: Zhao, Han, et al.
Publicado: (2025)
por: Zhao, Han, et al.
Publicado: (2025)
Exploring the Potential of Offline RL for Reasoning in LLMs: A Preliminary Study
por: Tian, Xiaoyu, et al.
Publicado: (2025)
por: Tian, Xiaoyu, et al.
Publicado: (2025)
How Difficulty-Aware Staged Reinforcement Learning Enhances LLMs' Reasoning Capabilities: A Preliminary Experimental Study
por: Ji, Yunjie, et al.
Publicado: (2025)
por: Ji, Yunjie, et al.
Publicado: (2025)
Not All Correct Answers Are Equal: Why Your Distillation Source Matters
por: Tian, Xiaoyu, et al.
Publicado: (2025)
por: Tian, Xiaoyu, et al.
Publicado: (2025)
Exploring Efficiency Frontiers of Thinking Budget in Medical Reasoning: Scaling Laws between Computational Resources and Reasoning Quality
por: Bi, Ziqian, et al.
Publicado: (2025)
por: Bi, Ziqian, et al.
Publicado: (2025)
Memorizing is Not Enough: Deep Knowledge Injection Through Reasoning
por: Xu, Ruoxi, et al.
Publicado: (2025)
por: Xu, Ruoxi, et al.
Publicado: (2025)
Navigate through Enigmatic Labyrinth A Survey of Chain of Thought Reasoning: Advances, Frontiers and Future
por: Chu, Zheng, et al.
Publicado: (2023)
por: Chu, Zheng, et al.
Publicado: (2023)
MeTHanol: Modularized Thinking Language Models with Intermediate Layer Thinking, Decoding and Bootstrapping Reasoning
por: Xi, Ningyuan, et al.
Publicado: (2024)
por: Xi, Ningyuan, et al.
Publicado: (2024)
Thinking in Character: Advancing Role-Playing Agents with Role-Aware Reasoning
por: Tang, Yihong, et al.
Publicado: (2025)
por: Tang, Yihong, et al.
Publicado: (2025)
Think Deep, Not Just Long: Measuring LLM Reasoning Effort via Deep-Thinking Tokens
por: Chen, Wei-Lin, et al.
Publicado: (2026)
por: Chen, Wei-Lin, et al.
Publicado: (2026)
SARI: Structured Audio Reasoning via Curriculum-Guided Reinforcement Learning
por: Wen, Cheng, et al.
Publicado: (2025)
por: Wen, Cheng, et al.
Publicado: (2025)
To Think or Not To Think, That is The Question for Large Reasoning Models in Theory of Mind Tasks
por: Gong, Nanxu, et al.
Publicado: (2026)
por: Gong, Nanxu, et al.
Publicado: (2026)
ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests
por: Xu, Shiyi, et al.
Publicado: (2025)
por: Xu, Shiyi, et al.
Publicado: (2025)
Advancing Speech Language Models by Scaling Supervised Fine-Tuning with Over 60,000 Hours of Synthetic Speech Dialogue Data
por: Zhao, Shuaijiang, et al.
Publicado: (2024)
por: Zhao, Shuaijiang, et al.
Publicado: (2024)
ThinkPilot: Steering Reasoning Models via Automated Think-prefixes Optimization
por: Li, Sunzhu, et al.
Publicado: (2025)
por: Li, Sunzhu, et al.
Publicado: (2025)
InCoder-32B-Thinking: Industrial Code World Model for Thinking
por: Yang, Jian, et al.
Publicado: (2026)
por: Yang, Jian, et al.
Publicado: (2026)
Seed1.5-Thinking: Advancing Superb Reasoning Models with Reinforcement Learning
por: Seed, ByteDance, et al.
Publicado: (2025)
por: Seed, ByteDance, et al.
Publicado: (2025)
Thinking in a Crowd: How Auxiliary Information Shapes LLM Reasoning
por: Zhao, Haodong, et al.
Publicado: (2025)
por: Zhao, Haodong, et al.
Publicado: (2025)
Efficient Reasoning with Balanced Thinking
por: Li, Yulin, et al.
Publicado: (2026)
por: Li, Yulin, et al.
Publicado: (2026)
Think Dense, Not Long: Dynamic Decoupled Conditional Advantage for Efficient Reasoning
por: Peng, Keqin, et al.
Publicado: (2026)
por: Peng, Keqin, et al.
Publicado: (2026)
LexPro-1.0 Technical Report
por: Chen, Haotian, et al.
Publicado: (2025)
por: Chen, Haotian, et al.
Publicado: (2025)
When to Continue Thinking: Adaptive Thinking Mode Switching for Efficient Reasoning
por: Zhang, Xiaoyun, et al.
Publicado: (2025)
por: Zhang, Xiaoyun, et al.
Publicado: (2025)
Think More, Hallucinate Less: Mitigating Hallucinations via Dual Process of Fast and Slow Thinking
por: Cheng, Xiaoxue, et al.
Publicado: (2025)
por: Cheng, Xiaoxue, et al.
Publicado: (2025)
ASTRA: Automated Synthesis of agentic Trajectories and Reinforcement Arenas
por: Tian, Xiaoyu, et al.
Publicado: (2026)
por: Tian, Xiaoyu, et al.
Publicado: (2026)
Thinking Economically: A Hierarchical Framework for Adaptive-Complexity Reasoning in LLMs
por: Gao, Yubo, et al.
Publicado: (2026)
por: Gao, Yubo, et al.
Publicado: (2026)
MM-THEBench: Do Reasoning MLLMs Think Reasonably?
por: Huang, Zhidian, et al.
Publicado: (2026)
por: Huang, Zhidian, et al.
Publicado: (2026)
Thinking with Nothinking Calibration: A New In-Context Learning Paradigm in Reasoning Large Language Models
por: Wu, Haotian, et al.
Publicado: (2025)
por: Wu, Haotian, et al.
Publicado: (2025)
Table-R1: Inference-Time Scaling for Table Reasoning
por: Yang, Zheyuan, et al.
Publicado: (2025)
por: Yang, Zheyuan, et al.
Publicado: (2025)
StreamingThinker: Large Language Models Can Think While Reading
por: Tong, Junlong, et al.
Publicado: (2025)
por: Tong, Junlong, et al.
Publicado: (2025)
A Survey of Frontiers in LLM Reasoning: Inference Scaling, Learning to Reason, and Agentic Systems
por: Ke, Zixuan, et al.
Publicado: (2025)
por: Ke, Zixuan, et al.
Publicado: (2025)
Atomic Thinking of LLMs: Decoupling and Exploring Mathematical Reasoning Abilities
por: Kuang, Jiayi, et al.
Publicado: (2025)
por: Kuang, Jiayi, et al.
Publicado: (2025)
SciResearcher: Scaling Deep Research Agents for Frontier Scientific Reasoning
por: Zheng, Tianshi, et al.
Publicado: (2026)
por: Zheng, Tianshi, et al.
Publicado: (2026)
Efficient Reasoning with Hidden Thinking
por: Shen, Xuan, et al.
Publicado: (2025)
por: Shen, Xuan, et al.
Publicado: (2025)
AceMath: Advancing Frontier Math Reasoning with Post-Training and Reward Modeling
por: Liu, Zihan, et al.
Publicado: (2024)
por: Liu, Zihan, et al.
Publicado: (2024)
Skip-Thinking: Chunk-wise Chain-of-Thought Distillation Enable Smaller Language Models to Reason Better and Faster
por: Chen, Xiao, et al.
Publicado: (2025)
por: Chen, Xiao, et al.
Publicado: (2025)
Learning When to Think: Shaping Adaptive Reasoning in R1-Style Models via Multi-Stage RL
por: Tu, Songjun, et al.
Publicado: (2025)
por: Tu, Songjun, et al.
Publicado: (2025)
Thinking Slow, Fast: Scaling Inference Compute with Distilled Reasoners
por: Paliotta, Daniele, et al.
Publicado: (2025)
por: Paliotta, Daniele, et al.
Publicado: (2025)
Ejemplares similares
-
Think Twice: Enhancing LLM Reasoning by Scaling Multi-round Test-time Thinking
por: Tian, Xiaoyu, et al.
Publicado: (2025) -
DeepDistill: Enhancing LLM Reasoning Capabilities via Large-Scale Difficulty-Graded Data Training
por: Tian, Xiaoyu, et al.
Publicado: (2025) -
Leveraging Reasoning Model Answers to Enhance Non-Reasoning Model Capability
por: Wang, Haotian, et al.
Publicado: (2025) -
1.4 Million Open-Source Distilled Reasoning Dataset to Empower Large Language Model Training
por: Zhao, Han, et al.
Publicado: (2025) -
Exploring the Potential of Offline RL for Reasoning in LLMs: A Preliminary Study
por: Tian, Xiaoyu, et al.
Publicado: (2025)