Boosting Accuracy and Efficiency of Budget Forcing in LLMs via Reinforcement Learning for Mathematical Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Tarunokusumo, Ravindra Aribowo, Cunha, Rafael Fernandes |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Beyond Accuracy: Dissecting Mathematical Reasoning for LLMs Under Reinforcement Learning
di: Wang, Jiayu, et al.
Pubblicazione: (2025)
di: Wang, Jiayu, et al.
Pubblicazione: (2025)
A Practical Two-Stage Recipe for Mathematical LLMs: Maximizing Accuracy with SFT and Efficiency with Reinforcement Learning
di: Yoshihara, Hiroshi, et al.
Pubblicazione: (2025)
di: Yoshihara, Hiroshi, et al.
Pubblicazione: (2025)
Beyond Self-Consistency: Ensemble Reasoning Boosts Consistency and Accuracy of LLMs in Cancer Staging
di: Chang, Chia-Hsuan, et al.
Pubblicazione: (2024)
di: Chang, Chia-Hsuan, et al.
Pubblicazione: (2024)
Agentic Reasoning and Tool Integration for LLMs via Reinforcement Learning
di: Singh, Joykirat, et al.
Pubblicazione: (2025)
di: Singh, Joykirat, et al.
Pubblicazione: (2025)
Boosting Sample Efficiency and Generalization in Multi-agent Reinforcement Learning via Equivariance
di: McClellan, Joshua, et al.
Pubblicazione: (2024)
di: McClellan, Joshua, et al.
Pubblicazione: (2024)
DISPO: Enhancing Training Efficiency and Stability in Reinforcement Learning for Large Language Model Mathematical Reasoning
di: Karaman, Batuhan K., et al.
Pubblicazione: (2026)
di: Karaman, Batuhan K., et al.
Pubblicazione: (2026)
KnowRL: Boosting LLM Reasoning via Reinforcement Learning with Minimal-Sufficient Knowledge Guidance
di: Yu, Linhao, et al.
Pubblicazione: (2026)
di: Yu, Linhao, et al.
Pubblicazione: (2026)
Enhancing Mathematical Reasoning in LLMs with Background Operators
di: Chen, Jiajun, et al.
Pubblicazione: (2024)
di: Chen, Jiajun, et al.
Pubblicazione: (2024)
CoBA-RL: Capability-Oriented Budget Allocation for Reinforcement Learning in LLMs
di: Yao, Zhiyuan, et al.
Pubblicazione: (2026)
di: Yao, Zhiyuan, et al.
Pubblicazione: (2026)
ReSearch: Learning to Reason with Search for LLMs via Reinforcement Learning
di: Chen, Mingyang, et al.
Pubblicazione: (2025)
di: Chen, Mingyang, et al.
Pubblicazione: (2025)
SuperRL: Reinforcement Learning with Supervision to Boost Language Model Reasoning
di: Liu, Yihao, et al.
Pubblicazione: (2025)
di: Liu, Yihao, et al.
Pubblicazione: (2025)
Beyond Accuracy: Evaluating Strategy Diversity in LLM Mathematical Reasoning
di: Yang, Xia, et al.
Pubblicazione: (2026)
di: Yang, Xia, et al.
Pubblicazione: (2026)
Toward Scientific Reasoning in LLMs: Training from Expert Discussions via Reinforcement Learning
di: Yin, Ming, et al.
Pubblicazione: (2025)
di: Yin, Ming, et al.
Pubblicazione: (2025)
Reinforcement Learning Improves LLM Accuracy and Reasoning in Disease Classification from Radiology Reports
di: Wei, Yishu, et al.
Pubblicazione: (2026)
di: Wei, Yishu, et al.
Pubblicazione: (2026)
Reinforcement Learning vs. Distillation: Understanding Accuracy and Capability in LLM Reasoning
di: Kim, Minwu, et al.
Pubblicazione: (2025)
di: Kim, Minwu, et al.
Pubblicazione: (2025)
Beyond Accuracy: Decomposing the Reasoning Efficiency of LLMs
di: Kaiser, Daniel, et al.
Pubblicazione: (2026)
di: Kaiser, Daniel, et al.
Pubblicazione: (2026)
Unlocking Reasoning Capabilities in LLMs via Reinforcement Learning Exploration
di: Deng, Wenhao, et al.
Pubblicazione: (2025)
di: Deng, Wenhao, et al.
Pubblicazione: (2025)
RoRecomp: Enhancing Reasoning Efficiency via Rollout Response Recomposition in Reinforcement Learning
di: Li, Gang, et al.
Pubblicazione: (2025)
di: Li, Gang, et al.
Pubblicazione: (2025)
SAT: Balancing Reasoning Accuracy and Efficiency with Stepwise Adaptive Thinking
di: Huang, Weiyang, et al.
Pubblicazione: (2026)
di: Huang, Weiyang, et al.
Pubblicazione: (2026)
MathMixup: Boosting LLM Mathematical Reasoning with Difficulty-Controllable Data Synthesis and Curriculum Learning
di: Li, Xuchen, et al.
Pubblicazione: (2026)
di: Li, Xuchen, et al.
Pubblicazione: (2026)
ReEfBench: Quantifying the Reasoning Efficiency of LLMs
di: Fu, Zhizhang, et al.
Pubblicazione: (2026)
di: Fu, Zhizhang, et al.
Pubblicazione: (2026)
Xiangqi-R1: Enhancing Spatial Strategic Reasoning in LLMs for Chinese Chess via Reinforcement Learning
di: Chen, Yuhao, et al.
Pubblicazione: (2025)
di: Chen, Yuhao, et al.
Pubblicazione: (2025)
PEPS: Quantum-Inspired Reinforcement Learning for Coherent Reasoning Traces in LLMs
di: Margapuri, Venkat, et al.
Pubblicazione: (2025)
di: Margapuri, Venkat, et al.
Pubblicazione: (2025)
Emergent Hierarchical Reasoning in LLMs through Reinforcement Learning
di: Wang, Haozhe, et al.
Pubblicazione: (2025)
di: Wang, Haozhe, et al.
Pubblicazione: (2025)
R3-RAG: Learning Step-by-Step Reasoning and Retrieval for LLMs via Reinforcement Learning
di: Li, Yuan, et al.
Pubblicazione: (2025)
di: Li, Yuan, et al.
Pubblicazione: (2025)
Harder Is Better: Boosting Mathematical Reasoning via Difficulty-Aware GRPO and Multi-Aspect Question Reformulation
di: Dai, Yanqi, et al.
Pubblicazione: (2026)
di: Dai, Yanqi, et al.
Pubblicazione: (2026)
TimeMaster: Training Time-Series Multimodal LLMs to Reason via Reinforcement Learning
di: Zhang, Junru, et al.
Pubblicazione: (2025)
di: Zhang, Junru, et al.
Pubblicazione: (2025)
DiFFPO: Training Diffusion LLMs to Reason Fast and Furious via Reinforcement Learning
di: Zhao, Hanyang, et al.
Pubblicazione: (2025)
di: Zhao, Hanyang, et al.
Pubblicazione: (2025)
h1: Bootstrapping LLMs to Reason over Longer Horizons via Reinforcement Learning
di: Motwani, Sumeet Ramesh, et al.
Pubblicazione: (2025)
di: Motwani, Sumeet Ramesh, et al.
Pubblicazione: (2025)
Revisiting Tree Search for LLMs: Gumbel and Sequential Halving for Budget-Scalable Reasoning
di: Ugadiarov, Leonid, et al.
Pubblicazione: (2026)
di: Ugadiarov, Leonid, et al.
Pubblicazione: (2026)
rSIM: Incentivizing Reasoning Capabilities of LLMs via Reinforced Strategy Injection
di: Chen, Sijia, et al.
Pubblicazione: (2025)
di: Chen, Sijia, et al.
Pubblicazione: (2025)
DeepSeek-Prover-V2: Advancing Formal Mathematical Reasoning via Reinforcement Learning for Subgoal Decomposition
di: Ren, Z. Z., et al.
Pubblicazione: (2025)
di: Ren, Z. Z., et al.
Pubblicazione: (2025)
Toward Better EHR Reasoning in LLMs: Reinforcement Learning with Expert Attention Guidance
di: Fang, Yue, et al.
Pubblicazione: (2025)
di: Fang, Yue, et al.
Pubblicazione: (2025)
CARFT: Boosting LLM Reasoning via Contrastive Learning with Annotated Chain-of-Thought-based Reinforced Fine-Tuning
di: Zhu, Wenqiao, et al.
Pubblicazione: (2025)
di: Zhu, Wenqiao, et al.
Pubblicazione: (2025)
Can Large Reasoning Models Improve Accuracy on Mathematical Tasks Using Flawed Thinking?
di: Amjith, Saraswathy, et al.
Pubblicazione: (2025)
di: Amjith, Saraswathy, et al.
Pubblicazione: (2025)
CSRP: Chain-of-Thought Reasoning for Chinese Text Correction via Reinforcement Learning with Efficiency-Aware Rewards
di: Tian, Wei, et al.
Pubblicazione: (2026)
di: Tian, Wei, et al.
Pubblicazione: (2026)
Boosting Vulnerability Detection of LLMs via Curriculum Preference Optimization with Synthetic Reasoning Data
di: Wen, Xin-Cheng, et al.
Pubblicazione: (2025)
di: Wen, Xin-Cheng, et al.
Pubblicazione: (2025)
WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning
di: Zhuang, Yuchen, et al.
Pubblicazione: (2025)
di: Zhuang, Yuchen, et al.
Pubblicazione: (2025)
G1: Teaching LLMs to Reason on Graphs with Reinforcement Learning
di: Guo, Xiaojun, et al.
Pubblicazione: (2025)
di: Guo, Xiaojun, et al.
Pubblicazione: (2025)
SATURN: SAT-based Reinforcement Learning to Unleash LLMs Reasoning
di: Liu, Huanyu, et al.
Pubblicazione: (2025)
di: Liu, Huanyu, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Beyond Accuracy: Dissecting Mathematical Reasoning for LLMs Under Reinforcement Learning
di: Wang, Jiayu, et al.
Pubblicazione: (2025) -
A Practical Two-Stage Recipe for Mathematical LLMs: Maximizing Accuracy with SFT and Efficiency with Reinforcement Learning
di: Yoshihara, Hiroshi, et al.
Pubblicazione: (2025) -
Beyond Self-Consistency: Ensemble Reasoning Boosts Consistency and Accuracy of LLMs in Cancer Staging
di: Chang, Chia-Hsuan, et al.
Pubblicazione: (2024) -
Agentic Reasoning and Tool Integration for LLMs via Reinforcement Learning
di: Singh, Joykirat, et al.
Pubblicazione: (2025) -
Boosting Sample Efficiency and Generalization in Multi-agent Reinforcement Learning via Equivariance
di: McClellan, Joshua, et al.
Pubblicazione: (2024)