Learning Like Humans: Advancing LLM Reasoning Capabilities via Adaptive Difficulty Curriculum Learning and Expert-Guided Self-Reformulation
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Enci, Yan, Xingang, Lin, Wei, Zhang, Tianxiang, Lu, Qianchun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Harder Is Better: Boosting Mathematical Reasoning via Difficulty-Aware GRPO and Multi-Aspect Question Reformulation
di: Dai, Yanqi, et al.
Pubblicazione: (2026)
di: Dai, Yanqi, et al.
Pubblicazione: (2026)
Enhancing LLM Reasoning via Non-Human-Like Reasoning Path Preference Optimization
di: Lu, Junjie, et al.
Pubblicazione: (2025)
di: Lu, Junjie, et al.
Pubblicazione: (2025)
MathMixup: Boosting LLM Mathematical Reasoning with Difficulty-Controllable Data Synthesis and Curriculum Learning
di: Li, Xuchen, et al.
Pubblicazione: (2026)
di: Li, Xuchen, et al.
Pubblicazione: (2026)
Self-Evolving Curriculum for LLM Reasoning
di: Chen, Xiaoyin, et al.
Pubblicazione: (2025)
di: Chen, Xiaoyin, et al.
Pubblicazione: (2025)
CLPO: Curriculum Learning meets Policy Optimization for LLM Reasoning
di: Zhang, Shijie, et al.
Pubblicazione: (2025)
di: Zhang, Shijie, et al.
Pubblicazione: (2025)
Simulating Human-Like Learning Dynamics with LLM-Empowered Agents
di: Yuan, Yu, et al.
Pubblicazione: (2025)
di: Yuan, Yu, et al.
Pubblicazione: (2025)
Rethinking the Sampling Criteria in Reinforcement Learning for LLM Reasoning: A Competence-Difficulty Alignment Perspective
di: Kong, Deyang, et al.
Pubblicazione: (2025)
di: Kong, Deyang, et al.
Pubblicazione: (2025)
Know When to Explore: Difficulty-Aware Certainty as a Guide for LLM Reinforcement Learning
di: Li, Ang, et al.
Pubblicazione: (2025)
di: Li, Ang, et al.
Pubblicazione: (2025)
GanitLLM: Difficulty-Aware Bengali Mathematical Reasoning through Curriculum-GRPO
di: Dipta, Shubhashis Roy, et al.
Pubblicazione: (2026)
di: Dipta, Shubhashis Roy, et al.
Pubblicazione: (2026)
DAST: Difficulty-Adaptive Slow-Thinking for Large Reasoning Models
di: Shen, Yi, et al.
Pubblicazione: (2025)
di: Shen, Yi, et al.
Pubblicazione: (2025)
MoL-RL: Distilling Multi-Step Environmental Feedback into LLMs for Feedback-Independent Reasoning
di: Yang, Kang, et al.
Pubblicazione: (2025)
di: Yang, Kang, et al.
Pubblicazione: (2025)
Automatic Curriculum Expert Iteration for Reliable LLM Reasoning
di: Zhao, Zirui, et al.
Pubblicazione: (2024)
di: Zhao, Zirui, et al.
Pubblicazione: (2024)
Requesting Expert Reasoning: Augmenting LLM Agents with Learned Collaborative Intervention
di: Wang, Zhiming, et al.
Pubblicazione: (2026)
di: Wang, Zhiming, et al.
Pubblicazione: (2026)
MorphoBench: A Benchmark with Difficulty Adaptive to Model Reasoning
di: Wang, Xukai, et al.
Pubblicazione: (2025)
di: Wang, Xukai, et al.
Pubblicazione: (2025)
Learn to Think: Bootstrapping LLM Reasoning Capability Through Graph Representation Learning
di: Gao, Hang, et al.
Pubblicazione: (2025)
di: Gao, Hang, et al.
Pubblicazione: (2025)
LLMCL-GEC: Advancing Grammatical Error Correction with LLM-Driven Curriculum Learning
di: Fang, Tao, et al.
Pubblicazione: (2024)
di: Fang, Tao, et al.
Pubblicazione: (2024)
Make Every Penny Count: Difficulty-Adaptive Self-Consistency for Cost-Efficient Reasoning
di: Wang, Xinglin, et al.
Pubblicazione: (2024)
di: Wang, Xinglin, et al.
Pubblicazione: (2024)
Capability-aware Prompt Reformulation Learning for Text-to-Image Generation
di: Zhan, Jingtao, et al.
Pubblicazione: (2024)
di: Zhan, Jingtao, et al.
Pubblicazione: (2024)
Mitigating Overthinking in Large Reasoning Models via Difficulty-aware Reinforcement Learning
di: Wan, Qian, et al.
Pubblicazione: (2026)
di: Wan, Qian, et al.
Pubblicazione: (2026)
VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning
di: Yuan, Ruifeng, et al.
Pubblicazione: (2025)
di: Yuan, Ruifeng, et al.
Pubblicazione: (2025)
DARE: Difficulty-Adaptive Reinforcement Learning with Co-Evolved Difficulty Estimation
di: Zhou, Yang, et al.
Pubblicazione: (2026)
di: Zhou, Yang, et al.
Pubblicazione: (2026)
Cog-DRIFT: Exploration on Adaptively Reformulated Instances Enables Learning from Hard Reasoning Problems
di: Chen, Justin Chih-Yao, et al.
Pubblicazione: (2026)
di: Chen, Justin Chih-Yao, et al.
Pubblicazione: (2026)
Learning with Challenges: Adaptive Difficulty-Aware Data Generation for Mobile GUI Agent Training
di: Kang, Linjia, et al.
Pubblicazione: (2026)
di: Kang, Linjia, et al.
Pubblicazione: (2026)
DART: Difficulty-Adaptive Reasoning Truncation for Efficient Large Language Models
di: Zhang, Ruofan, et al.
Pubblicazione: (2025)
di: Zhang, Ruofan, et al.
Pubblicazione: (2025)
SWE-RL: Advancing LLM Reasoning via Reinforcement Learning on Open Software Evolution
di: Wei, Yuxiang, et al.
Pubblicazione: (2025)
di: Wei, Yuxiang, et al.
Pubblicazione: (2025)
Discovering Novel LLM Experts via Task-Capability Coevolution
di: Dai, Andrew, et al.
Pubblicazione: (2026)
di: Dai, Andrew, et al.
Pubblicazione: (2026)
Tailored Teaching with Balanced Difficulty: Elevating Reasoning in Multimodal Chain-of-Thought via Prompt Curriculum
di: Yang, Xinglong, et al.
Pubblicazione: (2025)
di: Yang, Xinglong, et al.
Pubblicazione: (2025)
Self-Guided Defense: Adaptive Safety Alignment for Reasoning Models via Synthesized Guidelines
di: Wang, Yuhang, et al.
Pubblicazione: (2025)
di: Wang, Yuhang, et al.
Pubblicazione: (2025)
EvaLearn: Quantifying the Learning Capability and Efficiency of LLMs via Sequential Problem Solving
di: Dou, Shihan, et al.
Pubblicazione: (2025)
di: Dou, Shihan, et al.
Pubblicazione: (2025)
Graph-R1: Incentivizing the Zero-Shot Graph Learning Capability in LLMs via Explicit Reasoning
di: Wu, Yicong, et al.
Pubblicazione: (2025)
di: Wu, Yicong, et al.
Pubblicazione: (2025)
Unlocking Reasoning Capabilities in LLMs via Reinforcement Learning Exploration
di: Deng, Wenhao, et al.
Pubblicazione: (2025)
di: Deng, Wenhao, et al.
Pubblicazione: (2025)
Curriculum Reinforcement Learning from Easy to Hard Tasks Improves LLM Reasoning
di: Parashar, Shubham, et al.
Pubblicazione: (2025)
di: Parashar, Shubham, et al.
Pubblicazione: (2025)
From Reasoning Chains to Verifiable Subproblems: Curriculum Reinforcement Learning Enables Credit Assignment for LLM Reasoning
di: Jiang, Xitai, et al.
Pubblicazione: (2026)
di: Jiang, Xitai, et al.
Pubblicazione: (2026)
The LLM Already Knows: Estimating LLM-Perceived Question Difficulty via Hidden Representations
di: Zhu, Yubo, et al.
Pubblicazione: (2025)
di: Zhu, Yubo, et al.
Pubblicazione: (2025)
Adaptive Multi-Expert Reasoning via Difficulty-Aware Routing and Uncertainty-Guided Aggregation
di: Ehab, Mohamed, et al.
Pubblicazione: (2026)
di: Ehab, Mohamed, et al.
Pubblicazione: (2026)
VAPO: Efficient and Reliable Reinforcement Learning for Advanced Reasoning Tasks
di: Yue, Yu, et al.
Pubblicazione: (2025)
di: Yue, Yu, et al.
Pubblicazione: (2025)
StoryCoder: Narrative Reformulation for Structured Reasoning in LLM Code Generation
di: Jang, Geonhui, et al.
Pubblicazione: (2026)
di: Jang, Geonhui, et al.
Pubblicazione: (2026)
Human-Aware Robot Navigation via Reinforcement Learning with Hindsight Experience Replay and Curriculum Learning
di: Li, Keyu, et al.
Pubblicazione: (2021)
di: Li, Keyu, et al.
Pubblicazione: (2021)
WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning
di: Zhuang, Yuchen, et al.
Pubblicazione: (2025)
di: Zhuang, Yuchen, et al.
Pubblicazione: (2025)
Online Difficulty Filtering for Reasoning Oriented Reinforcement Learning
di: Bae, Sanghwan, et al.
Pubblicazione: (2025)
di: Bae, Sanghwan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Harder Is Better: Boosting Mathematical Reasoning via Difficulty-Aware GRPO and Multi-Aspect Question Reformulation
di: Dai, Yanqi, et al.
Pubblicazione: (2026) -
Enhancing LLM Reasoning via Non-Human-Like Reasoning Path Preference Optimization
di: Lu, Junjie, et al.
Pubblicazione: (2025) -
MathMixup: Boosting LLM Mathematical Reasoning with Difficulty-Controllable Data Synthesis and Curriculum Learning
di: Li, Xuchen, et al.
Pubblicazione: (2026) -
Self-Evolving Curriculum for LLM Reasoning
di: Chen, Xiaoyin, et al.
Pubblicazione: (2025) -
CLPO: Curriculum Learning meets Policy Optimization for LLM Reasoning
di: Zhang, Shijie, et al.
Pubblicazione: (2025)