Staying in the Sweet Spot: Responsive Reasoning Evolution via Capability-Adaptive Hint Scaffolding
Fuente:
arXiv
Saved in:
| Main Authors: | Li, Ziheng, Sun, Zexu, Zhao, Jinman, Min, Erxue, Zeng, Yongcheng, Wu, Hui, Cai, Hengyi, Wang, Shuaiqiang, Yin, Dawei, Chen, Xu, Deng, Zhi-Hong |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
CurES: From Gradient Analysis to Efficient Curriculum Learning for Reasoning LLMs
by: Zeng, Yongcheng, et al.
Published: (2025)
by: Zeng, Yongcheng, et al.
Published: (2025)
Solving the Granularity Mismatch: Hierarchical Preference Learning for Long-Horizon LLM Agents
by: Gao, Heyang, et al.
Published: (2025)
by: Gao, Heyang, et al.
Published: (2025)
Not All Preferences Are Created Equal: Stability-Aware and Gradient-Efficient Alignment for Reasoning Models
by: Wu, Hui, et al.
Published: (2026)
by: Wu, Hui, et al.
Published: (2026)
Cog-Rethinker: Hierarchical Metacognitive Reinforcement Learning for LLM Reasoning
by: Sun, Zexu, et al.
Published: (2025)
by: Sun, Zexu, et al.
Published: (2025)
Efficient Thought Space Exploration Through Strategic Intervention
by: Li, Ziheng, et al.
Published: (2025)
by: Li, Ziheng, et al.
Published: (2025)
CTR-Guided Generative Query Suggestion in Conversational Search
by: Min, Erxue, et al.
Published: (2025)
by: Min, Erxue, et al.
Published: (2025)
From Prompting to Alignment: A Generative Framework for Query Recommendation
by: Min, Erxue, et al.
Published: (2025)
by: Min, Erxue, et al.
Published: (2025)
MatchTIR: Fine-Grained Supervision for Tool-Integrated Reasoning via Bipartite Matching
by: Qu, Changle, et al.
Published: (2026)
by: Qu, Changle, et al.
Published: (2026)
XL$^2$Bench: A Benchmark for Extremely Long Context Understanding with Long-range Dependencies
by: Ni, Xuanfan, et al.
Published: (2024)
by: Ni, Xuanfan, et al.
Published: (2024)
AdaSwitch: Balancing Exploration and Guidance in Knowledge Distillation via Adaptive Switching
by: Peng, Jingyu, et al.
Published: (2025)
by: Peng, Jingyu, et al.
Published: (2025)
AgentSkiller: Scaling Generalist Agent Intelligence through Semantically Integrated Cross-Domain Data Synthesis
by: Sun, Zexu, et al.
Published: (2026)
by: Sun, Zexu, et al.
Published: (2026)
AdaSwitch: Adaptive Switching between Small and Large Agents for Effective Cloud-Local Collaborative Learning
by: Sun, Hao, et al.
Published: (2024)
by: Sun, Hao, et al.
Published: (2024)
MARA: A Multimodal Adaptive Retrieval-Augmented Framework for Document Question Answering
by: Wu, Hui, et al.
Published: (2026)
by: Wu, Hui, et al.
Published: (2026)
Hyperbolic Knowledge Transfer in Cross-Domain Recommendation System
by: Yang, Xin, et al.
Published: (2024)
by: Yang, Xin, et al.
Published: (2024)
LLMs + Persona-Plug = Personalized LLMs
by: Liu, Jiongnan, et al.
Published: (2024)
by: Liu, Jiongnan, et al.
Published: (2024)
Sweet Spots
by: Sempert, Mattie-Martha
Published: (2021)
by: Sempert, Mattie-Martha
Published: (2021)
Cross-model Control: Improving Multiple Large Language Models in One-time Training
by: Wu, Jiayi, et al.
Published: (2024)
by: Wu, Jiayi, et al.
Published: (2024)
AdaFuse: Accelerating Dynamic Adapter Inference via Token-Level Pre-Gating and Fused Kernel Optimization
by: Li, Qiyang, et al.
Published: (2026)
by: Li, Qiyang, et al.
Published: (2026)
Towards Verifiable Text Generation with Evolving Memory and Self-Reflection
by: Sun, Hao, et al.
Published: (2023)
by: Sun, Hao, et al.
Published: (2023)
PA-RAG: RAG Alignment via Multi-Perspective Preference Optimization
by: Wu, Jiayi, et al.
Published: (2024)
by: Wu, Jiayi, et al.
Published: (2024)
A Question Answering Dataset for Temporal-Sensitive Retrieval-Augmented Generation
by: Chen, Ziyang, et al.
Published: (2025)
by: Chen, Ziyang, et al.
Published: (2025)
Reasoning-to-Defend: Safety-Aware Reasoning Can Defend Large Language Models from Jailbreaking
by: Zhu, Junda, et al.
Published: (2025)
by: Zhu, Junda, et al.
Published: (2025)
From Exploration to Mastery: Enabling LLMs to Master Tools via Self-Driven Interactions
by: Qu, Changle, et al.
Published: (2024)
by: Qu, Changle, et al.
Published: (2024)
Towards Completeness-Oriented Tool Retrieval for Large Language Models
by: Qu, Changle, et al.
Published: (2024)
by: Qu, Changle, et al.
Published: (2024)
Tool Learning with Large Language Models: A Survey
by: Qu, Changle, et al.
Published: (2024)
by: Qu, Changle, et al.
Published: (2024)
The AI Transcription Sweet Spot
by: Rosehill, Daniel, et al.
Published: (2026)
by: Rosehill, Daniel, et al.
Published: (2026)
Pareto-Front Engineering of Dynamical Sweet Spots in Superconducting Qubits
by: Yang, Zhen, et al.
Published: (2026)
by: Yang, Zhen, et al.
Published: (2026)
Restoring the Sweet Spot: Pass-Rate Weighted Self-Distillation for LLM Reasoning
by: Liu, Zehao, et al.
Published: (2026)
by: Liu, Zehao, et al.
Published: (2026)
LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance
by: Fan, Yuchun, et al.
Published: (2026)
by: Fan, Yuchun, et al.
Published: (2026)
Hindsight Hint Distillation: Scaffolded Reasoning for SWE Agents from CoT-free Answers
by: Wang, Shengjie, et al.
Published: (2026)
by: Wang, Shengjie, et al.
Published: (2026)
Analysis of Rock Physical Properties and Evaluation of Reservoir ‘Sweet Spots’ in Marine Shale of the Ordovician Wulalike Formation, Western Ordos Basin
by: Longlong Yan, et al.
Published: (2025)
by: Longlong Yan, et al.
Published: (2025)
The Sweet Spot of Bound Tightening for Topology Optimization
by: Pineda, Salvador, et al.
Published: (2025)
by: Pineda, Salvador, et al.
Published: (2025)
Collection Development: Hitting the Sweet Spot (Baking)
by: Charles, John
Published: (2010)
by: Charles, John
Published: (2010)
DaRec: A Disentangled Alignment Framework for Large Language Model and Recommender System
by: Yang, Xihong, et al.
Published: (2024)
by: Yang, Xihong, et al.
Published: (2024)
Mixture of Experts in Image Classification: What's the Sweet Spot?
by: Videau, Mathurin, et al.
Published: (2024)
by: Videau, Mathurin, et al.
Published: (2024)
MAO-ARAG: Multi-Agent Orchestration for Adaptive Retrieval-Augmented Generation
by: Chen, Yiqun, et al.
Published: (2025)
by: Chen, Yiqun, et al.
Published: (2025)
StructGS: Adaptive Spherical Harmonics and Rendering Enhancements for Superior 3D Gaussian Splatting
by: Huang, Zexu, et al.
Published: (2025)
by: Huang, Zexu, et al.
Published: (2025)
DOCE: Finding the Sweet Spot for Execution-Based Code Generation
by: Li, Haau-Sing, et al.
Published: (2024)
by: Li, Haau-Sing, et al.
Published: (2024)
SSL: Sweet Spot Learning for Differentiated Guidance in Agentic Optimization
by: Wu, Jinyang, et al.
Published: (2026)
by: Wu, Jinyang, et al.
Published: (2026)
Not Too Generative, Not Too Discriminative: The Human Alignment Sweet Spot
by: Ortega, Jorge Chang, et al.
Published: (2026)
by: Ortega, Jorge Chang, et al.
Published: (2026)
Similar Items
-
CurES: From Gradient Analysis to Efficient Curriculum Learning for Reasoning LLMs
by: Zeng, Yongcheng, et al.
Published: (2025) -
Solving the Granularity Mismatch: Hierarchical Preference Learning for Long-Horizon LLM Agents
by: Gao, Heyang, et al.
Published: (2025) -
Not All Preferences Are Created Equal: Stability-Aware and Gradient-Efficient Alignment for Reasoning Models
by: Wu, Hui, et al.
Published: (2026) -
Cog-Rethinker: Hierarchical Metacognitive Reinforcement Learning for LLM Reasoning
by: Sun, Zexu, et al.
Published: (2025) -
Efficient Thought Space Exploration Through Strategic Intervention
by: Li, Ziheng, et al.
Published: (2025)