The Thinking Spectrum: An Empirical Study of Tunable Reasoning in LLMs through Model Merging
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lan, Xiaochong, Zheng, Yu, Cao, Shiteng, Li, Yong |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Stance Detection with Collaborative Role-Infused LLM-Based Agents
par: Lan, Xiaochong, et autres
Publié: (2023)
par: Lan, Xiaochong, et autres
Publié: (2023)
LocalGPT: Benchmarking and Advancing Large Language Models for Local Life Services in Meituan
par: Lan, Xiaochong, et autres
Publié: (2025)
par: Lan, Xiaochong, et autres
Publié: (2025)
AutoQual: An LLM Agent for Automated Discovery of Interpretable Features for Review Quality Assessment
par: Lan, Xiaochong, et autres
Publié: (2025)
par: Lan, Xiaochong, et autres
Publié: (2025)
Depression Detection on Social Media with Large Language Models
par: Lan, Xiaochong, et autres
Publié: (2024)
par: Lan, Xiaochong, et autres
Publié: (2024)
An Empirical Study on Prompt Compression for Large Language Models
par: Zhang, Zheng, et autres
Publié: (2025)
par: Zhang, Zheng, et autres
Publié: (2025)
The Zero-Step Thinking: An Empirical Study of Mode Selection as Harder Early Exit in Reasoning Models
par: Tan, Yuqiao, et autres
Publié: (2025)
par: Tan, Yuqiao, et autres
Publié: (2025)
Quantization Hurts Reasoning? An Empirical Study on Quantized Reasoning Models
par: Liu, Ruikang, et autres
Publié: (2025)
par: Liu, Ruikang, et autres
Publié: (2025)
Do LLMs Really Think Step-by-step In Implicit Reasoning?
par: Yu, Yijiong
Publié: (2024)
par: Yu, Yijiong
Publié: (2024)
Multiplex Thinking: Reasoning via Token-wise Branch-and-Merge
par: Tang, Yao, et autres
Publié: (2026)
par: Tang, Yao, et autres
Publié: (2026)
Think or Not? Exploring Thinking Efficiency in Large Reasoning Models via an Information-Theoretic Lens
par: Yong, Xixian, et autres
Publié: (2025)
par: Yong, Xixian, et autres
Publié: (2025)
Draft-Thinking: Learning Efficient Reasoning in Long Chain-of-Thought LLMs
par: Cao, Jie, et autres
Publié: (2026)
par: Cao, Jie, et autres
Publié: (2026)
ReasonAny: Incorporating Reasoning Capability to Any Model via Simple and Effective Model Merging
par: Yang, Junyao, et autres
Publié: (2026)
par: Yang, Junyao, et autres
Publié: (2026)
Towards Large Reasoning Models: A Survey of Reinforced Reasoning with Large Language Models
par: Xu, Fengli, et autres
Publié: (2025)
par: Xu, Fengli, et autres
Publié: (2025)
Between Underthinking and Overthinking: An Empirical Study of Reasoning Length and correctness in LLMs
par: Su, Jinyan, et autres
Publié: (2025)
par: Su, Jinyan, et autres
Publié: (2025)
SwiReasoning: Switch-Thinking in Latent and Explicit for Pareto-Superior Reasoning LLMs
par: Shi, Dachuan, et autres
Publié: (2025)
par: Shi, Dachuan, et autres
Publié: (2025)
Controlling Thinking Speed in Reasoning Models
par: Lin, Zhengkai, et autres
Publié: (2025)
par: Lin, Zhengkai, et autres
Publié: (2025)
Safety Through Reasoning: An Empirical Study of Reasoning Guardrail Models
par: Sreedhar, Makesh Narsimhan, et autres
Publié: (2025)
par: Sreedhar, Makesh Narsimhan, et autres
Publié: (2025)
An Empirical Survey of Model Merging Algorithms for Social Bias Mitigation
par: Shirafuji, Daiki, et autres
Publié: (2025)
par: Shirafuji, Daiki, et autres
Publié: (2025)
SuperMerge: An Approach For Gradient-Based Model Merging
par: Yang, Haoyu, et autres
Publié: (2024)
par: Yang, Haoyu, et autres
Publié: (2024)
Explore the Potential of LLMs in Misinformation Detection: An Empirical Study
par: Chen, Mengyang, et autres
Publié: (2023)
par: Chen, Mengyang, et autres
Publié: (2023)
Adapting Language-Specific LLMs to a Reasoning Model in One Day via Model Merging -- An Open Recipe
par: Pipatanakul, Kunat, et autres
Publié: (2025)
par: Pipatanakul, Kunat, et autres
Publié: (2025)
Evaluating Large Language Models on Financial Report Summarization: An Empirical Study
par: Yang, Xinqi, et autres
Publié: (2024)
par: Yang, Xinqi, et autres
Publié: (2024)
Reverse Thinking Makes LLMs Stronger Reasoners
par: Chen, Justin Chih-Yao, et autres
Publié: (2024)
par: Chen, Justin Chih-Yao, et autres
Publié: (2024)
To Think or Not To Think, That is The Question for Large Reasoning Models in Theory of Mind Tasks
par: Gong, Nanxu, et autres
Publié: (2026)
par: Gong, Nanxu, et autres
Publié: (2026)
Read Quietly, Think Aloud: Decoupling Comprehension and Reasoning in LLMs
par: Wang, Yuanxin, et autres
Publié: (2025)
par: Wang, Yuanxin, et autres
Publié: (2025)
Thinking LLMs: General Instruction Following with Thought Generation
par: Wu, Tianhao, et autres
Publié: (2024)
par: Wu, Tianhao, et autres
Publié: (2024)
An Empirical Study of Data Ability Boundary in LLMs' Math Reasoning
par: Chen, Zui, et autres
Publié: (2024)
par: Chen, Zui, et autres
Publié: (2024)
ThinkPilot: Steering Reasoning Models via Automated Think-prefixes Optimization
par: Li, Sunzhu, et autres
Publié: (2025)
par: Li, Sunzhu, et autres
Publié: (2025)
Soft Thinking: Unlocking the Reasoning Potential of LLMs in Continuous Concept Space
par: Zhang, Zhen, et autres
Publié: (2025)
par: Zhang, Zhen, et autres
Publié: (2025)
LLMs are Single-threaded Reasoners: Demystifying the Working Mechanism of Soft Thinking
par: Wu, Junhong, et autres
Publié: (2025)
par: Wu, Junhong, et autres
Publié: (2025)
Efficient Reasoning with Balanced Thinking
par: Li, Yulin, et autres
Publié: (2026)
par: Li, Yulin, et autres
Publié: (2026)
Effectively Controlling Reasoning Models through Thinking Intervention
par: Wu, Tong, et autres
Publié: (2025)
par: Wu, Tong, et autres
Publié: (2025)
Reasoning Pattern Alignment Merging for Adaptive Reasoning
par: Zhong, Zhaofeng, et autres
Publié: (2026)
par: Zhong, Zhaofeng, et autres
Publié: (2026)
RCP-Merging: Merging Long Chain-of-Thought Models with Domain-Specific Models by Considering Reasoning Capability as Prior
par: Yang, Junyao, et autres
Publié: (2025)
par: Yang, Junyao, et autres
Publié: (2025)
Can We Predict Alignment Before Models Finish Thinking? Towards Monitoring Misaligned Reasoning Models
par: Chan, Yik Siu, et autres
Publié: (2025)
par: Chan, Yik Siu, et autres
Publié: (2025)
Modeling Hierarchical Thinking in Large Reasoning Models
par: Shahariar, G M, et autres
Publié: (2025)
par: Shahariar, G M, et autres
Publié: (2025)
Multi-task Code LLMs: Data Mix or Model Merge?
par: Zhu, Mingzhi, et autres
Publié: (2026)
par: Zhu, Mingzhi, et autres
Publié: (2026)
Thinking About Thinking: Evaluating Reasoning in Post-Trained Language Models
par: Singla, Pratham, et autres
Publié: (2025)
par: Singla, Pratham, et autres
Publié: (2025)
Pruning via Merging: Compressing LLMs via Manifold Alignment Based Layer Merging
par: Liu, Deyuan, et autres
Publié: (2024)
par: Liu, Deyuan, et autres
Publié: (2024)
KAG-Thinker: Interactive Thinking and Deep Reasoning in LLMs via Knowledge-Augmented Generation
par: Zhang, Dalong, et autres
Publié: (2025)
par: Zhang, Dalong, et autres
Publié: (2025)
Documents similaires
-
Stance Detection with Collaborative Role-Infused LLM-Based Agents
par: Lan, Xiaochong, et autres
Publié: (2023) -
LocalGPT: Benchmarking and Advancing Large Language Models for Local Life Services in Meituan
par: Lan, Xiaochong, et autres
Publié: (2025) -
AutoQual: An LLM Agent for Automated Discovery of Interpretable Features for Review Quality Assessment
par: Lan, Xiaochong, et autres
Publié: (2025) -
Depression Detection on Social Media with Large Language Models
par: Lan, Xiaochong, et autres
Publié: (2024) -
An Empirical Study on Prompt Compression for Large Language Models
par: Zhang, Zheng, et autres
Publié: (2025)