The Thinking Spectrum: An Empirical Study of Tunable Reasoning in LLMs through Model Merging
Fuente:
arXiv
Guardado en:
| Autores principales: | Lan, Xiaochong, Zheng, Yu, Cao, Shiteng, Li, Yong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Stance Detection with Collaborative Role-Infused LLM-Based Agents
por: Lan, Xiaochong, et al.
Publicado: (2023)
por: Lan, Xiaochong, et al.
Publicado: (2023)
LocalGPT: Benchmarking and Advancing Large Language Models for Local Life Services in Meituan
por: Lan, Xiaochong, et al.
Publicado: (2025)
por: Lan, Xiaochong, et al.
Publicado: (2025)
AutoQual: An LLM Agent for Automated Discovery of Interpretable Features for Review Quality Assessment
por: Lan, Xiaochong, et al.
Publicado: (2025)
por: Lan, Xiaochong, et al.
Publicado: (2025)
Depression Detection on Social Media with Large Language Models
por: Lan, Xiaochong, et al.
Publicado: (2024)
por: Lan, Xiaochong, et al.
Publicado: (2024)
An Empirical Study on Prompt Compression for Large Language Models
por: Zhang, Zheng, et al.
Publicado: (2025)
por: Zhang, Zheng, et al.
Publicado: (2025)
The Zero-Step Thinking: An Empirical Study of Mode Selection as Harder Early Exit in Reasoning Models
por: Tan, Yuqiao, et al.
Publicado: (2025)
por: Tan, Yuqiao, et al.
Publicado: (2025)
Quantization Hurts Reasoning? An Empirical Study on Quantized Reasoning Models
por: Liu, Ruikang, et al.
Publicado: (2025)
por: Liu, Ruikang, et al.
Publicado: (2025)
Do LLMs Really Think Step-by-step In Implicit Reasoning?
por: Yu, Yijiong
Publicado: (2024)
por: Yu, Yijiong
Publicado: (2024)
Multiplex Thinking: Reasoning via Token-wise Branch-and-Merge
por: Tang, Yao, et al.
Publicado: (2026)
por: Tang, Yao, et al.
Publicado: (2026)
Think or Not? Exploring Thinking Efficiency in Large Reasoning Models via an Information-Theoretic Lens
por: Yong, Xixian, et al.
Publicado: (2025)
por: Yong, Xixian, et al.
Publicado: (2025)
Draft-Thinking: Learning Efficient Reasoning in Long Chain-of-Thought LLMs
por: Cao, Jie, et al.
Publicado: (2026)
por: Cao, Jie, et al.
Publicado: (2026)
ReasonAny: Incorporating Reasoning Capability to Any Model via Simple and Effective Model Merging
por: Yang, Junyao, et al.
Publicado: (2026)
por: Yang, Junyao, et al.
Publicado: (2026)
Towards Large Reasoning Models: A Survey of Reinforced Reasoning with Large Language Models
por: Xu, Fengli, et al.
Publicado: (2025)
por: Xu, Fengli, et al.
Publicado: (2025)
Between Underthinking and Overthinking: An Empirical Study of Reasoning Length and correctness in LLMs
por: Su, Jinyan, et al.
Publicado: (2025)
por: Su, Jinyan, et al.
Publicado: (2025)
SwiReasoning: Switch-Thinking in Latent and Explicit for Pareto-Superior Reasoning LLMs
por: Shi, Dachuan, et al.
Publicado: (2025)
por: Shi, Dachuan, et al.
Publicado: (2025)
Controlling Thinking Speed in Reasoning Models
por: Lin, Zhengkai, et al.
Publicado: (2025)
por: Lin, Zhengkai, et al.
Publicado: (2025)
Safety Through Reasoning: An Empirical Study of Reasoning Guardrail Models
por: Sreedhar, Makesh Narsimhan, et al.
Publicado: (2025)
por: Sreedhar, Makesh Narsimhan, et al.
Publicado: (2025)
An Empirical Survey of Model Merging Algorithms for Social Bias Mitigation
por: Shirafuji, Daiki, et al.
Publicado: (2025)
por: Shirafuji, Daiki, et al.
Publicado: (2025)
SuperMerge: An Approach For Gradient-Based Model Merging
por: Yang, Haoyu, et al.
Publicado: (2024)
por: Yang, Haoyu, et al.
Publicado: (2024)
Explore the Potential of LLMs in Misinformation Detection: An Empirical Study
por: Chen, Mengyang, et al.
Publicado: (2023)
por: Chen, Mengyang, et al.
Publicado: (2023)
Adapting Language-Specific LLMs to a Reasoning Model in One Day via Model Merging -- An Open Recipe
por: Pipatanakul, Kunat, et al.
Publicado: (2025)
por: Pipatanakul, Kunat, et al.
Publicado: (2025)
Evaluating Large Language Models on Financial Report Summarization: An Empirical Study
por: Yang, Xinqi, et al.
Publicado: (2024)
por: Yang, Xinqi, et al.
Publicado: (2024)
Reverse Thinking Makes LLMs Stronger Reasoners
por: Chen, Justin Chih-Yao, et al.
Publicado: (2024)
por: Chen, Justin Chih-Yao, et al.
Publicado: (2024)
To Think or Not To Think, That is The Question for Large Reasoning Models in Theory of Mind Tasks
por: Gong, Nanxu, et al.
Publicado: (2026)
por: Gong, Nanxu, et al.
Publicado: (2026)
Read Quietly, Think Aloud: Decoupling Comprehension and Reasoning in LLMs
por: Wang, Yuanxin, et al.
Publicado: (2025)
por: Wang, Yuanxin, et al.
Publicado: (2025)
Thinking LLMs: General Instruction Following with Thought Generation
por: Wu, Tianhao, et al.
Publicado: (2024)
por: Wu, Tianhao, et al.
Publicado: (2024)
An Empirical Study of Data Ability Boundary in LLMs' Math Reasoning
por: Chen, Zui, et al.
Publicado: (2024)
por: Chen, Zui, et al.
Publicado: (2024)
ThinkPilot: Steering Reasoning Models via Automated Think-prefixes Optimization
por: Li, Sunzhu, et al.
Publicado: (2025)
por: Li, Sunzhu, et al.
Publicado: (2025)
Soft Thinking: Unlocking the Reasoning Potential of LLMs in Continuous Concept Space
por: Zhang, Zhen, et al.
Publicado: (2025)
por: Zhang, Zhen, et al.
Publicado: (2025)
LLMs are Single-threaded Reasoners: Demystifying the Working Mechanism of Soft Thinking
por: Wu, Junhong, et al.
Publicado: (2025)
por: Wu, Junhong, et al.
Publicado: (2025)
Efficient Reasoning with Balanced Thinking
por: Li, Yulin, et al.
Publicado: (2026)
por: Li, Yulin, et al.
Publicado: (2026)
Effectively Controlling Reasoning Models through Thinking Intervention
por: Wu, Tong, et al.
Publicado: (2025)
por: Wu, Tong, et al.
Publicado: (2025)
Reasoning Pattern Alignment Merging for Adaptive Reasoning
por: Zhong, Zhaofeng, et al.
Publicado: (2026)
por: Zhong, Zhaofeng, et al.
Publicado: (2026)
RCP-Merging: Merging Long Chain-of-Thought Models with Domain-Specific Models by Considering Reasoning Capability as Prior
por: Yang, Junyao, et al.
Publicado: (2025)
por: Yang, Junyao, et al.
Publicado: (2025)
Can We Predict Alignment Before Models Finish Thinking? Towards Monitoring Misaligned Reasoning Models
por: Chan, Yik Siu, et al.
Publicado: (2025)
por: Chan, Yik Siu, et al.
Publicado: (2025)
Modeling Hierarchical Thinking in Large Reasoning Models
por: Shahariar, G M, et al.
Publicado: (2025)
por: Shahariar, G M, et al.
Publicado: (2025)
Multi-task Code LLMs: Data Mix or Model Merge?
por: Zhu, Mingzhi, et al.
Publicado: (2026)
por: Zhu, Mingzhi, et al.
Publicado: (2026)
Thinking About Thinking: Evaluating Reasoning in Post-Trained Language Models
por: Singla, Pratham, et al.
Publicado: (2025)
por: Singla, Pratham, et al.
Publicado: (2025)
Pruning via Merging: Compressing LLMs via Manifold Alignment Based Layer Merging
por: Liu, Deyuan, et al.
Publicado: (2024)
por: Liu, Deyuan, et al.
Publicado: (2024)
KAG-Thinker: Interactive Thinking and Deep Reasoning in LLMs via Knowledge-Augmented Generation
por: Zhang, Dalong, et al.
Publicado: (2025)
por: Zhang, Dalong, et al.
Publicado: (2025)
Ejemplares similares
-
Stance Detection with Collaborative Role-Infused LLM-Based Agents
por: Lan, Xiaochong, et al.
Publicado: (2023) -
LocalGPT: Benchmarking and Advancing Large Language Models for Local Life Services in Meituan
por: Lan, Xiaochong, et al.
Publicado: (2025) -
AutoQual: An LLM Agent for Automated Discovery of Interpretable Features for Review Quality Assessment
por: Lan, Xiaochong, et al.
Publicado: (2025) -
Depression Detection on Social Media with Large Language Models
por: Lan, Xiaochong, et al.
Publicado: (2024) -
An Empirical Study on Prompt Compression for Large Language Models
por: Zhang, Zheng, et al.
Publicado: (2025)