Pruning Long Chain-of-Thought of Large Reasoning Models via Small-Scale Preference Optimization
Fuente:
arXiv
Salvato in:
| Autori principali: | Hong, Bin, Liu, Jiayu, Zhang, Kai, Sun, Jianwen, Zhang, Mengdi, Huang, Zhenya |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Verifying Large Language Models' Reasoning Paths via Correlation Matrix Rank
di: Liu, Jiayu, et al.
Pubblicazione: (2025)
di: Liu, Jiayu, et al.
Pubblicazione: (2025)
ReasonFlux: Hierarchical LLM Reasoning via Scaling Thought Templates
di: Yang, Ling, et al.
Pubblicazione: (2025)
di: Yang, Ling, et al.
Pubblicazione: (2025)
End-to-End Graph Flattening Method for Large Language Models
di: Hong, Bin, et al.
Pubblicazione: (2024)
di: Hong, Bin, et al.
Pubblicazione: (2024)
Deconstructing Long Chain-of-Thought: A Structured Reasoning Optimization Framework for Long CoT Distillation
di: Luo, Yijia, et al.
Pubblicazione: (2025)
di: Luo, Yijia, et al.
Pubblicazione: (2025)
The Molecular Structure of Thought: Mapping the Topology of Long Chain-of-Thought Reasoning
di: Chen, Qiguang, et al.
Pubblicazione: (2026)
di: Chen, Qiguang, et al.
Pubblicazione: (2026)
Chain-of-Thought as a Lens: Evaluating Structured Reasoning Alignment between Human Preferences and Large Language Models
di: Wang, Boxuan, et al.
Pubblicazione: (2025)
di: Wang, Boxuan, et al.
Pubblicazione: (2025)
Reasoning Models Can be Accurately Pruned Via Chain-of-Thought Reconstruction
di: Lucas, Ryan, et al.
Pubblicazione: (2025)
di: Lucas, Ryan, et al.
Pubblicazione: (2025)
Streaming Hallucination Detection in Long Chain-of-Thought Reasoning
di: Lu, Haolang, et al.
Pubblicazione: (2026)
di: Lu, Haolang, et al.
Pubblicazione: (2026)
Rethinking Reasoning Quality in Large Language Models through Enhanced Chain-of-Thought via RL
di: He, Haoyang, et al.
Pubblicazione: (2025)
di: He, Haoyang, et al.
Pubblicazione: (2025)
EntroCut: Entropy-Guided Adaptive Truncation for Efficient Chain-of-Thought Reasoning in Small-scale Large Reasoning Models
di: Yan, Hongxi, et al.
Pubblicazione: (2026)
di: Yan, Hongxi, et al.
Pubblicazione: (2026)
Reasoning Matters: Mitigate Hallucination in Multimodal Large Reasoning Models via Reasoning-Conditioned Preference Optimization
di: Kong, Jiawei, et al.
Pubblicazione: (2026)
di: Kong, Jiawei, et al.
Pubblicazione: (2026)
What Makes a Good Reasoning Chain? Uncovering Structural Patterns in Long Chain-of-Thought Reasoning
di: Jiang, Gangwei, et al.
Pubblicazione: (2025)
di: Jiang, Gangwei, et al.
Pubblicazione: (2025)
NPG-Muse: Scaling Long Chain-of-Thought Reasoning with NP-Hard Graph Problems
di: Wang, Yuyao, et al.
Pubblicazione: (2025)
di: Wang, Yuyao, et al.
Pubblicazione: (2025)
Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models
di: Chen, Qiguang, et al.
Pubblicazione: (2025)
di: Chen, Qiguang, et al.
Pubblicazione: (2025)
Can Small Language Models Help Large Language Models Reason Better?: LM-Guided Chain-of-Thought
di: Lee, Jooyoung, et al.
Pubblicazione: (2024)
di: Lee, Jooyoung, et al.
Pubblicazione: (2024)
Training Multimodal Large Reasoning Models Needs Better Thoughts: A Three-Stage Framework for Long Chain-of-Thought Synthesis and Selection
di: Wang, Yizhi, et al.
Pubblicazione: (2025)
di: Wang, Yizhi, et al.
Pubblicazione: (2025)
Long Grounded Thoughts: Synthesizing Visual Problems and Reasoning Chains at Scale
di: Acuna, David, et al.
Pubblicazione: (2025)
di: Acuna, David, et al.
Pubblicazione: (2025)
DRT: Deep Reasoning Translation via Long Chain-of-Thought
di: Wang, Jiaan, et al.
Pubblicazione: (2024)
di: Wang, Jiaan, et al.
Pubblicazione: (2024)
Expediting and Elevating Large Language Model Reasoning via Hidden Chain-of-Thought Decoding
di: Liu, Tianqiao, et al.
Pubblicazione: (2024)
di: Liu, Tianqiao, et al.
Pubblicazione: (2024)
Enhancing Zero-Shot Chain-of-Thought Reasoning in Large Language Models through Logic
di: Zhao, Xufeng, et al.
Pubblicazione: (2023)
di: Zhao, Xufeng, et al.
Pubblicazione: (2023)
BadThink: Triggered Overthinking Attacks on Chain-of-Thought Reasoning in Large Language Models
di: Liu, Shuaitong, et al.
Pubblicazione: (2025)
di: Liu, Shuaitong, et al.
Pubblicazione: (2025)
Optimizing Small Language Models for NL2SQL via Chain-of-Thought Fine-Tuning
di: Solanki, Anshul, et al.
Pubblicazione: (2026)
di: Solanki, Anshul, et al.
Pubblicazione: (2026)
Reasoning Beyond Chain-of-Thought: A Latent Computational Mode in Large Language Models
di: He, Zhenghao, et al.
Pubblicazione: (2026)
di: He, Zhenghao, et al.
Pubblicazione: (2026)
Learning to Solve Geometry Problems via Simulating Human Dual-Reasoning Process
di: Xiao, Tong, et al.
Pubblicazione: (2024)
di: Xiao, Tong, et al.
Pubblicazione: (2024)
Understanding Reasoning in Chain-of-Thought from the Hopfieldian View
di: Hu, Lijie, et al.
Pubblicazione: (2024)
di: Hu, Lijie, et al.
Pubblicazione: (2024)
SafeChain: Safety of Language Models with Long Chain-of-Thought Reasoning Capabilities
di: Jiang, Fengqing, et al.
Pubblicazione: (2025)
di: Jiang, Fengqing, et al.
Pubblicazione: (2025)
Loong: Synthesize Long Chain-of-Thoughts at Scale through Verifiers
di: Huang, Xingyue, et al.
Pubblicazione: (2025)
di: Huang, Xingyue, et al.
Pubblicazione: (2025)
Diagnosing Pathological Chain-of-Thought in Reasoning Models
di: Liu, Manqing, et al.
Pubblicazione: (2026)
di: Liu, Manqing, et al.
Pubblicazione: (2026)
Towards Safer Large Reasoning Models by Promoting Safety Decision-Making before Chain-of-Thought Generation
di: Chen, Jianan, et al.
Pubblicazione: (2026)
di: Chen, Jianan, et al.
Pubblicazione: (2026)
Understanding Chain-of-Thought in Large Language Models via Topological Data Analysis
di: Li, Chenghao, et al.
Pubblicazione: (2025)
di: Li, Chenghao, et al.
Pubblicazione: (2025)
CoAT: Chain-of-Associated-Thoughts Framework for Enhancing Large Language Models Reasoning
di: Pan, Jianfeng, et al.
Pubblicazione: (2025)
di: Pan, Jianfeng, et al.
Pubblicazione: (2025)
LongCoT: Benchmarking Long-Horizon Chain-of-Thought Reasoning
di: Motwani, Sumeet Ramesh, et al.
Pubblicazione: (2026)
di: Motwani, Sumeet Ramesh, et al.
Pubblicazione: (2026)
Reason from Future: Reverse Thought Chain Enhances LLM Reasoning
di: Xu, Yinlong, et al.
Pubblicazione: (2025)
di: Xu, Yinlong, et al.
Pubblicazione: (2025)
Reinforcing Chain-of-Thought Reasoning with Self-Evolving Rubrics
di: Sheng, Leheng, et al.
Pubblicazione: (2026)
di: Sheng, Leheng, et al.
Pubblicazione: (2026)
Draft-Thinking: Learning Efficient Reasoning in Long Chain-of-Thought LLMs
di: Cao, Jie, et al.
Pubblicazione: (2026)
di: Cao, Jie, et al.
Pubblicazione: (2026)
Markov Chain of Thought for Efficient Mathematical Reasoning
di: Yang, Wen, et al.
Pubblicazione: (2024)
di: Yang, Wen, et al.
Pubblicazione: (2024)
Decoupling Understanding from Reasoning via Problem Space Mapping for Small-Scale Model Reasoning
di: Wang, Li, et al.
Pubblicazione: (2025)
di: Wang, Li, et al.
Pubblicazione: (2025)
Optimizing Chain-of-Thought Reasoners via Gradient Variance Minimization in Rejection Sampling and RL
di: Yao, Jiarui, et al.
Pubblicazione: (2025)
di: Yao, Jiarui, et al.
Pubblicazione: (2025)
UniCog: Uncovering Cognitive Abilities of LLMs through Latent Mind Space Analysis
di: Liu, Jiayu, et al.
Pubblicazione: (2026)
di: Liu, Jiayu, et al.
Pubblicazione: (2026)
Thoughts-as-Planning: Latent World Models for Chain-of-Thoughts Optimization via Reinforcement Planning
di: Liu, Dong, et al.
Pubblicazione: (2026)
di: Liu, Dong, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Verifying Large Language Models' Reasoning Paths via Correlation Matrix Rank
di: Liu, Jiayu, et al.
Pubblicazione: (2025) -
ReasonFlux: Hierarchical LLM Reasoning via Scaling Thought Templates
di: Yang, Ling, et al.
Pubblicazione: (2025) -
End-to-End Graph Flattening Method for Large Language Models
di: Hong, Bin, et al.
Pubblicazione: (2024) -
Deconstructing Long Chain-of-Thought: A Structured Reasoning Optimization Framework for Long CoT Distillation
di: Luo, Yijia, et al.
Pubblicazione: (2025) -
The Molecular Structure of Thought: Mapping the Topology of Long Chain-of-Thought Reasoning
di: Chen, Qiguang, et al.
Pubblicazione: (2026)