Early Stopping Chain-of-thoughts in Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Mao, Minjia, Yin, Bowen, Zhu, Yu, Fang, Xiao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Measuring Stereotype and Deviation Biases in Large Language Models
por: Wang, Daniel, et al.
Publicado: (2025)
por: Wang, Daniel, et al.
Publicado: (2025)
A General Method for Detecting Information Generated by Large Language Models
por: Mao, Minjia, et al.
Publicado: (2025)
por: Mao, Minjia, et al.
Publicado: (2025)
Watermarking Low-entropy Generation for Large Language Models: An Unbiased and Low-risk Method
por: Mao, Minjia, et al.
Publicado: (2024)
por: Mao, Minjia, et al.
Publicado: (2024)
Early Detection of Misinformation for Infodemic Management: A Domain Adaptation Approach
por: Mao, Minjia, et al.
Publicado: (2024)
por: Mao, Minjia, et al.
Publicado: (2024)
OCEAN: Offline Chain-of-thought Evaluation and Alignment in Large Language Models
por: Wu, Junda, et al.
Publicado: (2024)
por: Wu, Junda, et al.
Publicado: (2024)
Stop When Enough: Adaptive Early-Stopping for Chain-of-Thought Reasoning
por: Sun, Renliang, et al.
Publicado: (2025)
por: Sun, Renliang, et al.
Publicado: (2025)
Investigating Chain-of-thought with ChatGPT for Stance Detection on Social Media
por: Zhang, Bowen, et al.
Publicado: (2023)
por: Zhang, Bowen, et al.
Publicado: (2023)
Short-PHD: Detecting Short LLM-generated Text with Topological Data Analysis After Off-topic Content Insertion
por: Wei, Dongjun, et al.
Publicado: (2025)
por: Wei, Dongjun, et al.
Publicado: (2025)
PaD: Program-aided Distillation Can Teach Small Models Reasoning Better than Chain-of-thought Fine-tuning
por: Zhu, Xuekai, et al.
Publicado: (2023)
por: Zhu, Xuekai, et al.
Publicado: (2023)
Can Language Models Perform Robust Reasoning in Chain-of-thought Prompting with Noisy Rationales?
por: Zhou, Zhanke, et al.
Publicado: (2024)
por: Zhou, Zhanke, et al.
Publicado: (2024)
Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models
por: Zhao, Zekai, et al.
Publicado: (2025)
por: Zhao, Zekai, et al.
Publicado: (2025)
Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models
por: Sui, Yang, et al.
Publicado: (2025)
por: Sui, Yang, et al.
Publicado: (2025)
Just on Time: Token-Level Early Stopping for Diffusion Language Models
por: Kohut, Zahar, et al.
Publicado: (2026)
por: Kohut, Zahar, et al.
Publicado: (2026)
Early Stopping for Large Reasoning Models via Confidence Dynamics
por: Hosseini, Parsa, et al.
Publicado: (2026)
por: Hosseini, Parsa, et al.
Publicado: (2026)
Empowering Private Tutoring by Chaining Large Language Models
por: Chen, Yulin, et al.
Publicado: (2023)
por: Chen, Yulin, et al.
Publicado: (2023)
Recurrent Confidence Chain: Temporal-Aware Uncertainty Quantification in Large Language Models
por: Mao, Zhenjiang, et al.
Publicado: (2026)
por: Mao, Zhenjiang, et al.
Publicado: (2026)
Chain-of-thought Reviewing and Correction for Time Series Question Answering
por: Su, Chen, et al.
Publicado: (2025)
por: Su, Chen, et al.
Publicado: (2025)
Multi-round, Chain-of-thought Post-editing for Unfaithful Summaries
por: Lee, Yi-Hui, et al.
Publicado: (2025)
por: Lee, Yi-Hui, et al.
Publicado: (2025)
TERMINATOR: Learning Optimal Exit Points for Early Stopping in Chain-of-Thought Reasoning
por: Nagle, Alliot, et al.
Publicado: (2026)
por: Nagle, Alliot, et al.
Publicado: (2026)
MuSR: Testing the Limits of Chain-of-thought with Multistep Soft Reasoning
por: Sprague, Zayne, et al.
Publicado: (2023)
por: Sprague, Zayne, et al.
Publicado: (2023)
To CoT or not to CoT? Chain-of-thought helps mainly on math and symbolic reasoning
por: Sprague, Zayne, et al.
Publicado: (2024)
por: Sprague, Zayne, et al.
Publicado: (2024)
Graph Chain-of-Thought: Augmenting Large Language Models by Reasoning on Graphs
por: Jin, Bowen, et al.
Publicado: (2024)
por: Jin, Bowen, et al.
Publicado: (2024)
SimLens for Early Exit in Large Language Models: Eliciting Accurate Latent Predictions with One More Token
por: Ma, Ming, et al.
Publicado: (2025)
por: Ma, Ming, et al.
Publicado: (2025)
Stop When Reasoning Converges: Semantic-Preserving Early Exit for Reasoning Models
por: Min, Dehai, et al.
Publicado: (2026)
por: Min, Dehai, et al.
Publicado: (2026)
Answer Convergence as a Signal for Early Stopping in Reasoning
por: Liu, Xin, et al.
Publicado: (2025)
por: Liu, Xin, et al.
Publicado: (2025)
WikiChat: Stopping the Hallucination of Large Language Model Chatbots by Few-Shot Grounding on Wikipedia
por: Semnani, Sina J., et al.
Publicado: (2023)
por: Semnani, Sina J., et al.
Publicado: (2023)
Extend Model Merging from Fine-Tuned to Pre-Trained Large Language Models via Weight Disentanglement
por: Yu, Le, et al.
Publicado: (2024)
por: Yu, Le, et al.
Publicado: (2024)
Grasping the Essentials: Tailoring Large Language Models for Zero-Shot Relation Extraction
por: Zhou, Sizhe, et al.
Publicado: (2024)
por: Zhou, Sizhe, et al.
Publicado: (2024)
Model Tells You Where to Merge: Adaptive KV Cache Merging for LLMs on Long-Context Tasks
por: Wang, Zheng, et al.
Publicado: (2024)
por: Wang, Zheng, et al.
Publicado: (2024)
MuCRASP: Multimodal Chain-of-thought Reasoning aware Structured Pruning
por: Dutta, Aritra, et al.
Publicado: (2026)
por: Dutta, Aritra, et al.
Publicado: (2026)
AdaEDL: Early Draft Stopping for Speculative Decoding of Large Language Models via an Entropy-based Lower Bound on Token Acceptance Probability
por: Agrawal, Sudhanshu, et al.
Publicado: (2024)
por: Agrawal, Sudhanshu, et al.
Publicado: (2024)
NL2GenSym: Natural Language to Generative Symbolic Rules for SOAR Cognitive Architecture via Large Language Models
por: Yuan, Fang, et al.
Publicado: (2025)
por: Yuan, Fang, et al.
Publicado: (2025)
Your Models Have Thought Enough: Training Large Reasoning Models to Stop Overthinking
por: Han, Jinyi, et al.
Publicado: (2025)
por: Han, Jinyi, et al.
Publicado: (2025)
Aligning Large Language Models via Fully Self-Synthetic Data
por: Yin, Shangjian, et al.
Publicado: (2025)
por: Yin, Shangjian, et al.
Publicado: (2025)
Logit-Entropy Adaptive Stopping Heuristic for Efficient Chain-of-Thought Reasoning
por: Quamar, Mohammad Atif, et al.
Publicado: (2025)
por: Quamar, Mohammad Atif, et al.
Publicado: (2025)
MedCite: Can Language Models Generate Verifiable Text for Medicine?
por: Wang, Xiao, et al.
Publicado: (2025)
por: Wang, Xiao, et al.
Publicado: (2025)
ChainLM: Empowering Large Language Models with Improved Chain-of-Thought Prompting
por: Cheng, Xiaoxue, et al.
Publicado: (2024)
por: Cheng, Xiaoxue, et al.
Publicado: (2024)
Critic-CoT: Boosting the reasoning abilities of large language model via Chain-of-thoughts Critic
por: Zheng, Xin, et al.
Publicado: (2024)
por: Zheng, Xin, et al.
Publicado: (2024)
EL4NER: Ensemble Learning for Named Entity Recognition via Multiple Small-Parameter Large Language Models
por: Xiao, Yuzhen, et al.
Publicado: (2025)
por: Xiao, Yuzhen, et al.
Publicado: (2025)
How Linguistics Learned to Stop Worrying and Love the Language Models
por: Futrell, Richard, et al.
Publicado: (2025)
por: Futrell, Richard, et al.
Publicado: (2025)
Ejemplares similares
-
Measuring Stereotype and Deviation Biases in Large Language Models
por: Wang, Daniel, et al.
Publicado: (2025) -
A General Method for Detecting Information Generated by Large Language Models
por: Mao, Minjia, et al.
Publicado: (2025) -
Watermarking Low-entropy Generation for Large Language Models: An Unbiased and Low-risk Method
por: Mao, Minjia, et al.
Publicado: (2024) -
Early Detection of Misinformation for Infodemic Management: A Domain Adaptation Approach
por: Mao, Minjia, et al.
Publicado: (2024) -
OCEAN: Offline Chain-of-thought Evaluation and Alignment in Large Language Models
por: Wu, Junda, et al.
Publicado: (2024)