Entropy-Gated Branching for Efficient Test-Time Reasoning
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Xianzhi, Callanan, Ethan, Ghassel, Abdellah, Zhu, Xiaodan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Detect, Explain, Escalate: Sustainable Dialogue Breakdown Management for LLM Agents
por: Ghassel, Abdellah, et al.
Publicado: (2025)
por: Ghassel, Abdellah, et al.
Publicado: (2025)
Chat-TS: Enhancing Multi-Modal Reasoning Over Time-Series and Natural Language Data
por: Quinlan, Paul, et al.
Publicado: (2025)
por: Quinlan, Paul, et al.
Publicado: (2025)
Scaling Up, Speeding Up: A Benchmark of Speculative Decoding for Efficient LLM Test-Time Scaling
por: Sun, Shengyin, et al.
Publicado: (2025)
por: Sun, Shengyin, et al.
Publicado: (2025)
Hierarchical Lexical Graph for Enhanced Multi-Hop Retrieval
por: Ghassel, Abdellah, et al.
Publicado: (2025)
por: Ghassel, Abdellah, et al.
Publicado: (2025)
MatryoshkaThinking: Recursive Test-Time Scaling Enables Efficient Reasoning
por: Chen, Hongwei, et al.
Publicado: (2025)
por: Chen, Hongwei, et al.
Publicado: (2025)
Fine-Tuning Language Models with Differential Privacy through Adaptive Noise Allocation
por: Li, Xianzhi, et al.
Publicado: (2024)
por: Li, Xianzhi, et al.
Publicado: (2024)
CHIMERA: Compact Synthetic Data for Generalizable LLM Reasoning
por: Zhu, Xinyu, et al.
Publicado: (2026)
por: Zhu, Xinyu, et al.
Publicado: (2026)
ETR: Entropy Trend Reward for Efficient Chain-of-Thought Reasoning
por: Xiong, Xuan, et al.
Publicado: (2026)
por: Xiong, Xuan, et al.
Publicado: (2026)
TrimR: Verifier-based Training-Free Thinking Compression for Efficient Test-Time Scaling
por: Lin, Weizhe, et al.
Publicado: (2025)
por: Lin, Weizhe, et al.
Publicado: (2025)
Entropy Centroids as Intrinsic Rewards for Test-Time Scaling
por: Zhao, Wenshuo, et al.
Publicado: (2026)
por: Zhao, Wenshuo, et al.
Publicado: (2026)
Exploring the Role of Reasoning Structures for Constructing Proofs in Multi-Step Natural Language Reasoning with Large Language Models
por: Zheng, Zi'ou, et al.
Publicado: (2024)
por: Zheng, Zi'ou, et al.
Publicado: (2024)
Generalization or Memorization? Brittleness Testing for Chess-Trained Language Models
por: Tang, Ethan
Publicado: (2026)
por: Tang, Ethan
Publicado: (2026)
MedAdapter: Efficient Test-Time Adaptation of Large Language Models towards Medical Reasoning
por: Shi, Wenqi, et al.
Publicado: (2024)
por: Shi, Wenqi, et al.
Publicado: (2024)
NOBLE: Accelerating Transformers with Nonlinear Low-Rank Branches
por: Smith, Ethan
Publicado: (2026)
por: Smith, Ethan
Publicado: (2026)
LIMOPro: Reasoning Refinement for Efficient and Effective Test-time Scaling
por: Xiao, Yang, et al.
Publicado: (2025)
por: Xiao, Yang, et al.
Publicado: (2025)
Benchmarking LLMs for Mimicking Child-Caregiver Language in Interaction
por: Liu, Jing, et al.
Publicado: (2024)
por: Liu, Jing, et al.
Publicado: (2024)
ConfSpec: Efficient Step-Level Speculative Reasoning via Confidence-Gated Verification
por: Liu, Siran, et al.
Publicado: (2026)
por: Liu, Siran, et al.
Publicado: (2026)
Long-Horizon Plan Execution in Large Tool Spaces through Entropy-Guided Branching
por: Wei, Rongzhe, et al.
Publicado: (2026)
por: Wei, Rongzhe, et al.
Publicado: (2026)
Quantization Hurts Reasoning? An Empirical Study on Quantized Reasoning Models
por: Liu, Ruikang, et al.
Publicado: (2025)
por: Liu, Ruikang, et al.
Publicado: (2025)
Collaborative Multi-Agent Test-Time Reinforcement Learning for Reasoning
por: Hu, Zhiyuan, et al.
Publicado: (2026)
por: Hu, Zhiyuan, et al.
Publicado: (2026)
SpaRC and SpaRP: Spatial Reasoning Characterization and Path Generation for Understanding Spatial Reasoning Capability of Large Language Models
por: Rizvi, Md Imbesat Hassan, et al.
Publicado: (2024)
por: Rizvi, Md Imbesat Hassan, et al.
Publicado: (2024)
Branch-and-Browse: Efficient and Controllable Web Exploration with Tree-Structured Reasoning and Action Memory
por: He, Shiqi, et al.
Publicado: (2025)
por: He, Shiqi, et al.
Publicado: (2025)
Learning to Reason from Feedback at Test-Time
por: Li, Yanyang, et al.
Publicado: (2025)
por: Li, Yanyang, et al.
Publicado: (2025)
Chronicle: A Multimodal Foundation Model for Joint Language and Time Series Understanding
por: Quinlan, Paul, et al.
Publicado: (2026)
por: Quinlan, Paul, et al.
Publicado: (2026)
Scaling over Scaling: Exploring Test-Time Scaling Plateau in Large Reasoning Models
por: Wang, Jian, et al.
Publicado: (2025)
por: Wang, Jian, et al.
Publicado: (2025)
Logical Reasoning with Outcome Reward Models for Test-Time Scaling
por: Thatikonda, Ramya Keerthy, et al.
Publicado: (2025)
por: Thatikonda, Ramya Keerthy, et al.
Publicado: (2025)
ReProbe: Efficient Test-Time Scaling of Multi-Step Reasoning by Probing Internal States of Large Language Models
por: Ni, Jingwei, et al.
Publicado: (2025)
por: Ni, Jingwei, et al.
Publicado: (2025)
Retrieval is Not Enough: Enhancing RAG Reasoning through Test-Time Critique and Optimization
por: Wei, Jiaqi, et al.
Publicado: (2025)
por: Wei, Jiaqi, et al.
Publicado: (2025)
Guided by Gut: Efficient Test-Time Scaling with Reinforced Intrinsic Confidence
por: Ghasemabadi, Amirhosein, et al.
Publicado: (2025)
por: Ghasemabadi, Amirhosein, et al.
Publicado: (2025)
Parallel Test-Time Scaling for Latent Reasoning Models
por: You, Runyang, et al.
Publicado: (2025)
por: You, Runyang, et al.
Publicado: (2025)
Skill-Conditioned Gated Self-Distillation for LLM Reasoning
por: Huang, Jiazhen, et al.
Publicado: (2026)
por: Huang, Jiazhen, et al.
Publicado: (2026)
Inverse Scaling in Test-Time Compute
por: Gema, Aryo Pradipta, et al.
Publicado: (2025)
por: Gema, Aryo Pradipta, et al.
Publicado: (2025)
Towards Thinking-Optimal Scaling of Test-Time Compute for LLM Reasoning
por: Yang, Wenkai, et al.
Publicado: (2025)
por: Yang, Wenkai, et al.
Publicado: (2025)
Less is More: Improving LLM Reasoning with Minimal Test-Time Intervention
por: Yang, Zhen, et al.
Publicado: (2025)
por: Yang, Zhen, et al.
Publicado: (2025)
Forest-of-Thought: Scaling Test-Time Compute for Enhancing LLM Reasoning
por: Bi, Zhenni, et al.
Publicado: (2024)
por: Bi, Zhenni, et al.
Publicado: (2024)
Precedent-Informed Reasoning: Mitigating Overthinking in Large Reasoning Models via Test-Time Precedent Learning
por: Wang, Qianyue, et al.
Publicado: (2026)
por: Wang, Qianyue, et al.
Publicado: (2026)
Preemptive Detection and Correction of Misaligned Actions in LLM Agents
por: Fang, Haishuo, et al.
Publicado: (2024)
por: Fang, Haishuo, et al.
Publicado: (2024)
Seek in the Dark: Reasoning via Test-Time Instance-Level Policy Gradient in Latent Space
por: Li, Hengli, et al.
Publicado: (2025)
por: Li, Hengli, et al.
Publicado: (2025)
Condition-Gated Reasoning for Context-Dependent Biomedical Question Answering
por: Parekh, Jash Rajesh, et al.
Publicado: (2026)
por: Parekh, Jash Rajesh, et al.
Publicado: (2026)
Crosslingual Reasoning through Test-Time Scaling
por: Yong, Zheng-Xin, et al.
Publicado: (2025)
por: Yong, Zheng-Xin, et al.
Publicado: (2025)
Ejemplares similares
-
Detect, Explain, Escalate: Sustainable Dialogue Breakdown Management for LLM Agents
por: Ghassel, Abdellah, et al.
Publicado: (2025) -
Chat-TS: Enhancing Multi-Modal Reasoning Over Time-Series and Natural Language Data
por: Quinlan, Paul, et al.
Publicado: (2025) -
Scaling Up, Speeding Up: A Benchmark of Speculative Decoding for Efficient LLM Test-Time Scaling
por: Sun, Shengyin, et al.
Publicado: (2025) -
Hierarchical Lexical Graph for Enhanced Multi-Hop Retrieval
por: Ghassel, Abdellah, et al.
Publicado: (2025) -
MatryoshkaThinking: Recursive Test-Time Scaling Enables Efficient Reasoning
por: Chen, Hongwei, et al.
Publicado: (2025)