Gespeichert in:
| Hauptverfasser: | Ji, Yixin, Li, Juntao, Xiang, Yang, Ye, Hai, Wu, Kaixin, Yao, Kai, Xu, Jia, Mo, Linjian, Zhang, Min |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | https://arxiv.org/abs/2501.02497 |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Think Before You Prune: Selective Self-Generated Calibration for Pruning Large Reasoning Models
von: Xiang, Yang, et al.
Veröffentlicht: (2025)
von: Xiang, Yang, et al.
Veröffentlicht: (2025)
CPRM: A LLM-based Continual Pre-training Framework for Relevance Modeling in Commercial Search
von: Wu, Kaixin, et al.
Veröffentlicht: (2024)
von: Wu, Kaixin, et al.
Veröffentlicht: (2024)
When Is Thinking Enough? Early Exit via Sufficiency Assessment for Efficient Reasoning
von: Xiang, Yang, et al.
Veröffentlicht: (2026)
von: Xiang, Yang, et al.
Veröffentlicht: (2026)
When to Trust Tools? Adaptive Tool Trust Calibration For Tool-Integrated Math Reasoning
von: Xu, Ruotao, et al.
Veröffentlicht: (2026)
von: Xu, Ruotao, et al.
Veröffentlicht: (2026)
Taming the Titans: A Survey of Efficient LLM Inference Serving
von: Zhen, Ranran, et al.
Veröffentlicht: (2025)
von: Zhen, Ranran, et al.
Veröffentlicht: (2025)
Intuitive or Dependent? Investigating LLMs' Behavior Style to Conflicting Prompts
von: Ying, Jiahao, et al.
Veröffentlicht: (2023)
von: Ying, Jiahao, et al.
Veröffentlicht: (2023)
Adaptive Feature-based Low-Rank Compression of Large Language Models via Bayesian Optimization
von: Ji, Yixin, et al.
Veröffentlicht: (2024)
von: Ji, Yixin, et al.
Veröffentlicht: (2024)
Reasoning over Boundaries: Enhancing Specification Alignment via Test-time Deliberation
von: Zhang, Haoran, et al.
Veröffentlicht: (2025)
von: Zhang, Haoran, et al.
Veröffentlicht: (2025)
100 Days After DeepSeek-R1: A Survey on Replication Studies and More Directions for Reasoning Language Models
von: Zhang, Chong, et al.
Veröffentlicht: (2025)
von: Zhang, Chong, et al.
Veröffentlicht: (2025)
Demonstration Augmentation for Zero-shot In-context Learning
von: Su, Yi, et al.
Veröffentlicht: (2024)
von: Su, Yi, et al.
Veröffentlicht: (2024)
MIND Your Reasoning: A Meta-Cognitive Intuitive-Reflective Network for Dual-Reasoning in Multimodal Stance Detection
von: Wang, Bingbing, et al.
Veröffentlicht: (2025)
von: Wang, Bingbing, et al.
Veröffentlicht: (2025)
Unlocking the Power of Multi-Agent LLM for Reasoning: From Lazy Agents to Deliberation
von: Zhang, Zhiwei, et al.
Veröffentlicht: (2025)
von: Zhang, Zhiwei, et al.
Veröffentlicht: (2025)
GradOT: Training-free Gradient-preserving Offsite-tuning for Large Language Models
von: Yao, Kai, et al.
Veröffentlicht: (2025)
von: Yao, Kai, et al.
Veröffentlicht: (2025)
Less Data Less Tokens: Multilingual Unification Learning for Efficient Test-Time Reasoning in LLMs
von: Chen, Kang, et al.
Veröffentlicht: (2025)
von: Chen, Kang, et al.
Veröffentlicht: (2025)
Refine Thought: A Test-Time Inference Method for Embedding Model Reasoning
von: Wang, Guangzhi, et al.
Veröffentlicht: (2025)
von: Wang, Guangzhi, et al.
Veröffentlicht: (2025)
Enhancing Language Model Rationality with Bi-Directional Deliberation Reasoning
von: Zhang, Yadong, et al.
Veröffentlicht: (2024)
von: Zhang, Yadong, et al.
Veröffentlicht: (2024)
Forest-of-Thought: Scaling Test-Time Compute for Enhancing LLM Reasoning
von: Bi, Zhenni, et al.
Veröffentlicht: (2024)
von: Bi, Zhenni, et al.
Veröffentlicht: (2024)
OmniGuard: Unified Omni-Modal Guardrails with Deliberate Reasoning
von: Zhu, Boyu, et al.
Veröffentlicht: (2025)
von: Zhu, Boyu, et al.
Veröffentlicht: (2025)
Beware of Calibration Data for Pruning Large Language Models
von: Ji, Yixin, et al.
Veröffentlicht: (2024)
von: Ji, Yixin, et al.
Veröffentlicht: (2024)
Chronos: Learning Temporal Dynamics of Reasoning Chains for Test-Time Scaling
von: Zhang, Kai, et al.
Veröffentlicht: (2026)
von: Zhang, Kai, et al.
Veröffentlicht: (2026)
From Debate to Deliberation: Structured Collective Reasoning with Typed Epistemic Acts
von: Prakash, Sunil
Veröffentlicht: (2026)
von: Prakash, Sunil
Veröffentlicht: (2026)
Textual Self-attention Network: Test-Time Preference Optimization through Textual Gradient-based Attention
von: Mo, Shibing, et al.
Veröffentlicht: (2025)
von: Mo, Shibing, et al.
Veröffentlicht: (2025)
FINEREASON: Evaluating and Improving LLMs' Deliberate Reasoning through Reflective Puzzle Solving
von: Chen, Guizhen, et al.
Veröffentlicht: (2025)
von: Chen, Guizhen, et al.
Veröffentlicht: (2025)
BRIEF: Bridging Retrieval and Inference for Multi-hop Reasoning via Compression
von: Li, Yuankai, et al.
Veröffentlicht: (2024)
von: Li, Yuankai, et al.
Veröffentlicht: (2024)
Efficient Reasoning for LLMs through Speculative Chain-of-Thought
von: Wang, Jikai, et al.
Veröffentlicht: (2025)
von: Wang, Jikai, et al.
Veröffentlicht: (2025)
MemReread: Enhancing Agentic Long-Context Reasoning via Memory-Guided Rereading
von: Ji, Baibei, et al.
Veröffentlicht: (2026)
von: Ji, Baibei, et al.
Veröffentlicht: (2026)
Fractional Reasoning via Latent Steering Vectors Improves Inference Time Compute
von: Liu, Sheng, et al.
Veröffentlicht: (2025)
von: Liu, Sheng, et al.
Veröffentlicht: (2025)
Chain of Methodologies: Scaling Test Time Computation without Training
von: Liu, Cong, et al.
Veröffentlicht: (2025)
von: Liu, Cong, et al.
Veröffentlicht: (2025)
SAND: Boosting LLM Agents with Self-Taught Action Deliberation
von: Xia, Yu, et al.
Veröffentlicht: (2025)
von: Xia, Yu, et al.
Veröffentlicht: (2025)
Towards Safety Reasoning in LLMs: AI-agentic Deliberation for Policy-embedded CoT Data Creation
von: Kumarage, Tharindu, et al.
Veröffentlicht: (2025)
von: Kumarage, Tharindu, et al.
Veröffentlicht: (2025)
Test-Time Scaling of Reasoning Models for Machine Translation
von: Li, Zihao, et al.
Veröffentlicht: (2025)
von: Li, Zihao, et al.
Veröffentlicht: (2025)
Towards a Mechanistic Understanding of Large Reasoning Models: A Survey of Training, Inference, and Failures
von: Hu, Yi, et al.
Veröffentlicht: (2026)
von: Hu, Yi, et al.
Veröffentlicht: (2026)
Efficient Inference for Large Reasoning Models: A Survey
von: Liu, Yue, et al.
Veröffentlicht: (2025)
von: Liu, Yue, et al.
Veröffentlicht: (2025)
Multi-Agent Sampling: Scaling Inference Compute for Data Synthesis with Tree Search-Based Agentic Collaboration
von: Ye, Hai, et al.
Veröffentlicht: (2024)
von: Ye, Hai, et al.
Veröffentlicht: (2024)
Deliberate Reasoning in Language Models as Structure-Aware Planning with an Accurate World Model
von: Xiong, Siheng, et al.
Veröffentlicht: (2024)
von: Xiong, Siheng, et al.
Veröffentlicht: (2024)
Quantum-Audit: Evaluating the Reasoning Limits of LLMs on Quantum Computing
von: Afane, Mohamed, et al.
Veröffentlicht: (2026)
von: Afane, Mohamed, et al.
Veröffentlicht: (2026)
Parallel Loop Transformer for Efficient Test-Time Computation Scaling
von: Wu, Bohong, et al.
Veröffentlicht: (2025)
von: Wu, Bohong, et al.
Veröffentlicht: (2025)
Diagnosing Memorization in Chain-of-Thought Reasoning, One Token at a Time
von: Li, Huihan, et al.
Veröffentlicht: (2025)
von: Li, Huihan, et al.
Veröffentlicht: (2025)
DeepCritic: Deliberate Critique with Large Language Models
von: Yang, Wenkai, et al.
Veröffentlicht: (2025)
von: Yang, Wenkai, et al.
Veröffentlicht: (2025)
Beyond Test-Time Compute Strategies: Advocating Energy-per-Token in LLM Inference
von: Wilhelm, Patrick, et al.
Veröffentlicht: (2026)
von: Wilhelm, Patrick, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Think Before You Prune: Selective Self-Generated Calibration for Pruning Large Reasoning Models
von: Xiang, Yang, et al.
Veröffentlicht: (2025) -
CPRM: A LLM-based Continual Pre-training Framework for Relevance Modeling in Commercial Search
von: Wu, Kaixin, et al.
Veröffentlicht: (2024) -
When Is Thinking Enough? Early Exit via Sufficiency Assessment for Efficient Reasoning
von: Xiang, Yang, et al.
Veröffentlicht: (2026) -
When to Trust Tools? Adaptive Tool Trust Calibration For Tool-Integrated Math Reasoning
von: Xu, Ruotao, et al.
Veröffentlicht: (2026) -
Taming the Titans: A Survey of Efficient LLM Inference Serving
von: Zhen, Ranran, et al.
Veröffentlicht: (2025)