Salvato in:
| Autori principali: | Ji, Yixin, Li, Juntao, Xiang, Yang, Ye, Hai, Wu, Kaixin, Yao, Kai, Xu, Jia, Mo, Linjian, Zhang, Min |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2501.02497 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Think Before You Prune: Selective Self-Generated Calibration for Pruning Large Reasoning Models
di: Xiang, Yang, et al.
Pubblicazione: (2025)
di: Xiang, Yang, et al.
Pubblicazione: (2025)
CPRM: A LLM-based Continual Pre-training Framework for Relevance Modeling in Commercial Search
di: Wu, Kaixin, et al.
Pubblicazione: (2024)
di: Wu, Kaixin, et al.
Pubblicazione: (2024)
When Is Thinking Enough? Early Exit via Sufficiency Assessment for Efficient Reasoning
di: Xiang, Yang, et al.
Pubblicazione: (2026)
di: Xiang, Yang, et al.
Pubblicazione: (2026)
When to Trust Tools? Adaptive Tool Trust Calibration For Tool-Integrated Math Reasoning
di: Xu, Ruotao, et al.
Pubblicazione: (2026)
di: Xu, Ruotao, et al.
Pubblicazione: (2026)
Taming the Titans: A Survey of Efficient LLM Inference Serving
di: Zhen, Ranran, et al.
Pubblicazione: (2025)
di: Zhen, Ranran, et al.
Pubblicazione: (2025)
Intuitive or Dependent? Investigating LLMs' Behavior Style to Conflicting Prompts
di: Ying, Jiahao, et al.
Pubblicazione: (2023)
di: Ying, Jiahao, et al.
Pubblicazione: (2023)
Adaptive Feature-based Low-Rank Compression of Large Language Models via Bayesian Optimization
di: Ji, Yixin, et al.
Pubblicazione: (2024)
di: Ji, Yixin, et al.
Pubblicazione: (2024)
Reasoning over Boundaries: Enhancing Specification Alignment via Test-time Deliberation
di: Zhang, Haoran, et al.
Pubblicazione: (2025)
di: Zhang, Haoran, et al.
Pubblicazione: (2025)
100 Days After DeepSeek-R1: A Survey on Replication Studies and More Directions for Reasoning Language Models
di: Zhang, Chong, et al.
Pubblicazione: (2025)
di: Zhang, Chong, et al.
Pubblicazione: (2025)
Demonstration Augmentation for Zero-shot In-context Learning
di: Su, Yi, et al.
Pubblicazione: (2024)
di: Su, Yi, et al.
Pubblicazione: (2024)
MIND Your Reasoning: A Meta-Cognitive Intuitive-Reflective Network for Dual-Reasoning in Multimodal Stance Detection
di: Wang, Bingbing, et al.
Pubblicazione: (2025)
di: Wang, Bingbing, et al.
Pubblicazione: (2025)
Unlocking the Power of Multi-Agent LLM for Reasoning: From Lazy Agents to Deliberation
di: Zhang, Zhiwei, et al.
Pubblicazione: (2025)
di: Zhang, Zhiwei, et al.
Pubblicazione: (2025)
GradOT: Training-free Gradient-preserving Offsite-tuning for Large Language Models
di: Yao, Kai, et al.
Pubblicazione: (2025)
di: Yao, Kai, et al.
Pubblicazione: (2025)
Less Data Less Tokens: Multilingual Unification Learning for Efficient Test-Time Reasoning in LLMs
di: Chen, Kang, et al.
Pubblicazione: (2025)
di: Chen, Kang, et al.
Pubblicazione: (2025)
Refine Thought: A Test-Time Inference Method for Embedding Model Reasoning
di: Wang, Guangzhi, et al.
Pubblicazione: (2025)
di: Wang, Guangzhi, et al.
Pubblicazione: (2025)
Enhancing Language Model Rationality with Bi-Directional Deliberation Reasoning
di: Zhang, Yadong, et al.
Pubblicazione: (2024)
di: Zhang, Yadong, et al.
Pubblicazione: (2024)
Forest-of-Thought: Scaling Test-Time Compute for Enhancing LLM Reasoning
di: Bi, Zhenni, et al.
Pubblicazione: (2024)
di: Bi, Zhenni, et al.
Pubblicazione: (2024)
OmniGuard: Unified Omni-Modal Guardrails with Deliberate Reasoning
di: Zhu, Boyu, et al.
Pubblicazione: (2025)
di: Zhu, Boyu, et al.
Pubblicazione: (2025)
Beware of Calibration Data for Pruning Large Language Models
di: Ji, Yixin, et al.
Pubblicazione: (2024)
di: Ji, Yixin, et al.
Pubblicazione: (2024)
Chronos: Learning Temporal Dynamics of Reasoning Chains for Test-Time Scaling
di: Zhang, Kai, et al.
Pubblicazione: (2026)
di: Zhang, Kai, et al.
Pubblicazione: (2026)
From Debate to Deliberation: Structured Collective Reasoning with Typed Epistemic Acts
di: Prakash, Sunil
Pubblicazione: (2026)
di: Prakash, Sunil
Pubblicazione: (2026)
Textual Self-attention Network: Test-Time Preference Optimization through Textual Gradient-based Attention
di: Mo, Shibing, et al.
Pubblicazione: (2025)
di: Mo, Shibing, et al.
Pubblicazione: (2025)
FINEREASON: Evaluating and Improving LLMs' Deliberate Reasoning through Reflective Puzzle Solving
di: Chen, Guizhen, et al.
Pubblicazione: (2025)
di: Chen, Guizhen, et al.
Pubblicazione: (2025)
BRIEF: Bridging Retrieval and Inference for Multi-hop Reasoning via Compression
di: Li, Yuankai, et al.
Pubblicazione: (2024)
di: Li, Yuankai, et al.
Pubblicazione: (2024)
Efficient Reasoning for LLMs through Speculative Chain-of-Thought
di: Wang, Jikai, et al.
Pubblicazione: (2025)
di: Wang, Jikai, et al.
Pubblicazione: (2025)
MemReread: Enhancing Agentic Long-Context Reasoning via Memory-Guided Rereading
di: Ji, Baibei, et al.
Pubblicazione: (2026)
di: Ji, Baibei, et al.
Pubblicazione: (2026)
Fractional Reasoning via Latent Steering Vectors Improves Inference Time Compute
di: Liu, Sheng, et al.
Pubblicazione: (2025)
di: Liu, Sheng, et al.
Pubblicazione: (2025)
Chain of Methodologies: Scaling Test Time Computation without Training
di: Liu, Cong, et al.
Pubblicazione: (2025)
di: Liu, Cong, et al.
Pubblicazione: (2025)
SAND: Boosting LLM Agents with Self-Taught Action Deliberation
di: Xia, Yu, et al.
Pubblicazione: (2025)
di: Xia, Yu, et al.
Pubblicazione: (2025)
Towards Safety Reasoning in LLMs: AI-agentic Deliberation for Policy-embedded CoT Data Creation
di: Kumarage, Tharindu, et al.
Pubblicazione: (2025)
di: Kumarage, Tharindu, et al.
Pubblicazione: (2025)
Test-Time Scaling of Reasoning Models for Machine Translation
di: Li, Zihao, et al.
Pubblicazione: (2025)
di: Li, Zihao, et al.
Pubblicazione: (2025)
Towards a Mechanistic Understanding of Large Reasoning Models: A Survey of Training, Inference, and Failures
di: Hu, Yi, et al.
Pubblicazione: (2026)
di: Hu, Yi, et al.
Pubblicazione: (2026)
Efficient Inference for Large Reasoning Models: A Survey
di: Liu, Yue, et al.
Pubblicazione: (2025)
di: Liu, Yue, et al.
Pubblicazione: (2025)
Multi-Agent Sampling: Scaling Inference Compute for Data Synthesis with Tree Search-Based Agentic Collaboration
di: Ye, Hai, et al.
Pubblicazione: (2024)
di: Ye, Hai, et al.
Pubblicazione: (2024)
Deliberate Reasoning in Language Models as Structure-Aware Planning with an Accurate World Model
di: Xiong, Siheng, et al.
Pubblicazione: (2024)
di: Xiong, Siheng, et al.
Pubblicazione: (2024)
Quantum-Audit: Evaluating the Reasoning Limits of LLMs on Quantum Computing
di: Afane, Mohamed, et al.
Pubblicazione: (2026)
di: Afane, Mohamed, et al.
Pubblicazione: (2026)
Parallel Loop Transformer for Efficient Test-Time Computation Scaling
di: Wu, Bohong, et al.
Pubblicazione: (2025)
di: Wu, Bohong, et al.
Pubblicazione: (2025)
Diagnosing Memorization in Chain-of-Thought Reasoning, One Token at a Time
di: Li, Huihan, et al.
Pubblicazione: (2025)
di: Li, Huihan, et al.
Pubblicazione: (2025)
DeepCritic: Deliberate Critique with Large Language Models
di: Yang, Wenkai, et al.
Pubblicazione: (2025)
di: Yang, Wenkai, et al.
Pubblicazione: (2025)
Beyond Test-Time Compute Strategies: Advocating Energy-per-Token in LLM Inference
di: Wilhelm, Patrick, et al.
Pubblicazione: (2026)
di: Wilhelm, Patrick, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Think Before You Prune: Selective Self-Generated Calibration for Pruning Large Reasoning Models
di: Xiang, Yang, et al.
Pubblicazione: (2025) -
CPRM: A LLM-based Continual Pre-training Framework for Relevance Modeling in Commercial Search
di: Wu, Kaixin, et al.
Pubblicazione: (2024) -
When Is Thinking Enough? Early Exit via Sufficiency Assessment for Efficient Reasoning
di: Xiang, Yang, et al.
Pubblicazione: (2026) -
When to Trust Tools? Adaptive Tool Trust Calibration For Tool-Integrated Math Reasoning
di: Xu, Ruotao, et al.
Pubblicazione: (2026) -
Taming the Titans: A Survey of Efficient LLM Inference Serving
di: Zhen, Ranran, et al.
Pubblicazione: (2025)