The Price of a Second Thought: On the Evaluation of Reasoning Efficiency in Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Fan, Siqi, Qin, Bowen, Han, Peng, Shang, Shuo, Wang, Yequan, Sun, Aixin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Position-Aware Depth Decay Decoding ($D^3$): Boosting Large Language Model Inference Efficiency
di: Fan, Siqi, et al.
Pubblicazione: (2025)
di: Fan, Siqi, et al.
Pubblicazione: (2025)
If an LLM Were a Character, Would It Know Its Own Story? Evaluating Lifelong Learning in LLMs
di: Fan, Siqi, et al.
Pubblicazione: (2025)
di: Fan, Siqi, et al.
Pubblicazione: (2025)
Not All Layers of LLMs Are Necessary During Inference
di: Fan, Siqi, et al.
Pubblicazione: (2024)
di: Fan, Siqi, et al.
Pubblicazione: (2024)
GCRE-GPT: A Generative Model for Comparative Relation Extraction
di: Wang, Yequan, et al.
Pubblicazione: (2023)
di: Wang, Yequan, et al.
Pubblicazione: (2023)
Open-domain Implicit Format Control for Large Language Model Generation
di: Yao, Yiqun, et al.
Pubblicazione: (2024)
di: Yao, Yiqun, et al.
Pubblicazione: (2024)
Evaluating LLM Adaptation to Sociodemographic Factors: User Profile vs. Dialogue History
di: Zhong, Qishuai, et al.
Pubblicazione: (2025)
di: Zhong, Qishuai, et al.
Pubblicazione: (2025)
FLM-101B: An Open LLM and How to Train It with $100K Budget
di: Li, Xiang, et al.
Pubblicazione: (2023)
di: Li, Xiang, et al.
Pubblicazione: (2023)
nanoLM: an Affordable LLM Pre-training Benchmark via Accurate Loss Prediction across Scales
di: Yao, Yiqun, et al.
Pubblicazione: (2023)
di: Yao, Yiqun, et al.
Pubblicazione: (2023)
Benchmarking and Rethinking Knowledge Editing for Large Language Models
di: He, Guoxiu, et al.
Pubblicazione: (2025)
di: He, Guoxiu, et al.
Pubblicazione: (2025)
Hint Tuning: Less Data Makes Better Reasoners
di: Fan, Siqi, et al.
Pubblicazione: (2026)
di: Fan, Siqi, et al.
Pubblicazione: (2026)
Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models
di: Chen, Qiguang, et al.
Pubblicazione: (2025)
di: Chen, Qiguang, et al.
Pubblicazione: (2025)
THINK-Bench: Evaluating Thinking Efficiency and Chain-of-Thought Quality of Large Reasoning Models
di: Li, Zhiyuan, et al.
Pubblicazione: (2025)
di: Li, Zhiyuan, et al.
Pubblicazione: (2025)
On Context Utilization in Summarization with Large Language Models
di: Ravaut, Mathieu, et al.
Pubblicazione: (2023)
di: Ravaut, Mathieu, et al.
Pubblicazione: (2023)
Buffer of Thoughts: Thought-Augmented Reasoning with Large Language Models
di: Yang, Ling, et al.
Pubblicazione: (2024)
di: Yang, Ling, et al.
Pubblicazione: (2024)
Graph Chain-of-Thought: Augmenting Large Language Models by Reasoning on Graphs
di: Jin, Bowen, et al.
Pubblicazione: (2024)
di: Jin, Bowen, et al.
Pubblicazione: (2024)
The Price of Thought: A Multilingual Analysis of Reasoning, Performance, and Cost of Negotiation in Large Language Models
di: Hakimov, Sherzod, et al.
Pubblicazione: (2025)
di: Hakimov, Sherzod, et al.
Pubblicazione: (2025)
Thought Manipulation: External Thought Can Be Efficient for Large Reasoning Models
di: Liu, Yule, et al.
Pubblicazione: (2025)
di: Liu, Yule, et al.
Pubblicazione: (2025)
AutoLogi: Automated Generation of Logic Puzzles for Evaluating Reasoning Abilities of Large Language Models
di: Zhu, Qin, et al.
Pubblicazione: (2025)
di: Zhu, Qin, et al.
Pubblicazione: (2025)
Beyond Surface Reasoning: Unveiling the True Long Chain-of-Thought Capacity of Diffusion Large Language Models
di: Chen, Qiguang, et al.
Pubblicazione: (2025)
di: Chen, Qiguang, et al.
Pubblicazione: (2025)
Knowledge Updating? No More Model Editing! Just Selective Contextual Reasoning
di: He, Guoxiu, et al.
Pubblicazione: (2025)
di: He, Guoxiu, et al.
Pubblicazione: (2025)
Can Large Language Models Detect Errors in Long Chain-of-Thought Reasoning?
di: He, Yancheng, et al.
Pubblicazione: (2025)
di: He, Yancheng, et al.
Pubblicazione: (2025)
Cultural Value Differences of LLMs: Prompt, Language, and Model Size
di: Zhong, Qishuai, et al.
Pubblicazione: (2024)
di: Zhong, Qishuai, et al.
Pubblicazione: (2024)
Policy Frameworks for Transparent Chain-of-Thought Reasoning in Large Language Models
di: Chen, Yihang, et al.
Pubblicazione: (2025)
di: Chen, Yihang, et al.
Pubblicazione: (2025)
LoRA-Flow: Dynamic LoRA Fusion for Large Language Models in Generative Tasks
di: Wang, Hanqing, et al.
Pubblicazione: (2024)
di: Wang, Hanqing, et al.
Pubblicazione: (2024)
How Efficient Are Diffusion Language Models? A Critical Examination of Efficiency Evaluation Practices
di: Peng, Han, et al.
Pubblicazione: (2025)
di: Peng, Han, et al.
Pubblicazione: (2025)
Evaluating Large Language Models for Anxiety and Depression Classification using Counseling and Psychotherapy Transcripts
di: Sun, Junwei, et al.
Pubblicazione: (2024)
di: Sun, Junwei, et al.
Pubblicazione: (2024)
Enhancing Chain of Thought Prompting in Large Language Models via Reasoning Patterns
di: Zhang, Yufeng, et al.
Pubblicazione: (2024)
di: Zhang, Yufeng, et al.
Pubblicazione: (2024)
Finding Answers in Thought Matters: Revisiting Evaluation on Large Language Models with Reasoning
di: Jo, Hwiyeol, et al.
Pubblicazione: (2025)
di: Jo, Hwiyeol, et al.
Pubblicazione: (2025)
Retrieval-augmented Multi-modal Chain-of-Thoughts Reasoning for Large Language Models
di: Liu, Bingshuai, et al.
Pubblicazione: (2023)
di: Liu, Bingshuai, et al.
Pubblicazione: (2023)
On the Hardness of Faithful Chain-of-Thought Reasoning in Large Language Models
di: Tanneru, Sree Harsha, et al.
Pubblicazione: (2024)
di: Tanneru, Sree Harsha, et al.
Pubblicazione: (2024)
Large Language Model Is Not a Good Few-shot Information Extractor, but a Good Reranker for Hard Samples!
di: Ma, Yubo, et al.
Pubblicazione: (2023)
di: Ma, Yubo, et al.
Pubblicazione: (2023)
Logic-of-Thought: Injecting Logic into Contexts for Full Reasoning in Large Language Models
di: Liu, Tongxuan, et al.
Pubblicazione: (2024)
di: Liu, Tongxuan, et al.
Pubblicazione: (2024)
Blind Spot Navigation in Large Language Model Reasoning with Thought Space Explorer
di: Zhang, Jinghan, et al.
Pubblicazione: (2024)
di: Zhang, Jinghan, et al.
Pubblicazione: (2024)
MME-CoT: Benchmarking Chain-of-Thought in Large Multimodal Models for Reasoning Quality, Robustness, and Efficiency
di: Jiang, Dongzhi, et al.
Pubblicazione: (2025)
di: Jiang, Dongzhi, et al.
Pubblicazione: (2025)
Large Language Models Meet Symbolic Provers for Logical Reasoning Evaluation
di: Qi, Chengwen, et al.
Pubblicazione: (2025)
di: Qi, Chengwen, et al.
Pubblicazione: (2025)
Cognition-of-Thought Elicits Social-Aligned Reasoning in Large Language Models
di: Zhang, Xuanming, et al.
Pubblicazione: (2025)
di: Zhang, Xuanming, et al.
Pubblicazione: (2025)
ToW: Thoughts of Words Improve Reasoning in Large Language Models
di: Xu, Zhikun, et al.
Pubblicazione: (2024)
di: Xu, Zhikun, et al.
Pubblicazione: (2024)
Synergy-of-Thoughts: Eliciting Efficient Reasoning in Hybrid Language Models
di: Shang, Yu, et al.
Pubblicazione: (2024)
di: Shang, Yu, et al.
Pubblicazione: (2024)
Large Language Models as Evaluators for Recommendation Explanations
di: Zhang, Xiaoyu, et al.
Pubblicazione: (2024)
di: Zhang, Xiaoyu, et al.
Pubblicazione: (2024)
Large Language Model based Situational Dialogues for Second Language Learning
di: Xu, Shuyao, et al.
Pubblicazione: (2024)
di: Xu, Shuyao, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Position-Aware Depth Decay Decoding ($D^3$): Boosting Large Language Model Inference Efficiency
di: Fan, Siqi, et al.
Pubblicazione: (2025) -
If an LLM Were a Character, Would It Know Its Own Story? Evaluating Lifelong Learning in LLMs
di: Fan, Siqi, et al.
Pubblicazione: (2025) -
Not All Layers of LLMs Are Necessary During Inference
di: Fan, Siqi, et al.
Pubblicazione: (2024) -
GCRE-GPT: A Generative Model for Comparative Relation Extraction
di: Wang, Yequan, et al.
Pubblicazione: (2023) -
Open-domain Implicit Format Control for Large Language Model Generation
di: Yao, Yiqun, et al.
Pubblicazione: (2024)