Salvato in:
| Autori principali: | Pu, Xiao, Saxon, Michael, Hua, Wenyue, Wang, William Yang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2504.13367 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Mitigating Overthinking through Reasoning Shaping
di: Song, Feifan, et al.
Pubblicazione: (2025)
di: Song, Feifan, et al.
Pubblicazione: (2025)
Benchmarks as Microscopes: A Call for Model Metrology
di: Saxon, Michael, et al.
Pubblicazione: (2024)
di: Saxon, Michael, et al.
Pubblicazione: (2024)
Mitigating Overthinking in Large Reasoning Language Models via Reasoning Path Deviation Monitoring
di: Guan, Weixin, et al.
Pubblicazione: (2026)
di: Guan, Weixin, et al.
Pubblicazione: (2026)
Mitigating Overthinking in Large Reasoning Models via Manifold Steering
di: Huang, Yao, et al.
Pubblicazione: (2025)
di: Huang, Yao, et al.
Pubblicazione: (2025)
Losing Visual Needles in Image Haystacks: Vision Language Models are Easily Distracted in Short and Long Contexts
di: Sharma, Aditya, et al.
Pubblicazione: (2024)
di: Sharma, Aditya, et al.
Pubblicazione: (2024)
Precedent-Informed Reasoning: Mitigating Overthinking in Large Reasoning Models via Test-Time Precedent Learning
di: Wang, Qianyue, et al.
Pubblicazione: (2026)
di: Wang, Qianyue, et al.
Pubblicazione: (2026)
Batch Prompting Suppresses Overthinking Reasoning Under Constraint: How Batch Prompting Suppresses Overthinking in Reasoning Models
di: Srivastava, Saurabh, et al.
Pubblicazione: (2025)
di: Srivastava, Saurabh, et al.
Pubblicazione: (2025)
Do LLMs Overthink Basic Math Reasoning? Benchmarking the Accuracy-Efficiency Tradeoff in Language Models
di: Srivastava, Gaurav, et al.
Pubblicazione: (2025)
di: Srivastava, Gaurav, et al.
Pubblicazione: (2025)
RuleArena: A Benchmark for Rule-Guided Reasoning with LLMs in Real-World Scenarios
di: Zhou, Ruiwen, et al.
Pubblicazione: (2024)
di: Zhou, Ruiwen, et al.
Pubblicazione: (2024)
ROM: Real-time Overthinking Mitigation via Streaming Detection and Intervention
di: Wang, Xinyan, et al.
Pubblicazione: (2026)
di: Wang, Xinyan, et al.
Pubblicazione: (2026)
Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models
di: Sui, Yang, et al.
Pubblicazione: (2025)
di: Sui, Yang, et al.
Pubblicazione: (2025)
NPHardEval: Dynamic Benchmark on Reasoning Ability of Large Language Models via Complexity Classes
di: Fan, Lizhou, et al.
Pubblicazione: (2023)
di: Fan, Lizhou, et al.
Pubblicazione: (2023)
Disentangling Memory and Reasoning Ability in Large Language Models
di: Jin, Mingyu, et al.
Pubblicazione: (2024)
di: Jin, Mingyu, et al.
Pubblicazione: (2024)
DRQA: Dynamic Reasoning Quota Allocation for Controlling Overthinking in Reasoning Large Language Models
di: Yan, Kaiwen, et al.
Pubblicazione: (2025)
di: Yan, Kaiwen, et al.
Pubblicazione: (2025)
Your Models Have Thought Enough: Training Large Reasoning Models to Stop Overthinking
di: Han, Jinyi, et al.
Pubblicazione: (2025)
di: Han, Jinyi, et al.
Pubblicazione: (2025)
Large Language Models Are Latent Variable Models: Explaining and Finding Good Demonstrations for In-Context Learning
di: Wang, Xinyi, et al.
Pubblicazione: (2023)
di: Wang, Xinyi, et al.
Pubblicazione: (2023)
BadReasoner: Planting Tunable Overthinking Backdoors into Large Reasoning Models for Fun or Profit
di: Yi, Biao, et al.
Pubblicazione: (2025)
di: Yi, Biao, et al.
Pubblicazione: (2025)
TC-Bench: Benchmarking Temporal Compositionality in Text-to-Video and Image-to-Video Generation
di: Feng, Weixi, et al.
Pubblicazione: (2024)
di: Feng, Weixi, et al.
Pubblicazione: (2024)
MAGPIE: A dataset for Multi-AGent contextual PrIvacy Evaluation
di: Juneja, Gurusha, et al.
Pubblicazione: (2025)
di: Juneja, Gurusha, et al.
Pubblicazione: (2025)
Don't Overthink it. Preferring Shorter Thinking Chains for Improved LLM Reasoning
di: Hassid, Michael, et al.
Pubblicazione: (2025)
di: Hassid, Michael, et al.
Pubblicazione: (2025)
Do You Know About My Nation? Investigating Multilingual Language Models' Cultural Literacy Through Factual Knowledge
di: Tanwar, Eshaan, et al.
Pubblicazione: (2025)
di: Tanwar, Eshaan, et al.
Pubblicazione: (2025)
Think, But Don't Overthink: Reproducing Recursive Language Models
di: Wang, Daren
Pubblicazione: (2026)
di: Wang, Daren
Pubblicazione: (2026)
Reasoning or Overthinking: Evaluating Large Language Models on Financial Sentiment Analysis
di: Vamvourellis, Dimitris, et al.
Pubblicazione: (2025)
di: Vamvourellis, Dimitris, et al.
Pubblicazione: (2025)
Explore Briefly, Then Decide: Mitigating LLM Overthinking via Cumulative Entropy Regulation
di: Bin, Yi, et al.
Pubblicazione: (2025)
di: Bin, Yi, et al.
Pubblicazione: (2025)
Addressing Overthinking in Large Vision-Language Models via Gated Perception-Reasoning Optimization
di: Diao, Xingjian, et al.
Pubblicazione: (2026)
di: Diao, Xingjian, et al.
Pubblicazione: (2026)
Lost in Translation? Translation Errors and Challenges for Fair Assessment of Text-to-Image Models on Multilingual Concepts
di: Saxon, Michael, et al.
Pubblicazione: (2024)
di: Saxon, Michael, et al.
Pubblicazione: (2024)
Missing Premise exacerbates Overthinking: Are Reasoning Models losing Critical Thinking Skill?
di: Fan, Chenrui, et al.
Pubblicazione: (2025)
di: Fan, Chenrui, et al.
Pubblicazione: (2025)
The Evolution of Thought: Tracking LLM Overthinking via Reasoning Dynamics Analysis
di: Wei, Zihao, et al.
Pubblicazione: (2025)
di: Wei, Zihao, et al.
Pubblicazione: (2025)
Between Underthinking and Overthinking: An Empirical Study of Reasoning Length and correctness in LLMs
di: Su, Jinyan, et al.
Pubblicazione: (2025)
di: Su, Jinyan, et al.
Pubblicazione: (2025)
MultiAgent Collaboration Attack: Investigating Adversarial Attacks in Large Language Model Collaborations via Debate
di: Amayuelas, Alfonso, et al.
Pubblicazione: (2024)
di: Amayuelas, Alfonso, et al.
Pubblicazione: (2024)
Don't "Overthink" Passage Reranking: Is Reasoning Truly Necessary?
di: Jedidi, Nour, et al.
Pubblicazione: (2025)
di: Jedidi, Nour, et al.
Pubblicazione: (2025)
VSP: Assessing the dual challenges of perception and reasoning in spatial planning tasks for VLMs
di: Wu, Qiucheng, et al.
Pubblicazione: (2024)
di: Wu, Qiucheng, et al.
Pubblicazione: (2024)
Hop, Skip, and Overthink: Diagnosing Why Reasoning Models Fumble during Multi-Hop Analysis
di: Yadav, Anushka, et al.
Pubblicazione: (2025)
di: Yadav, Anushka, et al.
Pubblicazione: (2025)
Who Evaluates the Evaluations? Objectively Scoring Text-to-Image Prompt Coherence Metrics with T2IScoreScore (TS2)
di: Saxon, Michael, et al.
Pubblicazione: (2024)
di: Saxon, Michael, et al.
Pubblicazione: (2024)
The Impact of Reasoning Step Length on Large Language Models
di: Jin, Mingyu, et al.
Pubblicazione: (2024)
di: Jin, Mingyu, et al.
Pubblicazione: (2024)
Overthinking Reduction with Decoupled Rewards and Curriculum Data Scheduling
di: Jiang, Shuyang, et al.
Pubblicazione: (2025)
di: Jiang, Shuyang, et al.
Pubblicazione: (2025)
InductionBench: LLMs Fail in the Simplest Complexity Class
di: Hua, Wenyue, et al.
Pubblicazione: (2025)
di: Hua, Wenyue, et al.
Pubblicazione: (2025)
MAGPIE: A benchmark for Multi-AGent contextual PrIvacy Evaluation
di: Juneja, Gurusha, et al.
Pubblicazione: (2025)
di: Juneja, Gurusha, et al.
Pubblicazione: (2025)
REALM: A Dataset of Real-World LLM Use Cases
di: Cheng, Jingwen, et al.
Pubblicazione: (2025)
di: Cheng, Jingwen, et al.
Pubblicazione: (2025)
Propagation and Pitfalls: Reasoning-based Assessment of Knowledge Editing through Counterfactual Tasks
di: Hua, Wenyue, et al.
Pubblicazione: (2024)
di: Hua, Wenyue, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Mitigating Overthinking through Reasoning Shaping
di: Song, Feifan, et al.
Pubblicazione: (2025) -
Benchmarks as Microscopes: A Call for Model Metrology
di: Saxon, Michael, et al.
Pubblicazione: (2024) -
Mitigating Overthinking in Large Reasoning Language Models via Reasoning Path Deviation Monitoring
di: Guan, Weixin, et al.
Pubblicazione: (2026) -
Mitigating Overthinking in Large Reasoning Models via Manifold Steering
di: Huang, Yao, et al.
Pubblicazione: (2025) -
Losing Visual Needles in Image Haystacks: Vision Language Models are Easily Distracted in Short and Long Contexts
di: Sharma, Aditya, et al.
Pubblicazione: (2024)