Reason to Rote: Rethinking Memorization in Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Du, Yupei, Mondorf, Philipp, Casola, Silvia, Yao, Yuekun, Litschko, Robert, Plank, Barbara |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Circuit Compositions: Exploring Modular Structures in Transformer-Based Language Models
di: Mondorf, Philipp, et al.
Pubblicazione: (2024)
di: Mondorf, Philipp, et al.
Pubblicazione: (2024)
Liar, Liar, Logical Mire: A Benchmark for Suppositional Reasoning in Large Language Models
di: Mondorf, Philipp, et al.
Pubblicazione: (2024)
di: Mondorf, Philipp, et al.
Pubblicazione: (2024)
Comparing Inferential Strategies of Humans and Large Language Models in Deductive Reasoning
di: Mondorf, Philipp, et al.
Pubblicazione: (2024)
di: Mondorf, Philipp, et al.
Pubblicazione: (2024)
Beyond Accuracy: Evaluating the Reasoning Behavior of Large Language Models -- A Survey
di: Mondorf, Philipp, et al.
Pubblicazione: (2024)
di: Mondorf, Philipp, et al.
Pubblicazione: (2024)
Tracing Uncertainty in Language Model "Reasoning"
di: Grünefeld, Nils, et al.
Pubblicazione: (2026)
di: Grünefeld, Nils, et al.
Pubblicazione: (2026)
To Know or Not To Know? Analyzing Self-Consistency of Large Language Models under Ambiguity
di: Sedova, Anastasiia, et al.
Pubblicazione: (2024)
di: Sedova, Anastasiia, et al.
Pubblicazione: (2024)
LogicSkills: A Structured Benchmark for Formal Reasoning in Large Language Models
di: Rabern, Brian, et al.
Pubblicazione: (2026)
di: Rabern, Brian, et al.
Pubblicazione: (2026)
Reasoning that Travels: Dissecting How Chain-of-Thought Transfers Across Models
di: Cheng, Xinyuan, et al.
Pubblicazione: (2026)
di: Cheng, Xinyuan, et al.
Pubblicazione: (2026)
Barriers to Universal Reasoning With Transformers (And How to Overcome Them)
di: Kraus, Oliver, et al.
Pubblicazione: (2026)
di: Kraus, Oliver, et al.
Pubblicazione: (2026)
If Probable, Then Acceptable? Understanding Conditional Acceptability Judgments in Large Language Models
di: Orth, Jasmin, et al.
Pubblicazione: (2025)
di: Orth, Jasmin, et al.
Pubblicazione: (2025)
Loop, Think, & Generalize: Implicit Reasoning in Recurrent-Depth Transformers
di: Kohli, Harsh, et al.
Pubblicazione: (2026)
di: Kohli, Harsh, et al.
Pubblicazione: (2026)
ExPLAIND: Unifying Model, Data, and Training Attribution to Study Model Behavior
di: Eichin, Florian, et al.
Pubblicazione: (2025)
di: Eichin, Florian, et al.
Pubblicazione: (2025)
From Memorization to Reasoning in the Spectrum of Loss Curvature
di: Merullo, Jack, et al.
Pubblicazione: (2025)
di: Merullo, Jack, et al.
Pubblicazione: (2025)
Resource-Lean Lexicon Induction for German Dialects
di: Litschko, Robert, et al.
Pubblicazione: (2026)
di: Litschko, Robert, et al.
Pubblicazione: (2026)
BlackboxNLP-2025 MIB Shared Task: Exploring Ensemble Strategies for Circuit Localization Methods
di: Mondorf, Philipp, et al.
Pubblicazione: (2025)
di: Mondorf, Philipp, et al.
Pubblicazione: (2025)
Decoupling the Effect of Chain-of-Thought Reasoning: A Human Label Variation Perspective
di: Chen, Beiduo, et al.
Pubblicazione: (2026)
di: Chen, Beiduo, et al.
Pubblicazione: (2026)
Rethinking LLM Memorization through the Lens of Adversarial Compression
di: Schwarzschild, Avi, et al.
Pubblicazione: (2024)
di: Schwarzschild, Avi, et al.
Pubblicazione: (2024)
Memorization vs. Reasoning: Updating LLMs with New Knowledge
di: Li, Aochong Oliver, et al.
Pubblicazione: (2025)
di: Li, Aochong Oliver, et al.
Pubblicazione: (2025)
MaiNLP at SemEval-2024 Task 1: Analyzing Source Language Selection in Cross-Lingual Textual Relatedness
di: Zhou, Shijia, et al.
Pubblicazione: (2024)
di: Zhou, Shijia, et al.
Pubblicazione: (2024)
The Validation Gap: A Mechanistic Analysis of How Language Models Compute Arithmetic but Fail to Validate It
di: Bertolazzi, Leonardo, et al.
Pubblicazione: (2025)
di: Bertolazzi, Leonardo, et al.
Pubblicazione: (2025)
Reasoning or Memorization? Unreliable Results of Reinforcement Learning Due to Data Contamination
di: Wu, Mingqi, et al.
Pubblicazione: (2025)
di: Wu, Mingqi, et al.
Pubblicazione: (2025)
FTFT: Efficient and Robust Fine-Tuning by Transferring Training Dynamics
di: Du, Yupei, et al.
Pubblicazione: (2023)
di: Du, Yupei, et al.
Pubblicazione: (2023)
Cross-Dialect Information Retrieval: Information Access in Low-Resource and High-Variance Languages
di: Litschko, Robert, et al.
Pubblicazione: (2024)
di: Litschko, Robert, et al.
Pubblicazione: (2024)
Inference-Time Rethinking with Latent Thought Vectors for Math Reasoning
di: Kong, Deqian, et al.
Pubblicazione: (2026)
di: Kong, Deqian, et al.
Pubblicazione: (2026)
Quantifying In-Context Reasoning Effects and Memorization Effects in LLMs
di: Lou, Siyu, et al.
Pubblicazione: (2024)
di: Lou, Siyu, et al.
Pubblicazione: (2024)
Donkii: Can Annotation Error Detection Methods Find Errors in Instruction-Tuning Datasets?
di: Weber-Genzel, Leon, et al.
Pubblicazione: (2023)
di: Weber-Genzel, Leon, et al.
Pubblicazione: (2023)
Rethinking Expert Trajectory Utilization in LLM Post-training for Mathematical Reasoning
di: Ding, Bowen, et al.
Pubblicazione: (2025)
di: Ding, Bowen, et al.
Pubblicazione: (2025)
Rethinking Entropy Regularization in Large Reasoning Models
di: Jiang, Yuxian, et al.
Pubblicazione: (2025)
di: Jiang, Yuxian, et al.
Pubblicazione: (2025)
Feature Extraction and Steering for Enhanced Chain-of-Thought Reasoning in Language Models
di: Li, Zihao, et al.
Pubblicazione: (2025)
di: Li, Zihao, et al.
Pubblicazione: (2025)
Make Every Letter Count: Building Dialect Variation Dictionaries from Monolingual Corpora
di: Litschko, Robert, et al.
Pubblicazione: (2025)
di: Litschko, Robert, et al.
Pubblicazione: (2025)
Information Asymmetry across Language Varieties: A Case Study on Cantonese-Mandarin and Bavarian-German QA
di: Pei, Renhao, et al.
Pubblicazione: (2026)
di: Pei, Renhao, et al.
Pubblicazione: (2026)
Rethinking Chain-of-Thought Reasoning for Videos
di: Zhong, Yiwu, et al.
Pubblicazione: (2025)
di: Zhong, Yiwu, et al.
Pubblicazione: (2025)
Understanding When Tree of Thoughts Succeeds: Larger Models Excel in Generation, Not Discrimination
di: Chen, Qiqi, et al.
Pubblicazione: (2024)
di: Chen, Qiqi, et al.
Pubblicazione: (2024)
DOTS: Learning to Reason Dynamically in LLMs via Optimal Reasoning Trajectories Search
di: Yue, Murong, et al.
Pubblicazione: (2024)
di: Yue, Murong, et al.
Pubblicazione: (2024)
Recitation over Reasoning: How Cutting-Edge Language Models Can Fail on Elementary School-Level Reasoning Problems?
di: Yan, Kai, et al.
Pubblicazione: (2025)
di: Yan, Kai, et al.
Pubblicazione: (2025)
Evaluating Large Language Models for Cross-Lingual Retrieval
di: Zuo, Longfei, et al.
Pubblicazione: (2025)
di: Zuo, Longfei, et al.
Pubblicazione: (2025)
Exploring Large Language Models for Product Attribute Value Identification
di: Sabeh, Kassem, et al.
Pubblicazione: (2024)
di: Sabeh, Kassem, et al.
Pubblicazione: (2024)
An Empirical Comparison of Generative Approaches for Product Attribute-Value Identification
di: Sabeh, Kassem, et al.
Pubblicazione: (2024)
di: Sabeh, Kassem, et al.
Pubblicazione: (2024)
Nudging the Boundaries of LLM Reasoning
di: Chen, Justin Chih-Yao, et al.
Pubblicazione: (2025)
di: Chen, Justin Chih-Yao, et al.
Pubblicazione: (2025)
An Analysis for Reasoning Bias of Language Models with Small Initialization
di: Yao, Junjie, et al.
Pubblicazione: (2025)
di: Yao, Junjie, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Circuit Compositions: Exploring Modular Structures in Transformer-Based Language Models
di: Mondorf, Philipp, et al.
Pubblicazione: (2024) -
Liar, Liar, Logical Mire: A Benchmark for Suppositional Reasoning in Large Language Models
di: Mondorf, Philipp, et al.
Pubblicazione: (2024) -
Comparing Inferential Strategies of Humans and Large Language Models in Deductive Reasoning
di: Mondorf, Philipp, et al.
Pubblicazione: (2024) -
Beyond Accuracy: Evaluating the Reasoning Behavior of Large Language Models -- A Survey
di: Mondorf, Philipp, et al.
Pubblicazione: (2024) -
Tracing Uncertainty in Language Model "Reasoning"
di: Grünefeld, Nils, et al.
Pubblicazione: (2026)